Precios

Multiplicadores de modelos, aciertos de caché y primera compra de API Key

Precios de modelos

Cobramos por unidad de 100M tokens: 1x cuesta 40 CNY, o 0.40 CNY por 1M tokens. Los paquetes de compra y de recarga comparten los mismos seis niveles de autoservicio; para mayor volumen, contacta con soporte.

Usuarios existentes¿Ya tienes una API Key? Recárgala directamenteRecarga, consulta de pedidos y verificación de acreditación, todo aquí. Los paquetes nuevos bajan hasta 26.67 CNY / 100M tokens.Ir a recargar
URL de accesoPrefiere el Base URL con /v1
Base URL recomendadahttps://new.weeanno.shop/v1

Usa esta primero en la mayoría de clientes. Si tu cliente la rechaza, cambia a la alternativa.

Base URL alternativahttps://new.weeanno.shop

Los distintos enrutadores de API validan los Base URL de forma diferente, así que prueba la dirección al cambiar de modelo o de cliente.

Cuota unificadaUna clave para todos los modelos compatibles
  • Los multiplicadores solo reflejan las diferencias de coste entre modelos; la facturación se mantiene coherente.
  • No necesitas claves separadas para modelos distintos.
  • La cuota no caduca ni se reinicia, lo que se adapta a pruebas prolongadas y a un uso estable en producción.
Caché

Facturación por acierto de caché

Cuando parte de una solicitud coincide con contenido procesado antes, el sistema puede reutilizar ese cálculo en lugar de cobrar de nuevo el coste completo de entrada.

Qué cuenta como acierto de cachéEl contexto repetido se puede reutilizar

Reutilizar la caché mejora la velocidad de respuesta y reduce el coste de uso, sobre todo en conversaciones de varios turnos, llamadas de flujo de trabajo repetidas y bucles de autocompletado de código.

  • Entrada normal: se factura al multiplicador del modelo.
  • Entrada en caché repetida: se factura desde 0.1x.
  • En modelos de alto coste, el multiplicador de caché puede subir a 0.2x o pausarse durante una volatilidad upstream extrema.
Ejemplo sencillo

Si incluyes repetidamente un gran contexto compartido a lo largo de una conversación larga, la parte repetida que coincide puede cobrarse a un multiplicador menor.

Los aciertos de caché desde 0.1x

La parte de caché coincidente se factura solo al 10% del coste normal de entrada.

Las sesiones largas pueden costar menos

Las preguntas de seguimiento, las llamadas de flujo de trabajo y los bucles de autocompletado de código reutilizan más fácilmente el contexto repetido.

Los modelos premium pueden ajustarse

Cuando los costes upstream se mueven con fuerza, los multiplicadores de caché pueden cambiar y pausarse en casos extremos.

Nota: los aciertos de caché dependen de si el contenido de la solicitud cumple las condiciones de reutilización de caché del sistema.

Referencia

Referencia de precios de modelos

Compara multiplicadores, coste por token convertido, tamaño de contexto y soporte de visión antes de comprar.

Actualizado según la última lista de modelosPrecios convertidos y multiplicadores actuales

Una referencia práctica para entender el coste de los modelos antes de comprar.

Asume max_tokens=8192
ProveedorModeloMultiplicadorEjemplo: 2x significa que 100M tokens descuentan 200M de cuotaVentana de contexto recomendadaAsume max_tokens=8192Soporte de visión
China aggregate route(High concurrency)
claude-sonnet-4-6Fast response
0.5x1M
OpenAI
gpt-5.6-sol
6x258K
OpenAI
gpt-5.6-terra
1x258K
OpenAI
gpt-5.4
2x1M
OpenAI
gpt-5.5
4x258K
OpenAI
gpt-5.3-codex-spark
1x128K
OpenAI
gpt-image-2
per image1–2K 出图
OpenAI
gpt-image-2-4k
per image4K 出图
通义千问
qwen3.6-plus
3x1M
通义千问
qwen3.7-plus
4x1M
通义千问
qwen3.7-max
10x1M
通义千问
qwen3.8-max
20x1M
美团 LongCat
LongCat-2.0Agentic Coding
1x1M
腾讯混元
hy3
1x256K
MiniMax
MiniMax-M3
1x1M
MiniMax
image-01
per image
MiniMax
image-01-live
per second
StepFun
step-3.7-flashFast response
1x256K
ByteDance
doubao-seed-2.1-turbo
3x128K
Xiaomi
mimo-v2.5-pro
4x1M
Xiaomi
mimo-v2.5
2x1M
DeepSeek
deepseek-v4-pro
7.5x1M
DeepSeek
deepseek-v4-flash
2.5x1M
Kimi
kimi-k3
25x1M
Zhipu AI
glm-5.1
5x256K
Zhipu AI
glm-5.2
8x1M
xAI / Grok
grok-4.5
5x500K
Anthropic
claude-haiku-4-5-20251001
1x256K
Anthropic
claude-sonnet-5高能力主力
10x1M
Anthropic
claude-fable-5顶级任务
40x1M
Anthropic
claude-opus-4-6
15x1M
Anthropic
claude-opus-4-7
15x1M
Anthropic
claude-opus-4-8
15x1M
Anthropic
claude-opus-5
15x1M
Google
gemini-3.1-pro
10x1M
Google
gemini-3.5-flash
6x1M
China aggregate routeContexto 1M
(High concurrency)claude-sonnet-4-6Fast response
Multiplicador0.5x
context window1M
Visión
OpenAIContexto 258K
gpt-5.6-sol
Multiplicador6x
context window258K
Visión
OpenAIContexto 258K
gpt-5.6-terra
Multiplicador1x
context window258K
Visión
OpenAIContexto 1M
gpt-5.4
Multiplicador2x
context window1M
Visión
OpenAIContexto 258K
gpt-5.5
Multiplicador4x
context window258K
Visión
OpenAIContexto 128K
gpt-5.3-codex-spark
Multiplicador1x
context window128K
OpenAIContexto 1–2K 出图
gpt-image-2
Multiplicadorper image
context window1–2K 出图
OpenAIContexto 4K 出图
gpt-image-2-4k
Multiplicadorper image
context window4K 出图
通义千问Contexto 1M
qwen3.6-plus
Multiplicador3x
context window1M
Visión
通义千问Contexto 1M
qwen3.7-plus
Multiplicador4x
context window1M
Visión
通义千问Contexto 1M
qwen3.7-max
Multiplicador10x
context window1M
通义千问Contexto 1M
qwen3.8-max
Multiplicador20x
context window1M
Visión
美团 LongCatContexto 1M
LongCat-2.0Agentic Coding
Multiplicador1x
context window1M
腾讯混元Contexto 256K
hy3
Multiplicador1x
context window256K
MiniMaxContexto 1M
MiniMax-M3
Multiplicador1x
context window1M
Visión
MiniMax
image-01
Multiplicadorper image
MiniMax
image-01-live
Multiplicadorper second
StepFunContexto 256K
step-3.7-flashFast response
Multiplicador1x
context window256K
Visión
ByteDanceContexto 128K
doubao-seed-2.1-turbo
Multiplicador3x
context window128K
Visión
XiaomiContexto 1M
mimo-v2.5-pro
Multiplicador4x
context window1M
XiaomiContexto 1M
mimo-v2.5
Multiplicador2x
context window1M
Visión
DeepSeekContexto 1M
deepseek-v4-pro
Multiplicador7.5x
context window1M
DeepSeekContexto 1M
deepseek-v4-flash
Multiplicador2.5x
context window1M
KimiContexto 1M
kimi-k3
Multiplicador25x
context window1M
Visión
Zhipu AIContexto 256K
glm-5.1
Multiplicador5x
context window256K
Visión
Zhipu AIContexto 1M
glm-5.2
Multiplicador8x
context window1M
Visión
xAI / GrokContexto 500K
grok-4.5
Multiplicador5x
context window500K
Visión
AnthropicContexto 256K
claude-haiku-4-5-20251001
Multiplicador1x
context window256K
Visión
AnthropicContexto 1M
claude-sonnet-5高能力主力
Multiplicador10x
context window1M
Visión
AnthropicContexto 1M
claude-fable-5顶级任务
Multiplicador40x
context window1M
Visión
AnthropicContexto 1M
claude-opus-4-6
Multiplicador15x
context window1M
Visión
AnthropicContexto 1M
claude-opus-4-7
Multiplicador15x
context window1M
Visión
AnthropicContexto 1M
claude-opus-4-8
Multiplicador15x
context window1M
Visión
AnthropicContexto 1M
claude-opus-5
Multiplicador15x
context window1M
Visión
GoogleContexto 1M
gemini-3.1-pro
Multiplicador10x
context window1M
Visión
GoogleContexto 1M
gemini-3.5-flash
Multiplicador6x
context window1M
Visión

Los precios anteriores son conversiones de referencia según los multiplicadores actuales. Los modelos de imagen se facturan por imagen o por segundo. El consumo real sigue el multiplicador de la plataforma y el gasto de la solicitud; ✅ significa que se admite visión.

Siguiente

Cuando tengas clara la tabla de precios, realiza la compra

Esta página explica los multiplicadores, los aciertos de caché y el coste de los modelos. Los usuarios nuevos pueden comprar una API Key; los existentes pueden recargar una clave existente.