Preços

Multiplicadores de modelos, acertos de cache e primeira compra de API Key

Preços dos modelos

The RMB site uses a CNY 100 per 100M token benchmark, with CNY 10, 50, 100, 298, and 488 packages.

Usuários existentesJá tem uma API Key? Recarregue diretamenteTop up, look up orders, and confirm delivery here; 500M tokens cost CNY 488.Ir para a recarga
URL de acessoPrefira o Base URL com /v1
Base URL recomendadahttps://new.weeanno.shop/v1

Use esta primeiro na maioria dos clientes. Se o cliente recusar, mude para a alternativa.

Base URL alternativahttps://new.weeanno.shop

Diferentes roteadores de API validam os Base URLs de formas distintas, então teste o endereço ao trocar de modelo ou de cliente.

Cota unificadaUma chave para todos os modelos suportados
  • Os multiplicadores apenas refletem as diferenças de custo entre modelos; a cobrança permanece consistente.
  • Você não precisa de chaves separadas para modelos diferentes.
  • A cota não expira nem é zerada, o que se adapta a testes longos e a um uso estável em produção.
Cache

Cobrança por acerto de cache

Quando parte de uma requisição coincide com conteúdo processado antes, o sistema pode reutilizar esse cálculo em vez de cobrar novamente o custo total de entrada.

O que conta como acerto de cacheO contexto repetido pode ser reutilizado

Reutilizar o cache melhora a velocidade de resposta e reduz o custo de uso, especialmente em conversas de vários turnos, chamadas de fluxo de trabalho repetidas e loops de autocompletar código.

  • Entrada normal: cobrada pelo multiplicador do modelo.
  • Entrada em cache repetida: cobrada a partir de 0.1x.
  • Em modelos de alto custo, o multiplicador de cache pode subir para 0.2x ou ser pausado durante volatilidade upstream extrema.
Exemplo simples

Se você incluir repetidamente um grande contexto compartilhado ao longo de uma conversa longa, a parte repetida que coincide pode ser cobrada com um multiplicador menor.

Acertos de cache a partir de 0.1x

A parte de cache correspondente é cobrada por apenas 10% do custo normal de entrada.

Sessões longas podem custar menos

Perguntas de acompanhamento, chamadas de fluxo de trabalho e loops de autocompletar código reutilizam mais facilmente o contexto repetido.

Modelos premium podem se ajustar

Quando os custos upstream variam bruscamente, os multiplicadores de cache podem mudar e ser pausados em casos extremos.

Observação: os acertos de cache dependem de o conteúdo da requisição atender às condições de reutilização de cache do sistema.

Referência

Referência de preços dos modelos

Compare multiplicadores, custo por token convertido, tamanho de contexto e suporte a visão antes de comprar.

Atualizado conforme a lista de modelos mais recentePreços convertidos e multiplicadores atuais

Uma referência prática para entender o custo dos modelos antes da compra.

Assume max_tokens=8192
FornecedorModeloMultiplicadorExemplo: 2x significa que 100M tokens descontam 200M de cotaJanela de contexto recomendadaAssume max_tokens=8192Suporte a visão
China aggregate route(High concurrency)
claude-sonnet-4-6Fast response
0.5x1M✅
OpenAI
gpt-5.6-sol
6x258K✅
OpenAI
gpt-5.6-terra
1x258K✅
OpenAI
gpt-5.4
2x1M✅
OpenAI
gpt-5.5
4x258K✅
OpenAI
gpt-5.3-codex-spark
1x128K
OpenAI
gpt-image-2
per image1–2K 出图
OpenAI
gpt-image-2-4k
per image4K 出图
通义千问
qwen3.6-plus
3x1M✅
通义千问
qwen3.7-plus
4x1M✅
通义千问
qwen3.7-max
10x1M
通义千问
qwen3.8-max
20x1M✅
美团 LongCat
LongCat-2.0Agentic Coding
1x1M
腾讯混元
hy3
1x256K
MiniMax
MiniMax-M3
1x1M✅
MiniMax
image-01
per image
MiniMax
image-01-live
per second
StepFun
step-3.7-flashFast response
1x256K✅
ByteDance
doubao-seed-2.1-turbo
3x128K✅
Xiaomi
mimo-v2.5-pro
4x1M
Xiaomi
mimo-v2.5
2x1M✅
DeepSeek
deepseek-v4-pro
7.5x1M
DeepSeek
deepseek-v4-flash
2.5x1M
Kimi
kimi-k3
25x1M✅
Zhipu AI
glm-5.1
5x256K✅
Zhipu AI
glm-5.2
8x1M✅
xAI / Grok
grok-4.5
5x500K✅
Anthropic
claude-haiku-4-5-20251001
1x256K✅
Anthropic
claude-sonnet-5高能力主力
10x1M✅
Anthropic
claude-fable-5顶级任务
40x1M✅
Anthropic
claude-opus-4-6
15x1M✅
Anthropic
claude-opus-4-7
15x1M✅
Anthropic
claude-opus-4-8
15x1M✅
Anthropic
claude-opus-5
15x1M✅
Google
gemini-3.1-pro
10x1M✅
Google
gemini-3.5-flash
6x1M✅
China aggregate routeContexto 1M
(High concurrency)claude-sonnet-4-6Fast response
Multiplicador0.5x
context window1M
Visão✅
OpenAIContexto 258K
gpt-5.6-sol
Multiplicador6x
context window258K
Visão✅
OpenAIContexto 258K
gpt-5.6-terra
Multiplicador1x
context window258K
Visão✅
OpenAIContexto 1M
gpt-5.4
Multiplicador2x
context window1M
Visão✅
OpenAIContexto 258K
gpt-5.5
Multiplicador4x
context window258K
Visão✅
OpenAIContexto 128K
gpt-5.3-codex-spark
Multiplicador1x
context window128K
OpenAIContexto 1–2K 出图
gpt-image-2
Multiplicadorper image
context window1–2K 出图
OpenAIContexto 4K 出图
gpt-image-2-4k
Multiplicadorper image
context window4K 出图
通义千问Contexto 1M
qwen3.6-plus
Multiplicador3x
context window1M
Visão✅
通义千问Contexto 1M
qwen3.7-plus
Multiplicador4x
context window1M
Visão✅
通义千问Contexto 1M
qwen3.7-max
Multiplicador10x
context window1M
通义千问Contexto 1M
qwen3.8-max
Multiplicador20x
context window1M
Visão✅
美团 LongCatContexto 1M
LongCat-2.0Agentic Coding
Multiplicador1x
context window1M
腾讯混元Contexto 256K
hy3
Multiplicador1x
context window256K
MiniMaxContexto 1M
MiniMax-M3
Multiplicador1x
context window1M
Visão✅
MiniMax
image-01
Multiplicadorper image
MiniMax
image-01-live
Multiplicadorper second
StepFunContexto 256K
step-3.7-flashFast response
Multiplicador1x
context window256K
Visão✅
ByteDanceContexto 128K
doubao-seed-2.1-turbo
Multiplicador3x
context window128K
Visão✅
XiaomiContexto 1M
mimo-v2.5-pro
Multiplicador4x
context window1M
XiaomiContexto 1M
mimo-v2.5
Multiplicador2x
context window1M
Visão✅
DeepSeekContexto 1M
deepseek-v4-pro
Multiplicador7.5x
context window1M
DeepSeekContexto 1M
deepseek-v4-flash
Multiplicador2.5x
context window1M
KimiContexto 1M
kimi-k3
Multiplicador25x
context window1M
Visão✅
Zhipu AIContexto 256K
glm-5.1
Multiplicador5x
context window256K
Visão✅
Zhipu AIContexto 1M
glm-5.2
Multiplicador8x
context window1M
Visão✅
xAI / GrokContexto 500K
grok-4.5
Multiplicador5x
context window500K
Visão✅
AnthropicContexto 256K
claude-haiku-4-5-20251001
Multiplicador1x
context window256K
Visão✅
AnthropicContexto 1M
claude-sonnet-5高能力主力
Multiplicador10x
context window1M
Visão✅
AnthropicContexto 1M
claude-fable-5顶级任务
Multiplicador40x
context window1M
Visão✅
AnthropicContexto 1M
claude-opus-4-6
Multiplicador15x
context window1M
Visão✅
AnthropicContexto 1M
claude-opus-4-7
Multiplicador15x
context window1M
Visão✅
AnthropicContexto 1M
claude-opus-4-8
Multiplicador15x
context window1M
Visão✅
AnthropicContexto 1M
claude-opus-5
Multiplicador15x
context window1M
Visão✅
GoogleContexto 1M
gemini-3.1-pro
Multiplicador10x
context window1M
Visão✅
GoogleContexto 1M
gemini-3.5-flash
Multiplicador6x
context window1M
Visão✅

Os preços acima são conversões de referência com base nos multiplicadores atuais. Os modelos de imagem são cobrados por imagem ou por segundo. O consumo real segue o multiplicador da plataforma e o gasto da requisição; ✅ significa que há suporte a visão.

Próximo

Depois de entender a tabela de preços, faça a compra

Esta página explica os multiplicadores, os acertos de cache e o custo dos modelos. Usuários novos podem comprar uma API Key; os existentes podem recarregar uma chave existente.