Preços

Multiplicadores de modelos, acertos de cache e primeira compra de API Key

Preços dos modelos

Cobramos por unidade de 100M tokens: 1x custa 40 CNY, ou 0.40 CNY por 1M tokens. Os pacotes de compra e de recarga compartilham os mesmos seis níveis de autoatendimento; para volumes maiores, fale com o suporte.

Usuários existentesJá tem uma API Key? Recarregue diretamenteRecarga, consulta de pedidos e verificação de crédito, tudo aqui. Os pacotes novos chegam a 26.67 CNY / 100M tokens.Ir para a recarga
URL de acessoPrefira o Base URL com /v1
Base URL recomendadahttps://new.weeanno.shop/v1

Use esta primeiro na maioria dos clientes. Se o cliente recusar, mude para a alternativa.

Base URL alternativahttps://new.weeanno.shop

Diferentes roteadores de API validam os Base URLs de formas distintas, então teste o endereço ao trocar de modelo ou de cliente.

Cota unificadaUma chave para todos os modelos suportados
  • Os multiplicadores apenas refletem as diferenças de custo entre modelos; a cobrança permanece consistente.
  • Você não precisa de chaves separadas para modelos diferentes.
  • A cota não expira nem é zerada, o que se adapta a testes longos e a um uso estável em produção.
Cache

Cobrança por acerto de cache

Quando parte de uma requisição coincide com conteúdo processado antes, o sistema pode reutilizar esse cálculo em vez de cobrar novamente o custo total de entrada.

O que conta como acerto de cacheO contexto repetido pode ser reutilizado

Reutilizar o cache melhora a velocidade de resposta e reduz o custo de uso, especialmente em conversas de vários turnos, chamadas de fluxo de trabalho repetidas e loops de autocompletar código.

  • Entrada normal: cobrada pelo multiplicador do modelo.
  • Entrada em cache repetida: cobrada a partir de 0.1x.
  • Em modelos de alto custo, o multiplicador de cache pode subir para 0.2x ou ser pausado durante volatilidade upstream extrema.
Exemplo simples

Se você incluir repetidamente um grande contexto compartilhado ao longo de uma conversa longa, a parte repetida que coincide pode ser cobrada com um multiplicador menor.

Acertos de cache a partir de 0.1x

A parte de cache correspondente é cobrada por apenas 10% do custo normal de entrada.

Sessões longas podem custar menos

Perguntas de acompanhamento, chamadas de fluxo de trabalho e loops de autocompletar código reutilizam mais facilmente o contexto repetido.

Modelos premium podem se ajustar

Quando os custos upstream variam bruscamente, os multiplicadores de cache podem mudar e ser pausados em casos extremos.

Observação: os acertos de cache dependem de o conteúdo da requisição atender às condições de reutilização de cache do sistema.

Referência

Referência de preços dos modelos

Compare multiplicadores, custo por token convertido, tamanho de contexto e suporte a visão antes de comprar.

Atualizado conforme a lista de modelos mais recentePreços convertidos e multiplicadores atuais

Uma referência prática para entender o custo dos modelos antes da compra.

Assume max_tokens=8192
FornecedorModeloMultiplicadorExemplo: 2x significa que 100M tokens descontam 200M de cotaJanela de contexto recomendadaAssume max_tokens=8192Suporte a visão
China aggregate route(High concurrency)
claude-sonnet-4-6Fast response
0.5x1M
OpenAI
gpt-5.6-sol
6x258K
OpenAI
gpt-5.6-terra
1x258K
OpenAI
gpt-5.4
2x1M
OpenAI
gpt-5.5
4x258K
OpenAI
gpt-5.3-codex-spark
1x128K
OpenAI
gpt-image-2
per image1–2K 出图
OpenAI
gpt-image-2-4k
per image4K 出图
通义千问
qwen3.6-plus
3x1M
通义千问
qwen3.7-plus
4x1M
通义千问
qwen3.7-max
10x1M
通义千问
qwen3.8-max
20x1M
美团 LongCat
LongCat-2.0Agentic Coding
1x1M
腾讯混元
hy3
1x256K
MiniMax
MiniMax-M3
1x1M
MiniMax
image-01
per image
MiniMax
image-01-live
per second
StepFun
step-3.7-flashFast response
1x256K
ByteDance
doubao-seed-2.1-turbo
3x128K
Xiaomi
mimo-v2.5-pro
4x1M
Xiaomi
mimo-v2.5
2x1M
DeepSeek
deepseek-v4-pro
7.5x1M
DeepSeek
deepseek-v4-flash
2.5x1M
Kimi
kimi-k3
25x1M
Zhipu AI
glm-5.1
5x256K
Zhipu AI
glm-5.2
8x1M
xAI / Grok
grok-4.5
5x500K
Anthropic
claude-haiku-4-5-20251001
1x256K
Anthropic
claude-sonnet-5高能力主力
10x1M
Anthropic
claude-fable-5顶级任务
40x1M
Anthropic
claude-opus-4-6
15x1M
Anthropic
claude-opus-4-7
15x1M
Anthropic
claude-opus-4-8
15x1M
Anthropic
claude-opus-5
15x1M
Google
gemini-3.1-pro
10x1M
Google
gemini-3.5-flash
6x1M
China aggregate routeContexto 1M
(High concurrency)claude-sonnet-4-6Fast response
Multiplicador0.5x
context window1M
Visão
OpenAIContexto 258K
gpt-5.6-sol
Multiplicador6x
context window258K
Visão
OpenAIContexto 258K
gpt-5.6-terra
Multiplicador1x
context window258K
Visão
OpenAIContexto 1M
gpt-5.4
Multiplicador2x
context window1M
Visão
OpenAIContexto 258K
gpt-5.5
Multiplicador4x
context window258K
Visão
OpenAIContexto 128K
gpt-5.3-codex-spark
Multiplicador1x
context window128K
OpenAIContexto 1–2K 出图
gpt-image-2
Multiplicadorper image
context window1–2K 出图
OpenAIContexto 4K 出图
gpt-image-2-4k
Multiplicadorper image
context window4K 出图
通义千问Contexto 1M
qwen3.6-plus
Multiplicador3x
context window1M
Visão
通义千问Contexto 1M
qwen3.7-plus
Multiplicador4x
context window1M
Visão
通义千问Contexto 1M
qwen3.7-max
Multiplicador10x
context window1M
通义千问Contexto 1M
qwen3.8-max
Multiplicador20x
context window1M
Visão
美团 LongCatContexto 1M
LongCat-2.0Agentic Coding
Multiplicador1x
context window1M
腾讯混元Contexto 256K
hy3
Multiplicador1x
context window256K
MiniMaxContexto 1M
MiniMax-M3
Multiplicador1x
context window1M
Visão
MiniMax
image-01
Multiplicadorper image
MiniMax
image-01-live
Multiplicadorper second
StepFunContexto 256K
step-3.7-flashFast response
Multiplicador1x
context window256K
Visão
ByteDanceContexto 128K
doubao-seed-2.1-turbo
Multiplicador3x
context window128K
Visão
XiaomiContexto 1M
mimo-v2.5-pro
Multiplicador4x
context window1M
XiaomiContexto 1M
mimo-v2.5
Multiplicador2x
context window1M
Visão
DeepSeekContexto 1M
deepseek-v4-pro
Multiplicador7.5x
context window1M
DeepSeekContexto 1M
deepseek-v4-flash
Multiplicador2.5x
context window1M
KimiContexto 1M
kimi-k3
Multiplicador25x
context window1M
Visão
Zhipu AIContexto 256K
glm-5.1
Multiplicador5x
context window256K
Visão
Zhipu AIContexto 1M
glm-5.2
Multiplicador8x
context window1M
Visão
xAI / GrokContexto 500K
grok-4.5
Multiplicador5x
context window500K
Visão
AnthropicContexto 256K
claude-haiku-4-5-20251001
Multiplicador1x
context window256K
Visão
AnthropicContexto 1M
claude-sonnet-5高能力主力
Multiplicador10x
context window1M
Visão
AnthropicContexto 1M
claude-fable-5顶级任务
Multiplicador40x
context window1M
Visão
AnthropicContexto 1M
claude-opus-4-6
Multiplicador15x
context window1M
Visão
AnthropicContexto 1M
claude-opus-4-7
Multiplicador15x
context window1M
Visão
AnthropicContexto 1M
claude-opus-4-8
Multiplicador15x
context window1M
Visão
AnthropicContexto 1M
claude-opus-5
Multiplicador15x
context window1M
Visão
GoogleContexto 1M
gemini-3.1-pro
Multiplicador10x
context window1M
Visão
GoogleContexto 1M
gemini-3.5-flash
Multiplicador6x
context window1M
Visão

Os preços acima são conversões de referência com base nos multiplicadores atuais. Os modelos de imagem são cobrados por imagem ou por segundo. O consumo real segue o multiplicador da plataforma e o gasto da requisição; ✅ significa que há suporte a visão.

Próximo

Depois de entender a tabela de preços, faça a compra

Esta página explica os multiplicadores, os acertos de cache e o custo dos modelos. Usuários novos podem comprar uma API Key; os existentes podem recarregar uma chave existente.