Tarifs

Multiplicateurs de modèles, cache hit et premier achat de clé API

Tarifs des modèles

La facturation se fait par unité de 100M tokens : 1x coûte 40 CNY, soit 0.40 CNY par 1M tokens. Les packs d'achat et de recharge partagent les mêmes six paliers en libre-service ; pour un volume plus important, contactez le support.

Utilisateurs existantsVous avez déjà une clé API ? Rechargez-la directementRecharge, recherche de commande et vérification de crédit, tout se passe ici. Les nouveaux packs descendent jusqu'à 26.67 CNY / 100M tokens.Aller à la recharge
URL d'accèsPréférez le Base URL avec /v1
Base URL recommandéehttps://new.weeanno.shop/v1

Utilisez celle-ci en premier pour la plupart des clients. Si votre client la rejette, passez à l'adresse de secours.

Base URL de secourshttps://new.weeanno.shop

Les différents routeurs d'API valident les Base URL différemment, testez donc l'adresse lorsque vous changez de modèle ou de client.

Quota unifiéUne seule clé pour tous les modèles pris en charge
  • Les multiplicateurs ne font que refléter les écarts de coût entre modèles ; la facturation reste cohérente.
  • Vous n'avez pas besoin de clés distinctes pour des modèles différents.
  • Le quota n'expire pas et ne se réinitialise pas, ce qui convient aux tests de longue durée et à un usage stable en production.
Cache

Facturation au cache hit

Lorsqu'une partie d'une requête correspond à un contenu déjà traité, le système peut réutiliser ce calcul au lieu de facturer à nouveau le coût d'entrée complet.

Qu'est-ce qu'un cache hitLe contexte répété peut être réutilisé

Réutiliser le cache améliore la vitesse de réponse et réduit le coût d'usage, surtout dans les conversations à plusieurs tours, les appels de workflow répétés et les boucles de complétion de code.

  • Entrée normale : facturée au multiplicateur du modèle.
  • Entrée en cache répétée : facturée à partir de 0.1x.
  • Pour les modèles à coût élevé, le multiplicateur de cache peut monter à 0.2x ou être suspendu lors d'une forte volatilité amont.
Exemple simple

Si vous incluez à plusieurs reprises un grand contexte partagé au fil d'une longue conversation, la partie répétée correspondante peut être facturée à un multiplicateur plus bas.

Le cache hit démarre à 0.1x

La partie en cache correspondante n'est facturée qu'à 10% du coût d'entrée normal.

Les sessions longues peuvent coûter moins cher

Les questions de suivi, les appels de workflow et les boucles de complétion de code réutilisent plus facilement le contexte répété.

Les modèles premium peuvent être ajustés

Lorsque les coûts amont varient fortement, les multiplicateurs de cache peuvent changer et être suspendus dans les cas extrêmes.

Remarque : le cache hit dépend du fait que le contenu de la requête remplisse les conditions de réutilisation du cache du système.

Référence

Référence des prix des modèles

Comparez les multiplicateurs, le coût converti par token, la taille de contexte et la prise en charge de la vision avant d'acheter.

Mis à jour selon la dernière liste de modèlesPrix convertis et multiplicateurs actuels

Une référence pratique pour comprendre le coût des modèles avant l'achat.

Suppose max_tokens=8192
FournisseurModèleMultiplicateurExemple : 2x signifie que 100M tokens déduisent 200M du quotaFenêtre de contexte recommandéeSuppose max_tokens=8192Prise en charge de la vision
China aggregate route(High concurrency)
claude-sonnet-4-6Fast response
0.5x1M
OpenAI
gpt-5.6-sol
6x258K
OpenAI
gpt-5.6-terra
1x258K
OpenAI
gpt-5.4
2x1M
OpenAI
gpt-5.5
4x258K
OpenAI
gpt-5.3-codex-spark
1x128K
OpenAI
gpt-image-2
per image1–2K 出图
OpenAI
gpt-image-2-4k
per image4K 出图
通义千问
qwen3.6-plus
3x1M
通义千问
qwen3.7-plus
4x1M
通义千问
qwen3.7-max
10x1M
通义千问
qwen3.8-max
20x1M
美团 LongCat
LongCat-2.0Agentic Coding
1x1M
腾讯混元
hy3
1x256K
MiniMax
MiniMax-M3
1x1M
MiniMax
image-01
per image
MiniMax
image-01-live
per second
StepFun
step-3.7-flashFast response
1x256K
ByteDance
doubao-seed-2.1-turbo
3x128K
Xiaomi
mimo-v2.5-pro
4x1M
Xiaomi
mimo-v2.5
2x1M
DeepSeek
deepseek-v4-pro
7.5x1M
DeepSeek
deepseek-v4-flash
2.5x1M
Kimi
kimi-k3
25x1M
Zhipu AI
glm-5.1
5x256K
Zhipu AI
glm-5.2
8x1M
xAI / Grok
grok-4.5
5x500K
Anthropic
claude-haiku-4-5-20251001
1x256K
Anthropic
claude-sonnet-5高能力主力
10x1M
Anthropic
claude-fable-5顶级任务
40x1M
Anthropic
claude-opus-4-6
15x1M
Anthropic
claude-opus-4-7
15x1M
Anthropic
claude-opus-4-8
15x1M
Anthropic
claude-opus-5
15x1M
Google
gemini-3.1-pro
10x1M
Google
gemini-3.5-flash
6x1M
China aggregate routeContexte 1M
(High concurrency)claude-sonnet-4-6Fast response
Multiplicateur0.5x
context window1M
Vision
OpenAIContexte 258K
gpt-5.6-sol
Multiplicateur6x
context window258K
Vision
OpenAIContexte 258K
gpt-5.6-terra
Multiplicateur1x
context window258K
Vision
OpenAIContexte 1M
gpt-5.4
Multiplicateur2x
context window1M
Vision
OpenAIContexte 258K
gpt-5.5
Multiplicateur4x
context window258K
Vision
OpenAIContexte 128K
gpt-5.3-codex-spark
Multiplicateur1x
context window128K
OpenAIContexte 1–2K 出图
gpt-image-2
Multiplicateurper image
context window1–2K 出图
OpenAIContexte 4K 出图
gpt-image-2-4k
Multiplicateurper image
context window4K 出图
通义千问Contexte 1M
qwen3.6-plus
Multiplicateur3x
context window1M
Vision
通义千问Contexte 1M
qwen3.7-plus
Multiplicateur4x
context window1M
Vision
通义千问Contexte 1M
qwen3.7-max
Multiplicateur10x
context window1M
通义千问Contexte 1M
qwen3.8-max
Multiplicateur20x
context window1M
Vision
美团 LongCatContexte 1M
LongCat-2.0Agentic Coding
Multiplicateur1x
context window1M
腾讯混元Contexte 256K
hy3
Multiplicateur1x
context window256K
MiniMaxContexte 1M
MiniMax-M3
Multiplicateur1x
context window1M
Vision
MiniMax
image-01
Multiplicateurper image
MiniMax
image-01-live
Multiplicateurper second
StepFunContexte 256K
step-3.7-flashFast response
Multiplicateur1x
context window256K
Vision
ByteDanceContexte 128K
doubao-seed-2.1-turbo
Multiplicateur3x
context window128K
Vision
XiaomiContexte 1M
mimo-v2.5-pro
Multiplicateur4x
context window1M
XiaomiContexte 1M
mimo-v2.5
Multiplicateur2x
context window1M
Vision
DeepSeekContexte 1M
deepseek-v4-pro
Multiplicateur7.5x
context window1M
DeepSeekContexte 1M
deepseek-v4-flash
Multiplicateur2.5x
context window1M
KimiContexte 1M
kimi-k3
Multiplicateur25x
context window1M
Vision
Zhipu AIContexte 256K
glm-5.1
Multiplicateur5x
context window256K
Vision
Zhipu AIContexte 1M
glm-5.2
Multiplicateur8x
context window1M
Vision
xAI / GrokContexte 500K
grok-4.5
Multiplicateur5x
context window500K
Vision
AnthropicContexte 256K
claude-haiku-4-5-20251001
Multiplicateur1x
context window256K
Vision
AnthropicContexte 1M
claude-sonnet-5高能力主力
Multiplicateur10x
context window1M
Vision
AnthropicContexte 1M
claude-fable-5顶级任务
Multiplicateur40x
context window1M
Vision
AnthropicContexte 1M
claude-opus-4-6
Multiplicateur15x
context window1M
Vision
AnthropicContexte 1M
claude-opus-4-7
Multiplicateur15x
context window1M
Vision
AnthropicContexte 1M
claude-opus-4-8
Multiplicateur15x
context window1M
Vision
AnthropicContexte 1M
claude-opus-5
Multiplicateur15x
context window1M
Vision
GoogleContexte 1M
gemini-3.1-pro
Multiplicateur10x
context window1M
Vision
GoogleContexte 1M
gemini-3.5-flash
Multiplicateur6x
context window1M
Vision

Les prix ci-dessus sont des conversions de référence basées sur les multiplicateurs actuels. Les modèles d'image sont facturés par image ou par seconde. La consommation réelle suit le multiplicateur de la plateforme et la consommation de la requête ; ✅ signifie que la vision est prise en charge.

Suivant

Une fois la grille tarifaire claire, passez à l'achat

Cette page explique les multiplicateurs, les cache hits et le coût des modèles. Les nouveaux utilisateurs peuvent acheter une clé API ; les utilisateurs existants peuvent recharger une clé existante.