Preise

Modell-Multiplikatoren, Cache-Hits und erster API-Schlüssel-Kauf

Modellpreise

The RMB site uses a CNY 100 per 100M token benchmark, with CNY 10, 50, 100, 298, and 488 packages.

Bestehende NutzerSie haben bereits einen API-Schlüssel? Laden Sie ihn direkt aufTop up, look up orders, and confirm delivery here; 500M tokens cost CNY 488.Zum Aufladen
Zugriffs-URLBevorzugen Sie die Base URL mit /v1
Empfohlene Base URLhttps://new.weeanno.shop/v1

Verwenden Sie diese zuerst für die meisten Clients. Wenn Ihr Client sie ablehnt, wechseln Sie zur Ausweichadresse.

Ausweich-Base-URLhttps://new.weeanno.shop

Verschiedene API-Router validieren Base URLs unterschiedlich, testen Sie die Adresse daher beim Wechsel von Modell oder Client.

Einheitliches KontingentEin Schlüssel für alle unterstützten Modelle
  • Multiplikatoren bilden nur die Kostenunterschiede zwischen Modellen ab; die Abrechnung bleibt einheitlich.
  • Sie benötigen keine separaten Schlüssel für verschiedene Modelle.
  • Das Kontingent verfällt nicht und wird nicht zurückgesetzt, was sich für langfristige Tests und stabilen Produktivbetrieb eignet.
Cache

Cache-Hit-Abrechnung

Wenn ein Teil einer Anfrage mit bereits verarbeitetem Inhalt übereinstimmt, kann das System diese Berechnung wiederverwenden, statt die vollen Eingabekosten erneut zu berechnen.

Was als Cache-Hit zähltWiederholter Kontext kann wiederverwendet werden

Die Wiederverwendung des Caches verbessert die Antwortgeschwindigkeit und senkt die Nutzungskosten, besonders bei mehrstufigen Chats, wiederholten Workflow-Aufrufen und Code-Vervollständigungsschleifen.

  • Normale Eingabe: wird zum Modell-Multiplikator berechnet.
  • Wiederholte zwischengespeicherte Eingabe: wird ab 0.1x berechnet.
  • Bei kostenintensiven Modellen kann der Cache-Multiplikator auf 0.2x steigen oder bei extremer vorgelagerter Volatilität ausgesetzt werden.
Einfaches Beispiel

Wenn Sie über eine lange Konversation hinweg wiederholt einen großen gemeinsamen Kontext einfügen, kann der übereinstimmende wiederholte Teil zu einem niedrigeren Multiplikator berechnet werden.

Cache-Hits beginnen bei 0.1x

Übereinstimmender Cache-Input wird nur mit 10% der regulären Eingabekosten berechnet.

Längere Sitzungen können günstiger sein

Folgeanfragen, Workflow-Aufrufe und Code-Vervollständigungsschleifen nutzen wiederholten Kontext eher erneut.

Premium-Modelle können angepasst werden

Wenn die vorgelagerten Kosten stark schwanken, können sich die Cache-Multiplikatoren ändern und in Extremfällen ausgesetzt werden.

Hinweis: Ob ein Cache-Hit entsteht, hängt davon ab, ob der Anfrageinhalt die Bedingungen für die Cache-Wiederverwendung des Systems erfüllt.

Referenz

Modellpreis-Referenz

Vergleichen Sie Multiplikatoren, umgerechnete Kosten pro Token, Kontextgröße und Bildunterstützung, bevor Sie kaufen.

Aktualisiert anhand der neuesten ModelllisteAktuelle umgerechnete Preise und Multiplikatoren

Eine praktische Referenz, um die Modellkosten vor dem Kauf zu verstehen.

Annahme: max_tokens=8192
AnbieterModellMultiplikatorBeispiel: 2x bedeutet, dass 100M Tokens 200M vom Kontingent abziehenEmpfohlenes KontextfensterAnnahme: max_tokens=8192Bildunterstützung
China aggregate route(High concurrency)
claude-sonnet-4-6Fast response
0.5x1M✅
OpenAI
gpt-5.6-sol
6x258K✅
OpenAI
gpt-5.6-terra
1x258K✅
OpenAI
gpt-5.4
2x1M✅
OpenAI
gpt-5.5
4x258K✅
OpenAI
gpt-5.3-codex-spark
1x128K
OpenAI
gpt-image-2
per image1–2K 出图
OpenAI
gpt-image-2-4k
per image4K 出图
通义千问
qwen3.6-plus
3x1M✅
通义千问
qwen3.7-plus
4x1M✅
通义千问
qwen3.7-max
10x1M
通义千问
qwen3.8-max
20x1M✅
美团 LongCat
LongCat-2.0Agentic Coding
1x1M
腾讯混元
hy3
1x256K
MiniMax
MiniMax-M3
1x1M✅
MiniMax
image-01
per image
MiniMax
image-01-live
per second
StepFun
step-3.7-flashFast response
1x256K✅
ByteDance
doubao-seed-2.1-turbo
3x128K✅
Xiaomi
mimo-v2.5-pro
4x1M
Xiaomi
mimo-v2.5
2x1M✅
DeepSeek
deepseek-v4-pro
7.5x1M
DeepSeek
deepseek-v4-flash
2.5x1M
Kimi
kimi-k3
25x1M✅
Zhipu AI
glm-5.1
5x256K✅
Zhipu AI
glm-5.2
8x1M✅
xAI / Grok
grok-4.5
5x500K✅
Anthropic
claude-haiku-4-5-20251001
1x256K✅
Anthropic
claude-sonnet-5高能力主力
10x1M✅
Anthropic
claude-fable-5顶级任务
40x1M✅
Anthropic
claude-opus-4-6
15x1M✅
Anthropic
claude-opus-4-7
15x1M✅
Anthropic
claude-opus-4-8
15x1M✅
Anthropic
claude-opus-5
15x1M✅
Google
gemini-3.1-pro
10x1M✅
Google
gemini-3.5-flash
6x1M✅
China aggregate routeKontext 1M
(High concurrency)claude-sonnet-4-6Fast response
Multiplikator0.5x
context window1M
Vision✅
OpenAIKontext 258K
gpt-5.6-sol
Multiplikator6x
context window258K
Vision✅
OpenAIKontext 258K
gpt-5.6-terra
Multiplikator1x
context window258K
Vision✅
OpenAIKontext 1M
gpt-5.4
Multiplikator2x
context window1M
Vision✅
OpenAIKontext 258K
gpt-5.5
Multiplikator4x
context window258K
Vision✅
OpenAIKontext 128K
gpt-5.3-codex-spark
Multiplikator1x
context window128K
OpenAIKontext 1–2K 出图
gpt-image-2
Multiplikatorper image
context window1–2K 出图
OpenAIKontext 4K 出图
gpt-image-2-4k
Multiplikatorper image
context window4K 出图
通义千问Kontext 1M
qwen3.6-plus
Multiplikator3x
context window1M
Vision✅
通义千问Kontext 1M
qwen3.7-plus
Multiplikator4x
context window1M
Vision✅
通义千问Kontext 1M
qwen3.7-max
Multiplikator10x
context window1M
通义千问Kontext 1M
qwen3.8-max
Multiplikator20x
context window1M
Vision✅
美团 LongCatKontext 1M
LongCat-2.0Agentic Coding
Multiplikator1x
context window1M
腾讯混元Kontext 256K
hy3
Multiplikator1x
context window256K
MiniMaxKontext 1M
MiniMax-M3
Multiplikator1x
context window1M
Vision✅
MiniMax
image-01
Multiplikatorper image
MiniMax
image-01-live
Multiplikatorper second
StepFunKontext 256K
step-3.7-flashFast response
Multiplikator1x
context window256K
Vision✅
ByteDanceKontext 128K
doubao-seed-2.1-turbo
Multiplikator3x
context window128K
Vision✅
XiaomiKontext 1M
mimo-v2.5-pro
Multiplikator4x
context window1M
XiaomiKontext 1M
mimo-v2.5
Multiplikator2x
context window1M
Vision✅
DeepSeekKontext 1M
deepseek-v4-pro
Multiplikator7.5x
context window1M
DeepSeekKontext 1M
deepseek-v4-flash
Multiplikator2.5x
context window1M
KimiKontext 1M
kimi-k3
Multiplikator25x
context window1M
Vision✅
Zhipu AIKontext 256K
glm-5.1
Multiplikator5x
context window256K
Vision✅
Zhipu AIKontext 1M
glm-5.2
Multiplikator8x
context window1M
Vision✅
xAI / GrokKontext 500K
grok-4.5
Multiplikator5x
context window500K
Vision✅
AnthropicKontext 256K
claude-haiku-4-5-20251001
Multiplikator1x
context window256K
Vision✅
AnthropicKontext 1M
claude-sonnet-5高能力主力
Multiplikator10x
context window1M
Vision✅
AnthropicKontext 1M
claude-fable-5顶级任务
Multiplikator40x
context window1M
Vision✅
AnthropicKontext 1M
claude-opus-4-6
Multiplikator15x
context window1M
Vision✅
AnthropicKontext 1M
claude-opus-4-7
Multiplikator15x
context window1M
Vision✅
AnthropicKontext 1M
claude-opus-4-8
Multiplikator15x
context window1M
Vision✅
AnthropicKontext 1M
claude-opus-5
Multiplikator15x
context window1M
Vision✅
GoogleKontext 1M
gemini-3.1-pro
Multiplikator10x
context window1M
Vision✅
GoogleKontext 1M
gemini-3.5-flash
Multiplikator6x
context window1M
Vision✅

Die obigen Preise sind Referenzumrechnungen auf Basis der aktuellen Multiplikatoren. Bildmodelle werden pro Bild oder pro Sekunde berechnet. Der tatsächliche Abzug richtet sich nach dem Plattform-Multiplikator und dem Verbrauch der Anfrage; ✅ bedeutet, dass Vision unterstützt wird.

Weiter

Sobald die Preistabelle klar ist, gehen Sie zum Kauf über

Diese Seite erläutert Multiplikatoren, Cache-Hits und Modellkosten. Neue Nutzer können einen API-Schlüssel kaufen; bestehende Nutzer können einen vorhandenen Schlüssel aufladen.