Preise

Modell-Multiplikatoren, Cache-Hits und erster API-Schlüssel-Kauf

Modellpreise

Die Abrechnung erfolgt pro Einheit von 100M Tokens: 1x kostet 40 CNY bzw. 0.40 CNY pro 1M Tokens. Kauf- und Aufladepakete teilen sich dieselben sechs Self-Service-Stufen; für größere Mengen kontaktieren Sie den Support.

Bestehende NutzerSie haben bereits einen API-Schlüssel? Laden Sie ihn direkt aufAufladen, Bestellsuche und Gutschriftsprüfung erfolgen alle hier. Neue Pakete starten bei 26.67 CNY / 100M Tokens.Zum Aufladen
Zugriffs-URLBevorzugen Sie die Base URL mit /v1
Empfohlene Base URLhttps://new.weeanno.shop/v1

Verwenden Sie diese zuerst für die meisten Clients. Wenn Ihr Client sie ablehnt, wechseln Sie zur Ausweichadresse.

Ausweich-Base-URLhttps://new.weeanno.shop

Verschiedene API-Router validieren Base URLs unterschiedlich, testen Sie die Adresse daher beim Wechsel von Modell oder Client.

Einheitliches KontingentEin Schlüssel für alle unterstützten Modelle
  • Multiplikatoren bilden nur die Kostenunterschiede zwischen Modellen ab; die Abrechnung bleibt einheitlich.
  • Sie benötigen keine separaten Schlüssel für verschiedene Modelle.
  • Das Kontingent verfällt nicht und wird nicht zurückgesetzt, was sich für langfristige Tests und stabilen Produktivbetrieb eignet.
Cache

Cache-Hit-Abrechnung

Wenn ein Teil einer Anfrage mit bereits verarbeitetem Inhalt übereinstimmt, kann das System diese Berechnung wiederverwenden, statt die vollen Eingabekosten erneut zu berechnen.

Was als Cache-Hit zähltWiederholter Kontext kann wiederverwendet werden

Die Wiederverwendung des Caches verbessert die Antwortgeschwindigkeit und senkt die Nutzungskosten, besonders bei mehrstufigen Chats, wiederholten Workflow-Aufrufen und Code-Vervollständigungsschleifen.

  • Normale Eingabe: wird zum Modell-Multiplikator berechnet.
  • Wiederholte zwischengespeicherte Eingabe: wird ab 0.1x berechnet.
  • Bei kostenintensiven Modellen kann der Cache-Multiplikator auf 0.2x steigen oder bei extremer vorgelagerter Volatilität ausgesetzt werden.
Einfaches Beispiel

Wenn Sie über eine lange Konversation hinweg wiederholt einen großen gemeinsamen Kontext einfügen, kann der übereinstimmende wiederholte Teil zu einem niedrigeren Multiplikator berechnet werden.

Cache-Hits beginnen bei 0.1x

Übereinstimmender Cache-Input wird nur mit 10% der regulären Eingabekosten berechnet.

Längere Sitzungen können günstiger sein

Folgeanfragen, Workflow-Aufrufe und Code-Vervollständigungsschleifen nutzen wiederholten Kontext eher erneut.

Premium-Modelle können angepasst werden

Wenn die vorgelagerten Kosten stark schwanken, können sich die Cache-Multiplikatoren ändern und in Extremfällen ausgesetzt werden.

Hinweis: Ob ein Cache-Hit entsteht, hängt davon ab, ob der Anfrageinhalt die Bedingungen für die Cache-Wiederverwendung des Systems erfüllt.

Referenz

Modellpreis-Referenz

Vergleichen Sie Multiplikatoren, umgerechnete Kosten pro Token, Kontextgröße und Bildunterstützung, bevor Sie kaufen.

Aktualisiert anhand der neuesten ModelllisteAktuelle umgerechnete Preise und Multiplikatoren

Eine praktische Referenz, um die Modellkosten vor dem Kauf zu verstehen.

Annahme: max_tokens=8192
AnbieterModellMultiplikatorBeispiel: 2x bedeutet, dass 100M Tokens 200M vom Kontingent abziehenEmpfohlenes KontextfensterAnnahme: max_tokens=8192Bildunterstützung
China aggregate route(High concurrency)
claude-sonnet-4-6Fast response
0.5x1M
OpenAI
gpt-5.6-sol
6x258K
OpenAI
gpt-5.6-terra
1x258K
OpenAI
gpt-5.4
2x1M
OpenAI
gpt-5.5
4x258K
OpenAI
gpt-5.3-codex-spark
1x128K
OpenAI
gpt-image-2
per image1–2K 出图
OpenAI
gpt-image-2-4k
per image4K 出图
通义千问
qwen3.6-plus
3x1M
通义千问
qwen3.7-plus
4x1M
通义千问
qwen3.7-max
10x1M
通义千问
qwen3.8-max
20x1M
美团 LongCat
LongCat-2.0Agentic Coding
1x1M
腾讯混元
hy3
1x256K
MiniMax
MiniMax-M3
1x1M
MiniMax
image-01
per image
MiniMax
image-01-live
per second
StepFun
step-3.7-flashFast response
1x256K
ByteDance
doubao-seed-2.1-turbo
3x128K
Xiaomi
mimo-v2.5-pro
4x1M
Xiaomi
mimo-v2.5
2x1M
DeepSeek
deepseek-v4-pro
7.5x1M
DeepSeek
deepseek-v4-flash
2.5x1M
Kimi
kimi-k3
25x1M
Zhipu AI
glm-5.1
5x256K
Zhipu AI
glm-5.2
8x1M
xAI / Grok
grok-4.5
5x500K
Anthropic
claude-haiku-4-5-20251001
1x256K
Anthropic
claude-sonnet-5高能力主力
10x1M
Anthropic
claude-fable-5顶级任务
40x1M
Anthropic
claude-opus-4-6
15x1M
Anthropic
claude-opus-4-7
15x1M
Anthropic
claude-opus-4-8
15x1M
Anthropic
claude-opus-5
15x1M
Google
gemini-3.1-pro
10x1M
Google
gemini-3.5-flash
6x1M
China aggregate routeKontext 1M
(High concurrency)claude-sonnet-4-6Fast response
Multiplikator0.5x
context window1M
Vision
OpenAIKontext 258K
gpt-5.6-sol
Multiplikator6x
context window258K
Vision
OpenAIKontext 258K
gpt-5.6-terra
Multiplikator1x
context window258K
Vision
OpenAIKontext 1M
gpt-5.4
Multiplikator2x
context window1M
Vision
OpenAIKontext 258K
gpt-5.5
Multiplikator4x
context window258K
Vision
OpenAIKontext 128K
gpt-5.3-codex-spark
Multiplikator1x
context window128K
OpenAIKontext 1–2K 出图
gpt-image-2
Multiplikatorper image
context window1–2K 出图
OpenAIKontext 4K 出图
gpt-image-2-4k
Multiplikatorper image
context window4K 出图
通义千问Kontext 1M
qwen3.6-plus
Multiplikator3x
context window1M
Vision
通义千问Kontext 1M
qwen3.7-plus
Multiplikator4x
context window1M
Vision
通义千问Kontext 1M
qwen3.7-max
Multiplikator10x
context window1M
通义千问Kontext 1M
qwen3.8-max
Multiplikator20x
context window1M
Vision
美团 LongCatKontext 1M
LongCat-2.0Agentic Coding
Multiplikator1x
context window1M
腾讯混元Kontext 256K
hy3
Multiplikator1x
context window256K
MiniMaxKontext 1M
MiniMax-M3
Multiplikator1x
context window1M
Vision
MiniMax
image-01
Multiplikatorper image
MiniMax
image-01-live
Multiplikatorper second
StepFunKontext 256K
step-3.7-flashFast response
Multiplikator1x
context window256K
Vision
ByteDanceKontext 128K
doubao-seed-2.1-turbo
Multiplikator3x
context window128K
Vision
XiaomiKontext 1M
mimo-v2.5-pro
Multiplikator4x
context window1M
XiaomiKontext 1M
mimo-v2.5
Multiplikator2x
context window1M
Vision
DeepSeekKontext 1M
deepseek-v4-pro
Multiplikator7.5x
context window1M
DeepSeekKontext 1M
deepseek-v4-flash
Multiplikator2.5x
context window1M
KimiKontext 1M
kimi-k3
Multiplikator25x
context window1M
Vision
Zhipu AIKontext 256K
glm-5.1
Multiplikator5x
context window256K
Vision
Zhipu AIKontext 1M
glm-5.2
Multiplikator8x
context window1M
Vision
xAI / GrokKontext 500K
grok-4.5
Multiplikator5x
context window500K
Vision
AnthropicKontext 256K
claude-haiku-4-5-20251001
Multiplikator1x
context window256K
Vision
AnthropicKontext 1M
claude-sonnet-5高能力主力
Multiplikator10x
context window1M
Vision
AnthropicKontext 1M
claude-fable-5顶级任务
Multiplikator40x
context window1M
Vision
AnthropicKontext 1M
claude-opus-4-6
Multiplikator15x
context window1M
Vision
AnthropicKontext 1M
claude-opus-4-7
Multiplikator15x
context window1M
Vision
AnthropicKontext 1M
claude-opus-4-8
Multiplikator15x
context window1M
Vision
AnthropicKontext 1M
claude-opus-5
Multiplikator15x
context window1M
Vision
GoogleKontext 1M
gemini-3.1-pro
Multiplikator10x
context window1M
Vision
GoogleKontext 1M
gemini-3.5-flash
Multiplikator6x
context window1M
Vision

Die obigen Preise sind Referenzumrechnungen auf Basis der aktuellen Multiplikatoren. Bildmodelle werden pro Bild oder pro Sekunde berechnet. Der tatsächliche Abzug richtet sich nach dem Plattform-Multiplikator und dem Verbrauch der Anfrage; ✅ bedeutet, dass Vision unterstützt wird.

Weiter

Sobald die Preistabelle klar ist, gehen Sie zum Kauf über

Diese Seite erläutert Multiplikatoren, Cache-Hits und Modellkosten. Neue Nutzer können einen API-Schlüssel kaufen; bestehende Nutzer können einen vorhandenen Schlüssel aufladen.