Fournisseur / equipe DeepSeek
Officiel $0.21
Moyenne du listing $0.21
Indicateur principal 1.0M ctx
Rang 72

Étapes suivantes sur AI Hippo

Snapshot poids ouverts

deepseek-ai/deepseek-v4-flash

Bibliothèque: transformers

Tâche text-generation

Téléchargements
3.0M
J'aime
1.8k
Paramètres
0B

Tendance 90j

Voir la source des poids

À propos de ce modèle

DeepSeek: DeepSeek V4 Flash occupe la place n°72 de notre classement mondial des modèles. Il est listé comme LLM avec 1.0M ctx et un prix type d’environ $0.21 par 1M tokens. Utilisez Comparer pour des choix côte à côte ou le hub Token pour les tarifs multi-fournisseurs vérifiés du même snapshot.

Vous pouvez aussi explorer plus de modeles de DeepSeek et voir plus d'options depuis 🇨🇳 China .

Capacités et spécifications

Modalité
text->text
Modalités d'entrée
text
Paramètres API pris en charge
frequency_penalty, include_reasoning, logit_bias, logprobs, max_tokens, min_p, presence_penalty, reasoning, reasoning_effort, repetition_penalty, response_format, seed, stop, structured_outputs, temperature, tool_choice, tools, top_a, top_k, top_logprobs, top_p

Description catalogue : DeepSeek V4 Flash is an efficiency-optimized Mixture-of-Experts model from DeepSeek with 284B total parameters and 13B activated parameters, supporting a 1M-token context window. It is designed for fast inference and...

Prix des tokens par fournisseur

Comparez les prix de tokens de ce modèle entre fournisseurs disponibles.

Fournisseur Entrée / 1M tokens Sortie / 1M tokens Latence Statut
DeepInfra $0.09 $0.18 Vérifié · 2026-08-02
DeepSeek $0.14 $0.28 Snapshot · 2026-08-02
Fireworks $0.14 $0.28 Vérifié · 2026-08-02
OpenRouter $0.14 $0.28 Vérifié · 2026-08-02
SiliconFlow $0.13 $0.28 Vérifié · 2026-08-02

Les prix proviennent du dataset de comparaison des tokens et peuvent changer entre snapshots.

Alternatives

Choisissez un ou deux modèles de plus dans le classement global et utilisez Comparer pour les voir côte à côte.

FAQ

Pourquoi le prix officiel est-il absent ?

Les lignes officielles exigent un prix API direct ou cloud vérifié. Si seuls des agrégateurs listent le modèle, Official affiche — ; les devis vérifiés sont dans le tableau token.

Différence entre contexte et max sortie ?

Le contexte est l'entrée acceptée par requête. Le max de tokens de sortie est le plafond de génération par réponse—souvent bien inférieur à la fenêtre de contexte.

D'où viennent les prix multi-fournisseurs ?

Crawls/sync OpenRouter, Groq, Together, etc., fusionnés dans le jeu de comparaison infrastructure. Les lignes vérifiées affichent la date de capture dans la colonne statut.

Source des données et méthodologie
Source
Catalogue OpenRouter, crawls fournisseurs vérifiés et snapshots Hugging Face.
Metrics
Fenêtre de contexte, prix mixte 1M tokens, max sortie et champs capacités depuis l'API modèles OpenRouter.
Update cadence
Rafraîchissement pipeline quotidien ; les prix peuvent changer entre snapshots.
Fetched at
2026-08-02
Method
Le rang composite utilise la pondération contexte × prix du site (pas l'ELO LMSYS Arena).