Google: Gemini 3.5 Flash Lite
Snapshot décisionnel depuis le classement global ; le score composite correspond au tableau des modèles du site.
Données mises à jour :
Modèle
2 sources vérifiées
Étapes suivantes sur AI Hippo
À propos de ce modèle
Google: Gemini 3.5 Flash Lite occupe la place n°78 de notre classement mondial des modèles. Il est listé comme Multimodal avec 1.0M ctx et un prix type d’environ $1.40 par 1M tokens. Utilisez Comparer pour des choix côte à côte ou le hub Token pour les tarifs multi-fournisseurs vérifiés du même snapshot.
Vous pouvez aussi explorer plus de modeles de Google et voir plus d'options depuis 🇺🇸 United States .
Capacités et spécifications
- Modalité
- text+image+file+audio+video->text
- Modalités d'entrée
- text, image, video, file, audio
- Paramètres API pris en charge
- include_reasoning, max_tokens, reasoning, reasoning_effort, response_format, seed, stop, structured_outputs, temperature, tool_choice, tools, top_p
Description catalogue : Gemini 3.5 Flash Lite is a high-efficiency model from Google with upgraded agentic capabilities. It is suited for subagents that execute focused tasks within complex, multi-agent workflows.
Prix des tokens par fournisseur
Comparez les prix de tokens de ce modèle entre fournisseurs disponibles.
| Fournisseur | Entrée / 1M tokens | Sortie / 1M tokens | Latence | Statut |
|---|---|---|---|---|
| Google Vertex AI | $0.30 | $2.50 | — | Vérifié · 2026-08-02 |
| OpenRouter | $0.30 | $2.50 | — | Vérifié · 2026-08-02 |
Les prix proviennent du dataset de comparaison des tokens et peuvent changer entre snapshots.
Alternatives
-
Meta: Llama 4 Scout
Comparer maintenant -
Xiaomi: MiMo-V2.5
Comparer maintenant -
OpenAI: GPT-5.6 Luna Pro
Comparer maintenant
Choisissez un ou deux modèles de plus dans le classement global et utilisez Comparer pour les voir côte à côte.
FAQ
Pourquoi le prix officiel est-il absent ?
Les lignes officielles exigent un prix API direct ou cloud vérifié. Si seuls des agrégateurs listent le modèle, Official affiche — ; les devis vérifiés sont dans le tableau token.
Différence entre contexte et max sortie ?
Le contexte est l'entrée acceptée par requête. Le max de tokens de sortie est le plafond de génération par réponse—souvent bien inférieur à la fenêtre de contexte.
D'où viennent les prix multi-fournisseurs ?
Crawls/sync OpenRouter, Groq, Together, etc., fusionnés dans le jeu de comparaison infrastructure. Les lignes vérifiées affichent la date de capture dans la colonne statut.
Source des données et méthodologie
- Source
- Catalogue OpenRouter, crawls fournisseurs vérifiés et snapshots Hugging Face.
- Metrics
- Fenêtre de contexte, prix mixte 1M tokens, max sortie et champs capacités depuis l'API modèles OpenRouter.
- Update cadence
- Rafraîchissement pipeline quotidien ; les prix peuvent changer entre snapshots.
- Fetched at
- 2026-08-02
- Method
- Le rang composite utilise la pondération contexte × prix du site (pas l'ELO LMSYS Arena).