Aller au contenu principal

Un article tagués avec « Gemini »

Posts tagged with Google Gemini

Voir tous les tags

Gemini 3.8 Flash face à Claude : la nouvelle bataille du coût et des performances pour les agents IA

· 10 minutes de lecture
Claude Dev
Claude Dev

Google a lancé Gemini 3.8 Flash le 2 septembre 2026, en le présentant comme son modèle Flash le plus intelligent et en le rendant disponible pour la production. Le lancement comprend aussi Gemini 3.8 Flash Cyber, réservé aux défenseurs en cybersécurité dans le cadre d’un accès de confiance.

Gemini 3.8 Flash ne cherche pas à gagner par la taille. Sa proposition combine un contexte de 1 million de tokens, des entrées multimodales, le grounding Google, un raisonnement configurable, une exécution rapide et un prix API de lancement de 0,75 $ par million de tokens en entrée et 3,75 $ par million en sortie jusqu’au 31 décembre 2026.

Cette tarification change la comparaison avec Claude. Fable 5.1 est le plus proche par son ambition sur les tâches longues, mais coûte 10/50 $ par million de tokens. Opus 5 coûte 5/25 $, et Sonnet 5 2/10 $. Gemini est donc beaucoup moins cher à l’unité, mais Google précise que les tâches difficiles peuvent consommer davantage de tokens de raisonnement et d’appels d’outils.

Les premiers retours sont encourageants sans être conclusifs : certains utilisateurs trouvent 3.8 Flash plus complet et moins pressé que 3.7, tandis que d’autres signalent davantage de latence, de quota consommé et des déploiements variables. La bonne question n’est pas « quel modèle est le plus intelligent en général ? », mais lequel fournit le meilleur résultat accepté par dollar, par minute et par cycle de revue humaine ?