Menu

Pourquoi GPT-6 Astra est lent dans les longues conversations ?

← Toutes les annonces

Pourquoi GPT-6 Astra est lent dans les longues conversations ?

2026-09-09 23:31:58

Astra est un nouveau modèle avec des soucis d’optimisation dans les longs échanges. Rien d’anormal de notre côté — pour la vitesse utilisez GPT-4.1, pour l’équilibre GPT-5.6 Sol.

GPT-6 Astra vient d’arriver et a suscité beaucoup d’intérêt dès le premier jour — merci à tous. Dernièrement on nous demande « pourquoi Astra est lent dans les longues conversations ? » Expliquons clairement.

Pourquoi ralentit-il ?

Astra est un modèle tout nouveau. Rapide sur les prompts courts (2–4 secondes), mais à mesure que la conversation grandit — surtout le travail d’agent avec 10+ messages et outils — les temps de réponse s’allongent nettement. Dans nos mesures, un historique d’agent de 12 messages prend des minutes sur Astra contre quelques secondes sur les autres modèles.

C’est un problème d’optimisation typique d’un modèle fraîchement sorti ; cela s’améliore avec la maturité côté modèle. Il n’y a donc rien d’anormal de notre côté — notre infrastructure est saine.

Que recommandons-nous pour l’instant ?

  • Besoin de vitesse → GPT-4.1 : stable en 2–3 secondes, court ou long. Actuellement l’option la plus confortable pour l’agent.
  • Besoin d’équilibre → GPT-5.6 Sol : bon équilibre qualité/vitesse, nettement plus rapide qu’Astra dans les longs échanges.
  • Continuez d’essayer Astra : utilisez-le pour les conversations courtes. En cas de blocage sur un long historique, ouvrez une nouvelle conversation ou compactez (résumez) l’historique.

Qu’avons-nous fait ?

Nous avons mis une limite rapide de 40 secondes sur les requêtes Astra : une requête bloquée ne monopolise plus son slot — vous recevez une erreur claire avec un modèle alternatif. Les autres modèles ne sont pas affectés.

Nous annoncerons les évolutions ici. Bon build !