Le récapitulatif hebdomadaire de Numerama revient sur les 772 manuscrits mathématiques d’OpenAI, qui ont impressionné les scientifiques, et sur le retour de Mistral AI avec son premier modèle depuis des mois. Il évoque aussi le premier décodeur « home cinéma » d’Orange.
TypeSafe, créateur du modèle d’IA Jev, est valorisé 7,5 milliards de dollars quelques semaines seulement après son lancement. L’entreprise affirme que Jev est bien plus rapide et consomme beaucoup moins de tokens que les grands modèles de langage.
Asana indique que son agent de navigation est devenu 76 fois moins cher et 5 fois plus rapide lors de tests. L’entreprise s’est appuyée sur les modèles d’OpenAI dans Codex et compte proposer des modèles plus performants à ses clients.
Anthropic ouvre ses modèles les plus performants en cybersécurité à davantage de professionnels vérifiés via son Cyber Verification Program. Le groupe indique que près de 129 000 failles ont été identifiées entre avril et juillet 2026, même si ces modèles peuvent aussi servir des attaquants.
Un billet du blog de Hugging Face s’intéresse à la création de son propre modèle d’IA lorsqu’aucun ne répond au besoin.
Un billet publié sur Hugging Face présente d1, des modèles de décision multimodaux et ouverts conçus pour fonctionner sur des appareils en périphérie.
Falcon ASR, un modèle de reconnaissance vocale, est présenté sur le blog de Hugging Face.
Au 6 octobre 2026, le million de jetons en sortie coûte de 0,50 dollar (GPT-6 Luna) à 50 dollars (GPT-6 Astra et Claude Fable 5.1) parmi les dix-huit offres comparées par ActuIA.
GPT-6 est déployé dans le monde entier dans ChatGPT, accompagné d’Intelligent UI. Les réponses sont plus rapides et peuvent intégrer des visuels et des éléments interactifs utilisables directement.
Google DeepMind publie EmbeddingGemma 2, un modèle ouvert et léger qui produit des représentations vectorielles multimodales.
Le 6 octobre, Mistral a ouvert l’aperçu de Mistral Large 4, un modèle de 1 050 milliards de paramètres présenté comme le plus performant des modèles ouverts hors de Chine. Les mesures indépendantes confirment un rattrapage, la cybersécurité étant mise en avant face aux modèles ouverts chinois.
Google a mis à jour sa documentation : à partir du 9 octobre, les utilisateurs sans abonnement n’auront plus accès à Gemini Flash et Pro. L’offre gratuite sera nettement restreinte.
Le 3 octobre, l’entreprise allemande Aleph Alpha a mis en ligne Kolibri 1, un modèle de langage à mélange d’experts dont les poids complets sont téléchargeables sur Hugging Face. ActuIA détaille ce que permet sa licence Apache 2.0.
OpenAI publie un guide pour aider les start-up à choisir parmi les modèles GPT-6. Il aborde le réglage de l’effort de raisonnement, la rédaction des prompts et des skills, l’orchestration des outils et la mise en production.
Google publie un récapitulatif des nouveautés en matière d’IA annoncées en septembre 2026.
GPT-6 Astra Ultrafast, qui tourne sur les GPU Blackwell de NVIDIA, est disponible dans l’API d’OpenAI et pour les utilisateurs éligibles de ChatGPT Work et de Codex. Il génère des tokens jusqu’à huit fois plus vite que le mode standard d’Astra.
Google DeepMind annonce Gemini 4 Argon, présenté comme le début d’une nouvelle ère pour ses modèles les plus avancés.
OpenAI récapitule la vingtaine d’annonces faites lors de sa conférence DevDay 2026. Elles concernent GPT-6 Astra, ChatGPT, Codex, les API, la sécurité et de nouveaux outils pour les développeurs.
OpenAI lance GPT-6.1 Sol, présenté comme proche du niveau d’Astra en programmation, en pilotage d’ordinateur et pour le travail professionnel. Son prix via l’API est cinq fois inférieur au tarif standard d’Astra.
Un billet publié sur Hugging Face présente Holo4, conçu pour des agents généralistes capables de piloter un ordinateur.
Basis, spécialiste de l’IA comptable, indique que GPT-6 Astra a complété un classeur fiscal de 50 onglets deux fois plus vite que GPT-5.6 Sol. Sa meilleure compréhension des intentions de l’utilisateur rassure aussi l’entreprise pour un usage réel.
Google DeepMind présente une fonction Live Avatar pour Gemini 3.8 Live.
Google DeepMind annonce des capacités de synthèse vocale pour Gemini 3.8.
OpenAI améliore la mise en cache des prompts pour GPT-6 : meilleur taux de réutilisation, nouveaux diagnostics, points d’arrêt explicites et contrôles supplémentaires. L’objectif est de réduire la latence et les coûts pour les développeurs.
OpenAI lance deux nouveaux modèles, GPT-6 Sol et GPT-6 Luna. Ils proposent des équilibres différents entre performances et coût pour les tâches courantes.
Google DeepMind annonce Gemini 3.8 Live, ainsi qu’une déclinaison baptisée 3.8 Live Extended Thinking.