Semaine 40, 2026 · Nouveautés

Les modèles d'IA de nouvelle génération et les agents persistants arrivent

Les mises à jour d'OpenAI, Anthropic et Google apportent des modèles plus rapides et des agents IA autonomes pour automatiser vos processus.

En bref

  • OpenAI, Anthropic et Google ont lancé des modèles plus rapides et plus abordables, au tarif de deux dollars par million de tokens en entrée.
  • Les agents IA persistants, dotés d'environnements cloud dédiés, deviennent la norme pour exécuter des tâches complexes en arrière-plan.
  • Des modèles spécialisés uniquement dédiés à la prise de décision offrent une alternative ultra-rapide et économique pour le routage et le tri.

Cette semaine marque un tournant coordonné dans le paysage de l'intelligence artificielle. Les principaux fournisseurs ont lancé de nouveaux modèles qui réduisent considérablement le coût de l'informatique cognitive tout en introduisant des agents persistants fonctionnant en arrière-plan.

Pour les responsables techniques et les directeurs des opérations, ces lancements offrent des opportunités immédiates de réduire les coûts d'API. Ils permettent également de déployer des flux de travail autonomes qui s'exécutent en continu sans supervision manuelle.

Sujet 01

OpenAI dévoile GPT-6.1 Sol, l'agent Dots et un abonnement Pro

OpenAI a annoncé GPT-6.1 Sol, qui offre une intelligence proche de celle d'Astra pour deux dollars par million de tokens en entrée et dix dollars en sortie. L'entreprise a également présenté Dots, un agent IA persistant propulsé par GPT-6 Astra qui exécute des tâches en arrière-plan en continu sur son propre ordinateur cloud. Un nouvel abonnement Pro à cinq cents dollars par mois donne accès à un mode ultra-rapide générant jusqu'à trois cents tokens par seconde dans Codex.

Ce que cela change pour vos systèmes

L'introduction d'agents d'arrière-plan permanents dotés d'environnements cloud dédiés transforme la conception des flux de travail automatisés. Les équipes peuvent désormais déléguer des opérations continues à des systèmes autonomes sans gérer d'infrastructure locale. De plus, la baisse des prix de GPT-6.1 Sol réduit le coût des intégrations d'API à grand volume.

Sources

Sujet 02

Anthropic lance Claude Sonnet 5.5 avec des vitesses accrues

Anthropic a publié Claude Sonnet 5.5, offrant des vitesses de génération supérieures de plus de trente pour cent et des coûts de tokens réduits. Le modèle est proposé à deux dollars par million de tokens en entrée et dix dollars en sortie, avec des lectures de cache à vingt centimes et des écritures à deux dollars et cinquante centimes. Il a obtenu un score de 70,6 pour cent sur le benchmark de codage agentique Terminal-Bench 4.0, surpassant Claude Opus 5.5.

Ce que cela change pour vos systèmes

Ce modèle rend le codage agentique et les intégrations de systèmes complexes plus rapides et plus abordables. Son excellent score démontre que Sonnet 5.5 peut gérer de manière fiable l'automatisation basée sur un terminal et les tâches de développement multi-étapes. Les entreprises utilisant Claude pour l'ingénierie logicielle devraient migrer vers ce modèle pour réduire leurs coûts opérationnels.

Sources

Sujet 03

Google présente Gemini 4 Argon avec une limite de sortie étendue

Google a annoncé Gemini 4 Argon, un nouveau modèle phare optimisé pour les flux de travail complexes, l'ingénierie logicielle et la cybersécurité. Ce modèle dispose d'une limite de sortie élargie à un million de tokens, pour un tarif de deux dollars par million de tokens en entrée et dix dollars en sortie. Il a atteint un score de 77,9 pour cent sur le benchmark d'ingénierie logicielle DeepSWE v1.1 et de 68 pour cent sur CWE-bench v1 pour la cybersécurité.

Ce que cela change pour vos systèmes

La limite d'un million de tokens en sortie permet au modèle de générer des bases de code massives ou des rapports détaillés en une seule exécution. Ses performances élevées sur les benchmarks de sécurité et d'ingénierie en font un candidat idéal pour la génération automatisée de code et la détection de vulnérabilités.

Sujet 04

TypeSafe AI lance Jev, un modèle de décision ultra-rapide

TypeSafe AI a lancé Jev, un modèle de décision spécialisé qui ne génère pas de texte mais produit des probabilités et des scores. Conçu pour les choix catégoriels et probabilistes, Jev fonctionne jusqu'à deux cents fois plus vite et quatre cents fois moins cher que les grands modèles de langage standards. Il coûte environ quatre centimes par million de tokens en entrée sur OpenRouter et répond à des questions à choix multiples, binaires ou d'évaluation.

Ce que cela change pour vos systèmes

Utiliser de grands modèles de langage pour du simple routage ou de la classification ralentit les flux de travail et s'avère coûteux. Jev permet de mettre en place des étapes de tri rapides et économiques pour orienter les tâches avant de solliciter des modèles plus lourds. Cette architecture hybride réduit considérablement la latence des API et les dépenses opérationnelles.

Sources

Sujet 05

Manus 2.0 introduit des ordinateurs cloud et des agents autonomes

Manus 2.0 a été lancé avec le moteur Cascade, qui fonctionne plus de vingt-huit pour cent plus vite et consomme plus de vingt-trois pour cent de tokens en moins que la version précédente. Cette mise à jour introduit des Cloud Computers persistants, des machines virtuelles actives en permanence qui permettent aux agents d'exécuter des automatisations même lorsque l'ordinateur de l'utilisateur est éteint. Elle intègre également Cue, une application autonome pour gérer des agents IA personnels dotés de leurs propres adresses e-mail, numéros de téléphone et environnements cloud.

Ce que cela change pour vos systèmes

Les machines virtuelles persistantes permettent aux automatisations d'entreprise de s'exécuter en continu sans dépendre du matériel local. Le fait d'attribuer des canaux de communication dédiés aux agents simplifie grandement leurs interactions avec les services externes et les collaborateurs humains.

Sources

Sujet 06

Microsoft repense Copilot avec les fonctions Code et Autopilot

Microsoft a mis à jour Microsoft 365 Copilot, en le structurant autour de trois sections principales : Home, Code et Autopilot. La section Code permet aux utilisateurs de concevoir des logiciels et des tableaux de bord interactifs à partir de descriptions en langage naturel. Autopilot fonctionne comme un agent d'arrière-plan autonome qui prend en charge des objectifs, suit les progrès et exécute des tâches au sein des applications Microsoft 365 sans supervision active.

Ce que cela change pour vos systèmes

L'intégration d'Autopilot apporte l'exécution en arrière-plan directement au sein de l'écosystème Microsoft 365. Cela permet aux équipes d'automatiser les tâches administratives, la génération de documents et le suivi de projets sans avoir à développer des intégrations d'API sur mesure.

Sources

Notre analyse

Le lancement simultané de GPT-6.1 Sol, Claude Sonnet 5.5 et Gemini 4 Argon établit une nouvelle référence en matière de prix et de performances pour l'IA d'entreprise. À deux dollars par million de tokens en entrée, le traitement de données à grande échelle et les flux de travail d'agents complexes deviennent plus viables que jamais sur le plan financier.

Nous vous recommandons d'analyser vos dépenses d'API actuelles et d'évaluer dans quelle mesure des agents d'arrière-plan persistants, tels que Dots d'OpenAI ou les Cloud Computers de Manus, peuvent remplacer des tâches cron locales souvent fragiles. De plus, l'intégration de modèles de décision légers comme Jev pour le routage peut préserver votre budget en évitant des appels inutiles vers de grands modèles de langage.

Questions et réponses

Quel est le standard de tarification pour les derniers modèles de pointe ?

GPT-6.1 Sol d'OpenAI, Claude Sonnet 5.5 d'Anthropic et Gemini 4 Argon de Google ont harmonisé leurs tarifs à deux dollars par million de tokens en entrée et dix dollars par million de tokens en sortie.

Quel est l'avantage des ordinateurs cloud persistants pour l'automatisation ?

Des outils comme Dots d'OpenAI et Manus 2.0 proposent des machines virtuelles toujours actives dans le cloud. Cela permet aux agents d'IA d'exécuter des tâches, de faire tourner des serveurs et de gérer des flux de travail en continu, même lorsque votre ordinateur local est éteint.

Qu'est-ce qu'un modèle dédié à la décision et quand faut-il l'utiliser ?

Un modèle dédié à la décision, comme Jev de TypeSafe AI, produit des probabilités, des scores ou des choix binaires plutôt que du texte. Il est idéal pour des tâches rapides et économiques de routage, de classification et de tri avant d'envoyer des requêtes complexes à des modèles plus grands.

Vous voulez mettre cela en place dans votre entreprise ?

Dites-nous ce que vous utilisez aujourd’hui. Nous vous répondons avec un premier plan pour le connecter, l’automatiser ou construire ce qui manque.