
Sommaire
- Les nouveaux modeles : une course a trois, et quelques outsiders
- Le vrai saut : des "agents" qui font, au lieu de repondre
- Multimodal : l'image, la voix et, surtout, la video
- L'IA dans votre poche et sur votre bureau
- Ce que ca change au quotidien et au travail
- Les limites : elle se trompe, elle coute, elle consomme
- Regulation : ce qui se met en place, et vos reperes en France
- En bref
Fin novembre 2025, Google sortait Gemini 3, sa nouvelle generation d’IA. En avril 2026, OpenAI repondait avec GPT 5.5. Fin mai, Anthropic publiait Claude Opus 4.8. Trois geants, trois sorties en six mois, et a chaque fois la meme promesse : une machine qui comprend mieux ce que vous voulez et qui en fait davantage toute seule. Derriere la surenchere de versions, une question simple pour vous : qu’est-ce qui est devenu possible aujourd’hui qu’on ne pouvait pas faire en decembre dernier ? La reponse tient en trois mots, et un avertissement.
Petit rappel de vocabulaire, parce qu’on va y revenir. Un LLM (large language model, grand modele de langage) est le moteur derriere ChatGPT, Gemini ou Le Chat : un programme entraine sur des montagnes de textes qui predit, mot apres mot, la suite la plus plausible. Un token est l’unite que ces modeles manipulent, a peu pres une syllabe ou un bout de mot ; c’est aussi l’unite a laquelle on facture l’usage. Gardez ces deux mots en tete, le reste se laisse raconter.
Les nouveaux modeles : une course a trois, et quelques outsiders
Le trio de tete s’est entierement renouvele. Gemini 3 Pro, sorti le 18 novembre 2025, revendiquait dans son annonce officielle la premiere place du classement public LMArena, ou des humains votent en aveugle pour la meilleure reponse. GPT 5.5, arrive le 23 avril 2026, a ete pense, selon OpenAI, pour les taches qui durent : pas juste repondre, mais planifier, utiliser des outils et avancer pendant de longues minutes sans qu’on lui tienne la main. Claude Opus 4.8, publie le 28 mai 2026, mettait l’accent sur la fiabilite : son editeur affirme qu’il est environ quatre fois moins susceptible que la version precedente de laisser passer ses propres erreurs de code, un detail qui en dit long sur la priorite du moment.

Autour de ce trio, l’Europe a son champion. Le francais Mistral a sorti fin 2025 Mistral Large 3, et son assistant grand public, longtemps appele Le Chat, a ete rebaptise Vibe fin mai 2026 avec un mode dedie aux taches longues, comme l’a detaille la presse specialisee. L’entreprise a leve 830 millions de dollars en mars pour batir des centres de donnees pres de Paris et en Suede, et signe des partenariats avec Airbus ou BMW : c’est l’argument de la souverainete, une IA dont les serveurs et les regles restent europeens. Plus discret mais decisif, le chinois DeepSeek continue de proposer des modeles en acces ouvert qui s’approchent des meilleurs pour une fraction du prix, ce qui tire toute la filiere vers le bas cote tarif. Cette nuance compte : un modele « ouvert » peut etre installe et inspecte par n’importe qui, la ou les modeles d’OpenAI ou d’Anthropic restent des boites fermees accessibles seulement via leur service.
Le vrai saut : des « agents » qui font, au lieu de repondre
Voici le mot de l’annee : l’agent. Jusqu’ici, vous posiez une question, l’IA repondait, et c’etait a vous d’executer. Un agent, lui, agit. Concretement, vous lui confiez une mission un peu floue (« trie ma boite mail », « reserve ce service », « corrige et teste ce bout de programme ») et il enchaine les etapes seul : il consulte des outils, clique, verifie son travail, recommence si besoin. OpenAI a explicitement positionne GPT 5.5 sur ce terrain, en revendiquant un score record de 82,7 % sur Terminal Bench 2.0, un test qui mesure justement la capacite a mener des taches en ligne de commande de bout en bout. Google, de son cote, a integre un « Gemini Agent » capable de ranger une boite Gmail, comme le montre la demonstration officielle de Gemini 3.
Le terrain ou cela se voit le plus, c’est le code informatique. Anthropic affirme qu’Opus 4.8 est le meilleur modele teste pour piloter un navigateur a votre place, avec 84 % sur un test appele Online Mind2Web. Pour un non programmeur, l’interet est ailleurs : ces memes briques commencent a debarquer dans les usages quotidiens. Reserver un creneau, comparer des devis, remplir un formulaire fastidieux, autant de corvees que l’agent promet d’absorber. La promesse reste plus avancee que la realite grand public, mais la direction est claire, et elle s’est dessinee tres vite ces six derniers mois. En entreprise, le mouvement est deja concret : on a vu des enseignes augmenter leurs equipes avec l’IA pour des taches tres terre a terre.
Multimodal : l’image, la voix et, surtout, la video
Multimodal est l’autre mot a gloser : un modele multimodal ne se contente pas de lire du texte, il comprend et produit aussi des images, du son, de la video. C’est la que les progres sont les plus spectaculaires a l’oeil nu. Du cote video, la bascule de ces derniers mois est nette. Google a presente le 19 mai 2026, lors de sa conference annuelle, un nouveau modele baptise Gemini Omni capable de generer de courtes videos directement dans YouTube, et son modele video Veo continue de produire des sequences avec son synchronise, voix et bruitages compris. Signe que la course coute cher, OpenAI a ferme son application video grand public Sora fin avril 2026 : selon les chiffres rapportes par la presse tech, l’outil brulait jusqu’a 15 millions de dollars par jour de couts de calcul pour des revenus marginaux.
Cette puissance creative a un revers que vous devez connaitre. Plus les IA fabriquent des images, des voix et des videos credibles, plus il devient facile de truquer. Le clonage de voix, en particulier, alimente une nouvelle vague d’arnaques telephoniques ou un escroc se fait passer pour un proche : un phenomene que nous avons documente sous le terme de vishing par deepfake vocal. La regle de prudence est simple : un appel paniquant qui reclame de l’argent dans l’urgence merite toujours un rappel sur le numero habituel.

L’IA dans votre poche et sur votre bureau
Jusqu’a recemment, toute requete partait vers un centre de donnees lointain pour etre traitee. Depuis quelques mois, une partie du travail se fait directement sur l’appareil : c’est l’IA « on device », c’est a dire directement sur l’appareil. Concretement, votre telephone embarque un petit modele capable de resumer un message, transcrire un memo vocal ou retoucher une photo sans connexion. Apple fait tourner ses fonctions « Apple Intelligence » sur iPhone 15 Pro et plus recents, et Google diffuse son modele compact Gemini Nano sur les Android compatibles. Les puces des telephones haut de gamme de debut 2026 integrent desormais des processeurs dedies a l’IA assez muscles pour faire tourner localement des modeles de plusieurs milliards de parametres.
L’interet pour vous est double : la rapidite, puisqu’il n’y a pas d’aller retour vers internet, et la vie privee, puisque vos donnees restent dans votre poche. C’est l’exact contrepoint des assistants en ligne, qui eux multiplient les acces a vos contenus : la version recente de ChatGPT branchee sur Gmail et vos fichiers illustre bien le compromis, plus de service contre plus d’acces a vos donnees. L’IA quitte aussi l’ecran : les lunettes connectees de Meta font partie de cette vague d’appareils ou l’assistant devient un compagnon discret, au poignet ou sur le nez.
Ce que ca change au quotidien et au travail
Au quotidien, le changement est moins une revolution qu’une accumulation de petits gains. Resumer un long document, traduire une recette manuscrite, transformer un cours filme en fiches de revision : Gemini 3 met ces usages en avant dans sa demonstration, et ils sont a portee de n’importe quel abonne. La recherche sur le web elle-meme se transforme, avec des reponses synthetisees plutot que des listes de liens. Cette commodite a un cout collectif sur lequel on reviendra, mais pour l’usager, le temps gagne est reel.
Au travail, la promesse des agents rencontre une realite plus nuancee. L’IA accelere la redaction, l’analyse de donnees, la creation de documents, et des secteurs entiers l’integrent. Mais elle deplace aussi les reperes : la confiance, la repartition des taches, le sentiment de maitrise. Les enquetes sur les travailleurs face a cette transition montrent un melange d’enthousiasme et d’inquietude qui n’a rien d’irrationnel. Et l’IA s’invite dans des metiers inattendus : la meteo, par exemple, ou des modeles concurrencent desormais les grands centres de prevision europeens.
Les limites : elle se trompe, elle coute, elle consomme
Voici l’avertissement promis en debut d’article, et il tient en un mot peu glamour : l’IA hallucine. Le terme designe ces moments ou le modele invente une information fausse avec un aplomb total, parce qu’il predit du plausible, pas du vrai. Le probleme n’a pas disparu en six mois, loin de la. Des mesures publiees en 2026 relevent encore des taux d’erreur tres variables selon les taches, parfois eleves sur des questions factuelles pointues, et un constat contre intuitif revient : les modeles les plus « intelligents », ceux qui raisonnent le plus, ne sont pas forcement les plus fiables sur les faits simples. La raison de fond est structurelle : ces systemes sont entraines a toujours repondre, jamais a dire « je ne sais pas ». La consequence pratique pour vous : verifiez toute information importante, surtout un chiffre, une date, un nom propre, une question medicale ou juridique.
Le cout est l’autre limite, et il est double. Cout financier d’abord : faire tourner ces modeles revient si cher qu’Anthropic a explique avoir du renoncer a un modele gratuit finance par la publicite, l’IA coute trop pour etre offerte a grande echelle. Cette economie sous tension explique aussi les valorisations vertigineuses du secteur, comme le projet d’introduction en Bourse d’Anthropic. Cout environnemental ensuite. C’est ici qu’un travail francais fait reference : Mistral a publie, avec l’agence de la transition ecologique, la premiere analyse de cycle de vie complete d’une IA europeenne. Le verdict, repris dans notre dossier sur l’empreinte des requetes, donne un ordre de grandeur utile : une reponse de 400 tokens emet environ 1,14 gramme de CO2 et consomme 45 millilitres d’eau. Faible a l’echelle d’une requete, mais multiplie par des milliards d’usages quotidiens, l’addition fait grimper la demande electrique mondiale des centres de donnees, que l’Agence internationale de l’energie voit croitre fortement d’ici 2030.
Regulation : ce qui se met en place, et vos reperes en France
L’Europe a choisi d’encadrer tout cela avec une loi, l’AI Act. Etape clef a retenir : a partir du 2 aout 2026, la Commission europeenne disposera de reels pouvoirs de controle sur les modeles d’IA les plus puissants, avec des amendes possibles jusqu’a 3 % du chiffre d’affaires mondial, comme le precise le cadre officiel de l’UE. Les modeles deja sur le marche, eux, ont jusqu’en aout 2027 pour se mettre en conformite. En France, la question de l’IA monte aussi au niveau politique : les sujets numeriques et d’IA ont figure parmi les priorites portees par Bercy dans les enceintes internationales.
Pour s’y retrouver sans se noyer, trois reperes suffisent. Un, choisissez l’outil selon le besoin : un assistant en ligne pour la puissance, l’IA de votre telephone pour les taches simples et privees. Deux, gardez la main critique : l’IA propose, vous tranchez, et vous verifiez ce qui engage. Trois, gardez en tete que cette photographie a une date de peremption courte. Le rythme actuel, c’est une sortie majeure toutes les quelques semaines. Ce qui parait inedit ce mois-ci sera la norme cet automne, et le panorama qu’on vient de dresser sera deja, en partie, a refaire.
En bref
Qu’est-ce qui a vraiment change en six mois ?
Trois choses : de nouveaux modeles plus capables (Gemini 3 en novembre 2025, GPT 5.5 en avril 2026, Claude Opus 4.8 en mai 2026), l’arrivee des « agents » qui executent des taches au lieu de seulement repondre, et des progres nets en video et en IA embarquee sur les telephones.
Qu’est-ce qu’un agent IA ?
Un programme d’IA qui ne se contente pas de repondre, mais qui agit a votre place : il enchaine les etapes d’une mission (trier des mails, remplir un formulaire, tester un programme), utilise des outils et verifie son travail. C’est le grand chantier des editeurs en 2026, encore plus avance pour les developpeurs que pour le grand public.
L’IA est-elle fiable aujourd’hui ?
Pas totalement. Les modeles « hallucinent » encore, c’est a dire qu’ils inventent parfois des informations fausses avec assurance. Les taux d’erreur restent variables selon les taches en 2026. Verifiez toujours un chiffre, une date, un nom propre ou un conseil medical ou juridique.
Combien ca coute et ca consomme ?
Beaucoup. Faire tourner ces IA coute si cher que les versions vraiment gratuites se rarefient. Cote environnement, une analyse francaise de Mistral et de l’ADEME chiffre une reponse type a environ 1,14 g de CO2 et 45 ml d’eau : peu seul, mais colossal multiplie par des milliards d’usages.
L’IA est-elle deja encadree par la loi ?
Oui, en Europe. L’AI Act donne a la Commission de reels pouvoirs de controle sur les modeles les plus puissants a partir du 2 aout 2026, avec des amendes possibles jusqu’a 3 % du chiffre d’affaires mondial.
Votre réaction :
Article créé en collaboration avec l’IA.
Les plus lus
- 1
Grève easyJet : un préavis sans aucune date, et une loi qui ne prévient les passagers que 24 heures avant - 2
L’Odyssée de Nolan en IMAX 70 mm : la seule salle de France est à Montpellier - 3
Musées gratuits le premier dimanche du mois : la règle et les pièges - 4
Conseillers numériques : le budget passe de 40 à 14 millions d’euros, et les démarches bloquent toujours - 5
600e de Taratata : ce que France 2 a rediffusé jeudi soir avait été tourné dix mois plus tôt
Nos dossiers
- France486
- Santé208
- Science207
- Prévention195
- Culture184
- Consommation178
- Biodiversité171
- IA149
Recevez notre sélection dans votre boîte mail
Le meilleur d’Actu Alt Plus : décryptages, chiffres et panoramas. Désinscription en 1 clic, zéro spam.

