
Cette semaine, une même question traverse presque toutes les annonces IA : qui est derrière, et qui est en face ? Mistral revient dans la course aux grands modèles avec un atout qui n'est pas la puissance brute. Une start-up présente une IA vidéo que près d'un interlocuteur sur deux a prise pour un humain. Des voix de synthèse se clonent à partir de quelques secondes d'audio, et Google ouvre à tous un outil pour repérer certains contenus générés. Pendant ce temps, l'accès gratuit aux meilleurs modèles se resserre chez Google et s'élargit chez OpenAI. Face à des machines de plus en plus crédibles, ce sont les réflexes fixés à l'avance qui protègent, bien plus que l'œil ou l'oreille.
Semaine du 8 octobre : pourquoi ces actualités IA ne sont pas comme les autres
Quatre notions reviennent dans les annonces de la semaine. Elles sont proches, et il est utile de les distinguer avant de regarder les faits.
- Un modèle à poids ouverts, c'est un modèle dont l'éditeur publie les paramètres, ce qui permet de le télécharger et de le faire tourner sur ses propres serveurs.
- Un modèle de décision, c'est un modèle qui ne rédige rien : il choisit une réponse dans une liste fixée à l'avance et indique son degré de certitude.
- Un test de Turing vidéo, c'est une expérience où des personnes échangent en direct avec un visage à l'écran et doivent dire si elles parlent à un humain ou à une machine.
- Un filigrane invisible, c'est une marque glissée dans une image, une vidéo ou un son au moment de sa génération, imperceptible à l'œil mais lisible par un outil de détection.
Ces quatre notions expliquent pourquoi les signaux qui suivent dessinent, pris ensemble, autre chose qu'une série d'annonces produits.
Mistral Large 4 : le laboratoire français revient dans la course
Mistral avait pris du retard sur les modèles de pointe. Le laboratoire a continué à publier des modèles plus modestes et à héberger ceux d'autres éditeurs, puis a levé 3 milliards d'euros le 8 septembre. Le 6 octobre, il a présenté Mistral Large 4 : environ 1 000 milliards de paramètres, dont 52 milliards actifs pour chaque réponse, une lecture du texte et des images, et plus de 160 langues couvertes. Mistral promet de publier les poids du modèle d'ici fin octobre, sans préciser la licence.
Ce que ça veut dire pour les dirigeants
L'atout de Large 4 n'est pas sa puissance, c'est son origine : un modèle entraîné en Europe, solide sur les langues européennes, publié par un acteur soumis au droit européen. Selon le classement d'Artificial Analysis, c'est le meilleur modèle ouvert développé hors de Chine, mais sept modèles chinois restent devant lui. Pour une organisation qui doit garder la main sur ses données, l'existence d'une alternative européenne crédible compte davantage qu'une place sur un podium. Le choix d'un modèle se fait de plus en plus sur la question de la dépendance, et plus seulement sur celle de la performance.
Le hic en deux points
Premier point : Large 4 n'est accessible que par API, en préversion dans Mistral Studio, et il n'est pas proposé dans Le Chat, l'assistant grand public de Mistral. Un salarié ne peut donc pas l'essayer depuis son navigateur, il faut un projet technique. Second point : les meilleurs scores revendiqués en cybersécurité et en programmation sont annoncés par Mistral lui-même. Tant que des évaluations indépendantes ne les ont pas confirmés, ils restent des promesses d'éditeur.
→ Choisir ses modèles IA selon ses contraintes de données avec Alegria.group
Griffin : une IA vidéo prise pour un humain par près d'un interlocuteur sur deux
Le 1er octobre, la start-up Tavus a présenté Griffin comme « le premier modèle à passer le test de Turing vidéo ». Selon Tavus, 48 % des personnes qui lui ont parlé en direct ont cru s'adresser à un humain, contre moins de 3 % avec le modèle précédent. Griffin peut interrompre son interlocuteur, hocher la tête et réagir à ce qu'il voit à l'écran.
Ce que ça veut dire pour les dirigeants
Le chiffre est fragile, mais la tendance est nette : les visages et les voix générés en direct deviennent crédibles. La même semaine, Eleven v4, la nouvelle voix de synthèse d'ElevenLabs, gère le français et permet un clonage à partir de 10 secondes d'audio. Une demande de virement passée en visio par un faux dirigeant, ou un appel d'un faux fournisseur, n'a plus besoin d'être grossière pour fonctionner. Se fier à ce que l'on voit et entend ne suffit plus : il faut des procédures décidées avant que la situation se présente. Concrètement, convenir d'un mot de code avec ses proches et ses équipes, et, face à une demande d'argent, de code ou de mot de passe en visio, raccrocher puis rappeler sur un numéro déjà enregistré.
Google ouvre de son côté SynthID Detector, un outil gratuit et accessible à tous qui repère un filigrane invisible sur une photo, une vidéo ou un son. Utile, à une limite près : un résultat « non détecté » ne prouve pas qu'un contenu est authentique, il signifie seulement que ce filigrane précis n'y figure pas.
Le hic en deux points
Premier point : le chiffre de 48 % repose sur 26 personnes sur 54, pour des appels d'une minute. L'étude est interne, sans groupe de comparaison ni vérification indépendante, et Griffin n'est pas disponible, seule une version allégée étant testée par un petit groupe. Second point : le test mesure l'apparence humaine, pas la justesse de ce que dit la machine. Une IA peut sembler parfaitement naturelle et se tromper avec aplomb.
→ Former ses équipes aux bons réflexes face aux contenus générés par IA
Les autres signaux IA de la semaine à retenir
Jev, un modèle qui ne rédige rien, copié en trois jours
Mi-septembre, TypeSafe, fondée par un ancien d'OpenAI, a lancé Jev, premier modèle de sa famille « System One ». Il ne produit aucun texte : il choisit une réponse dans une liste fixe et indique son degré de certitude. Comme il répond en une seule fois au lieu de générer mot après mot, TypeSafe annonce un temps de réponse de 70 à 500 millisecondes, contre 3 à 329 secondes ailleurs, soit 40 à 200 fois plus vite, pour environ 0,04 dollar le million de mots en entrée, contre 0,20 à 10 dollars. Ce sont les chiffres de la start-up. En trois jours, OpenAI (en accès limité), Amazon et Cloudflare (en open source) ont sorti leur propre version, comme le relève TechCrunch. Le revers est connu : un tel modèle peut choisir la mauvaise case avec assurance, ce qui reporte en partie la vérification sur l'utilisateur.
90 % de ce que permet déjà un abonnement reste inutilisé
Dans son décryptage de la semaine, Alexandre Raspail, responsable communication d'Alegria.group, rappelle qu'en dehors de la bulle des initiés, la plupart des utilisateurs passent à côté d'environ 90 % de ce que permet déjà un abonnement classique à ChatGPT, Claude ou Gemini, parfois même un compte gratuit. Il présente lui-même ce chiffre comme une estimation de terrain, pas comme le résultat d'une étude. Le constat qu'il en tire est simple : personne ne le leur a jamais montré. Pour combler cet écart, la formation gratuite de 1 h 37 publiée par Alegria.group reprend les trois assistants pas à pas, des premières demandes aux usages avancés.
L'IA freine l'embauche des jeunes dans les métiers exposés
Une étude d'HEC et de la Banque de France mesure que depuis novembre 2022, les embauches en CDI des 21-29 ans ont baissé d'environ 28 % dans les métiers les plus exposés à l'IA, contre 7,5 % dans les moins exposés. Après 50 ans, l'écart tombe sous 4 points. L'étude décrit une tendance sans prouver que l'IA en soit la cause, mais elle pose une question de fond : comment former demain des profils expérimentés si les postes d'entrée se raréfient ?
ChatGPT passe à GPT-6, Gemini gratuit perd ses meilleurs modèles
Les abonnés payants de ChatGPT disposent de GPT-6 depuis le 7 octobre, et les comptes gratuits reçoivent la version Luna par vagues, selon OpenAI. Google fait le chemin inverse : à partir du vendredi 9 octobre, seul Flash-Lite reste accessible sans abonnement dans Gemini, et l'offre AI Plus à 4,99 euros par mois perd le modèle Pro (page d'aide de Google). Pour les équipes qui utilisent des comptes gratuits ou d'entrée de gamme, la qualité des réponses peut donc changer du jour au lendemain, sans aucune action de leur part.
Claude s'installe dans Google Docs, Sheets et Slides
Depuis le 6 octobre, Claude fonctionne directement dans Google Docs, Sheets et Slides, en bêta publique et avec un abonnement payant. Pour les organisations équipées de Google Workspace, l'assistant arrive là où le travail se fait déjà, sans copier-coller entre deux fenêtres.
Sécurité et transparence : deux alertes venues d'OpenAI
Un ancien responsable d'OpenAI, qui a supervisé les rapports de sécurité de 12 lancements de modèles, a démissionné en appelant à des contrôles plus stricts. Le 6 octobre, OpenAI a par ailleurs publié plus de 700 fichiers de résultats mathématiques produits par un modèle interne non disponible, une démarche critiquée par des mathématiciens. Dans les deux cas, la même question revient : qui vérifie ce que les laboratoires affirment de leurs propres modèles ?
Une lettre chiffrée de Napoléon déchiffrée en six heures
GPT-6 Astra a déchiffré une lettre codée de Napoléon au général Marmont, datée de mars 1809, en six heures environ, à partir d'une planche publiée en 1969. Une démonstration spectaculaire, sans application directe pour les entreprises, mais révélatrice de la capacité des modèles à tenir un raisonnement long et méthodique.
Ce que les dirigeants doivent arbitrer dans les 12 prochains mois
Mis bout à bout, ces signaux se traduisent en quatre questions concrètes, qui ne demandent ni budget exceptionnel ni compétence technique rare.
- Question 1 : quelle procédure suivent nos équipes face à une demande de virement, de code ou de mot de passe reçue en visio ou par téléphone ?
- Question 2 : pour nos données sensibles, avons-nous identifié une alternative européenne à nos modèles actuels, et à quelles conditions l'utiliser ?
- Question 3 : quelle part des fonctionnalités de nos abonnements IA nos équipes utilisent-elles réellement ?
- Question 4 : savons-nous quels outils reposent sur des comptes gratuits dont les modèles peuvent changer sans préavis ?
→ Construire des agents IA fiables et encadrés avec Alegria.group
Alegria.group : transformer ces signaux en stratégie IA opérationnelle
Les annonces de la semaine posent toutes la même question de confiance : savoir qui a produit un modèle, un visage, une voix ou une réponse, et ce qu'il est possible d'en vérifier. La réponse passe moins par un nouvel outil que par des règles claires et des équipes formées à les appliquer.
Alegria.group accompagne plus de 600 projets et a formé plus de 14 700 personnes, avec une approche qui combine conseil, formation et exécution. L'objectif n'est pas d'adopter chaque nouveau modèle, mais de doter les équipes d'une méthode et de réflexes de vérification sur les quelques usages qui produisent une valeur mesurable.
Pour aller plus loin sur la maturité IA des PME
Le Baromètre 2025 de la maturité IA des PME françaises est un référentiel chiffré pour situer son entreprise et prioriser les chantiers.


