Dario Amodei demande aux laboratoires de rythmer leurs progrès et ouvre Anthropic à des évaluateurs extérieurs. OpenAI, Elon Musk et Demis Hassabis applaudissent, Washington rejette le récit du risque. Le texte réclame aussi une dérogation antitrust étroite pour certaines discussions de sécurité, et la défense de l'avance américaine : c'est là que se joue la vraie question.
StudentSim bat GPT-5.4 sur un truc précis, imiter les erreurs d'un élève réel plutôt que produire des erreurs génériques. C'est ça la vraie nouveauté : jusqu'ici on entraînait des tuteurs IA sur des fautes plausibles mais fabriquées, et les résultats s'écroulaient au contact de vrais élèves. Reste que 60 élèves sur trois matières, c'est un labo, pas une salle de classe à 30, et le vrai test viendra quand ces tuteurs affronteront la diversité que même les chercheurs n'ont pas simulée.
2,3 secondes de décalage, c'est en dessous du seuil où une visio multilingue devient supportable, et ça change vraiment la donne pour les réunions internationales. Reste que 29 langues avec voix sur 60 couvertes, c'est un système à deux vitesses, le français est dans le lot mais la moitié du catalogue reste en texte seul. À 1,54 dollar l'heure, l'interprétation humaine a un vrai concurrent low-cost, enfin surtout pour les boîtes qui n'ont jamais eu les moyens d'en payer une.
Le vrai truc intéressant ici, ce n'est pas la vitesse, c'est le score de confiance collé à chaque décision. Ça permet de router automatiquement vers un humain sans coder cette logique à la main, et ça change la donne pour tout ce qui est modération ou tri automatique. Sur le papier les gains de 190x en vitesse et 440x en coût sortent de benchmarks maison, comparés à une référence qui est elle-même la moyenne de deux autres modèles, donc à prendre avec des pincettes ; et tant que les poids et le nombre de paramètres restent secrets, sans auto-hébergement possible, c'est une boîte noire qu'on loue sur liste d'attente, à un prix que même l'entreprise n'exclut pas d'être subventionné.