
Photo : Diego Martinez sur Pexels
Anthropic dit que Claude bosse de plus en plus tout seul sur la R&D
Anthropic a sorti un indice maison pour mesurer à quel point ses IA automatisent sa propre R&D. Sympa sur le papier, mais personne d'indépendant n'a encore vérifié les chiffres.
Anthropic vient de publier, le 17 septembre, un nouvel indicateur censé mesurer à quel point ses propres modèles Claude prennent en charge la R&D de l'entreprise. En gros, ils regardent combien de boulot est fait par l'IA versus par des humains, et le résultat montre une progression bien nette de l'automatisation.
Le hic, c'est que cet indice est fabriqué maison : ce sont les modèles d'Anthropic eux-mêmes qui aident à le calculer, avec une pondération du travail humain qui reste assez approximative. Autrement dit, l'entreprise note son propre devoir, ce qui pose forcément question sur l'objectivité de la mesure.
Pour rassurer un peu tout le monde, Anthropic ajoute aussi des outils de surveillance des agents IA et de gestion de la puissance de calcul utilisée. L'idée, c'est de montrer qu'ils gardent un œil sur ce que font leurs IA en autonomie. Reste que tant qu'un organisme extérieur n'aura pas vérifié ces chiffres de façon indépendante, on est encore dans la théorie plus que dans la preuve solide.
Sources
À lire aussi

Une journaliste a créé son propre avatar IA... et c'est troublant
Une journaliste tech a fabriqué un clone numérique d'elle-même capable de discuter avec toi, et elle en ressort avec un sentiment plutôt partagé.

Des lunettes qui remplacent les écouteurs à vélo : le test des Shimano Lazer VeloVox
9 mois avec les Lazer VeloVox : des lunettes à conduction osseuse pour écouter sa musique ou téléphoner à vélo, sans se prendre 135 € d'amende pour écouteurs. Verdict.

Microsoft veut faire de Copilot ton seul outil de travail
Microsoft a lancé la plus grosse refonte de Copilot depuis ses débuts : chat, création d'apps et agents autonomes réunis dans une seule appli.