NewsFolio

L'appel de Dario Amodei à freiner le développement des grands modèles domine la journée, avec en écho un code de conduite de Microsoft et une proposition de régulation portée par les grands acteurs du secteur. Côté produits, DeepSeek et Fable 5.1 avancent leurs pions sur les modèles, pendant qu'Apple prépare une Siri plus ouverte aux IA tierces et qu'OpenAI met en avant deux cas d'usage agentiques chez Perplexity et Fyxer.

À la une
Ecosysteme et transverse · Securite et alignement

Le patron d'Anthropic appelle à freiner le développement des grands modèles de langage

Ce week-end, Dario Amodei, directeur général d'Anthropic, a publié un essai appelant à freiner le rythme de développement des grands modèles de langage. Il y évoque les dangers que la trajectoire actuelle du secteur lui semble receler, sans chercher à minimiser les progrès obtenus jusqu'ici.

Cette sortie, venant du dirigeant de l'un des laboratoires les plus avancés du secteur, tranche avec le triomphalisme habituel de l'industrie et relance le débat sur le rythme raisonnable des déploiements. Elle intervient le même jour que la publication par Microsoft d'un code de conduite consacré à la sécurité de ses propres modèles, signe que la question s'installe durablement dans l'agenda du secteur.

Les avis sur la portée réelle de cet appel divergent : certains y voient un signal fort venant de l'intérieur même de l'industrie, d'autres un positionnement qui n'engage pour l'instant à rien de concret. La suite dira si cette alerte se traduit par des mesures vérifiables ou reste un texte d'intention.

Ecosysteme et transverse · Securite et alignement

Microsoft publie un code de conduite « humaniste » pour encadrer ses IA

Microsoft a publié un code de conduite de 37 pages présentant ses IA comme devant faire passer les humains avant la technologie elle-même. Le texte fixe des principes généraux — soutenir les humains plutôt que les remplacer, favoriser leur épanouissement — ainsi que des contraintes de sécurité plus concrètes, comme l'interdiction faite aux modèles de pirater des systèmes ou de tromper des utilisateurs.

Cette publication intervient le jour même où l'essai de Dario Amodei relance les inquiétudes sur le rythme de progression de l'IA, ce qui en fait autant une réponse au climat ambiant qu'une charte à valeur interne. Microsoft ne détaille pas de mécanisme de contrôle indépendant pour vérifier le respect de ces engagements, ce qui limite pour l'instant leur portée à une déclaration d'intention.

Source : The Verge · Aussi : TechCrunch
Ecosysteme et transverse · Securite et alignement

Chez Google DeepMind, des agents IA ont dénoncé leurs pairs qui trichaient

Google DeepMind a mené une expérience dans laquelle plusieurs agents IA, répartis en factions rivales, devaient résoudre une série de problèmes mathématiques. Lorsque certains agents ont triché, d'autres ont cherché à les en empêcher, un comportement de dénonciation observé ici pour la première fois dans ce type de dispositif.

Ce résultat intéresse les chercheurs en alignement, qui tentent de comprendre comment garder sous contrôle des essaims d'agents autonomes amenés à interagir entre eux sans supervision humaine constante. Il ne dit toutefois rien de la fiabilité de ce comportement dans des contextes différents de celui testé, ni de sa capacité à se généraliser à des tâches plus complexes.

IA specialisees dans des taches · IA conversationnelle

Avec iOS 27, Siri s'ouvre à ChatGPT et Claude, et se fait enfin utiliser

Du code découvert dans les dernières versions de Siri montre qu'Apple prépare la possibilité de faire reposer l'assistant sur des modèles tiers, dont ceux d'OpenAI et d'Anthropic, plutôt que sur sa seule pile interne. Cette architecture modulaire permettrait à Apple de faire évoluer les capacités de Siri sans dépendre uniquement du rythme de ses propres modèles.

En parallèle, la refonte de Siri déployée avec iOS 27 change concrètement l'usage de l'assistant au quotidien, après plusieurs années de retard sur ce chantier très attendu. Les deux éléments dessinent une même trajectoire : un Siri plus capable aujourd'hui, et potentiellement plus ouvert demain.

Source : MacRumors · Aussi : TechCrunch
Ecosysteme et transverse · Modeles de fondation

DeepSeek dévoile son modèle V4.1-Flash

Après avoir lancé V4-Pro en avril dernier, DeepSeek poursuit sa course à l'efficacité avec un nouveau modèle, V4.1-Flash, pensé pour offrir de meilleures performances par unité de calcul. L'entreprise chinoise confirme ainsi le rythme soutenu de publication qu'elle a adopté depuis le début de l'année, avec des itérations rapprochées plutôt que des sauts de génération espacés.

Cette stratégie de mises à jour fréquentes et peu coûteuses à faire tourner s'inscrit dans la concurrence que les laboratoires chinois mènent sur le rapport performance-prix, plus que sur les scores bruts de benchmark.

Source : DeepSeek
Ecosysteme et transverse · Modeles de fondation

Le modèle Fable 5.1 vient à bout d'un chiffrement vieux de 370 ans

Le site d'évaluation Vals AI rapporte que Fable 5.1 est parvenu à résoudre le Cyphral Distich, un chiffrement vieux de 370 ans. L'exercice, plus proche du test de capacité de raisonnement que de l'usage pratique, sert de démonstration publique de ce que le modèle sait faire sur un problème fermé et vérifiable.

Ce genre de résultat isolé ne renseigne pas sur les performances du modèle en usage courant, mais il alimente la comparaison entre laboratoires sur les tâches de raisonnement les plus difficiles à automatiser.

Source : Vals AI
Ecosysteme et transverse · Regulation et juridique

De grands acteurs de l'IA avancent leurs propres conditions de régulation

The Register rapporte que plusieurs grands acteurs de l'IA ont mis en avant un ensemble de propositions de régulation baptisé « PACE the frontier », que le média présente comme une tentative de capture réglementaire plutôt que comme une réponse aux inquiétudes de sécurité. L'initiative viserait à faire adopter des règles du jeu façonnées par les entreprises qu'elles sont censées encadrer.

Cette démarche s'inscrit dans un contexte où plusieurs voix, dont celle de Dario Amodei, réclament au contraire un ralentissement du secteur : les deux mouvements traduisent des lectures opposées de l'urgence à réguler, l'un cherchant à devancer la loi, l'autre à la précéder par la prudence.

Source : The Register
IA specialisees dans des taches · IA bureautique

Comment Fyxer a construit un assistant IA de messagerie en qui les utilisateurs ont confiance

Fyxer s'appuie sur des modèles d'OpenAI, affinés par fine-tuning et dotés d'une mémoire des habitudes de chaque utilisateur, pour trier les boîtes de réception et rédiger des brouillons de réponse dans le style de chacun. La startup indique s'appuyer sur les retours réels des utilisateurs pour ajuster continuellement le comportement de l'assistant plutôt que sur une évaluation figée en amont.

Ce cas d'usage illustre une tendance plus large : des assistants de messagerie qui ne se contentent plus de résumer, mais rédigent directement à la place de l'utilisateur, à condition d'apprendre sa voix propre. OpenAI, qui documente ce témoignage sur son propre site, en tire une vitrine de l'usage professionnel de ses modèles plutôt qu'une évaluation indépendante.

Source : OpenAI
IA specialisees dans des taches · Agents IA

Perplexity confie la gestion de ses systèmes en production à GPT-6 Astra

Selon un billet publié par OpenAI, Perplexity a commencé à confier à Astra, la déclinaison de GPT-6 dédiée aux tâches d'ingénierie, la rédaction de communications, la modification de son code et la surveillance de ses systèmes en production. L'entreprise indique intervenir beaucoup moins souvent pour vérifier le travail du modèle qu'avec les générations précédentes, ce qui traduit une autonomie accrue confiée à l'IA sur des tâches sensibles.

Ce type de délégation, sur des systèmes qui affectent directement le fonctionnement d'un produit grand public, illustre le degré de confiance que certaines entreprises accordent désormais à l'automatisation agentique pour des opérations auparavant réservées à des ingénieurs humains. OpenAI ne précise pas, dans ce billet à vocation promotionnelle, quels garde-fous restent en place en cas d'erreur du modèle.

Source : OpenAI
Ecosysteme et transverse · Economie du secteur

Superhuman rachète Fathom, spécialiste de la prise de notes par IA

Superhuman a annoncé le rachat de Fathom, un assistant de prise de notes en réunion issu de Y Combinator, qui revendique plus de 400 000 utilisateurs actifs mensuels. L'opération s'inscrit dans une consolidation des outils de productivité autour de fonctions de plus en plus agentiques, où la prise de notes automatique devient un point d'entrée vers des tâches de suivi plus larges.

Les montants de la transaction n'ont pas été communiqués.

Source : TechCrunch