Daily Newsby Damien Schneider
AccueilArticles
© 2026 Damien Schneider
Daily Newsby Damien Schneider
AccueilArticles

Catégories

Articles

Apple dévoile Siri AI à la WWDC, Anthropic ouvre Mythos

9 juin 2026·12 brèves

Tim Cook clôt son dernier keynote sur un Siri repensé qui laisse la Bourse de marbre, Anthropic met son palier Mythos entre les mains du public avec Fable 5, et Cognition montre que les meilleurs modèles plafonnent à 13/100 sur du vrai code.

IA & LLMs

Apple dévoile Siri AI à la WWDC, pour le dernier keynote de Tim Cook

À la WWDC 2026, Apple a présenté Siri AI : un assistant qui suit une conversation, croise le contexte des e-mails, du calendrier, des photos et des contacts, et enchaîne des actions entre apps, via une app de type chatbot. Le keynote dévoile aussi iOS 27, macOS Golden Gate et un aperçu de homeOS pour le futur hub domestique. La présentation, dernière de Tim Cook avant la passation à Jeff Williams puis John Ternus, n'a pas convaincu Wall Street : l'action a perdu jusqu'à −4 %, plusieurs fonctions ressemblant à des annonces déjà repoussées.

Démo officielle de Siri AI. Source : Apple.
#apple, #wwdc, #assistant
TechCrunchEngadgetvia Superhumanvia Aktionnaire

Anthropic ouvre son palier Mythos au public avec Claude Fable 5

Claude Fable 5 est le premier modèle de la famille Mythos disponible publiquement : état de l'art sur presque tous les benchmarks (code, vision, recherche scientifique), avec un écart d'autant plus grand que la tâche est longue. Tarif API à 10 $/M tokens en entrée, 50 $/M en sortie. Les sujets sensibles (cybersécurité, biologie) sont automatiquement reroutés vers Claude Opus 4.8, dans moins de 5 % des sessions. Mythos 5, même modèle avec moins de garde-fous, reste réservé à des partenaires sécurité validés — cinq jours après un papier d'Anthropic appelant à ralentir le développement frontière.

#anthropic, #modèle
AnthropicTechCrunchvia AlphaSignal

FrontierCode : les meilleurs modèles plafonnent à 13/100 sur du vrai code

Le benchmark FrontierCode de Cognition ne demande pas « le code passe-t-il les tests ? » mais « un mainteneur le fusionnerait-il ? » — en notant la justesse, la qualité des tests, la discipline de périmètre et le respect du style du dépôt. Les tâches ont été écrites par les mainteneurs de 36 dépôts open-source, 40 h+ chacune, en trois paliers. Sur le set Diamond, le meilleur modèle (Claude Opus 4.8) atteint 13,4/100 ; GPT-5.5 6,3, Gemini 3.1 Pro 4,7. Le benchmark produit aussi 81 % d'erreurs de notation en moins que SWE-Bench Pro.

#benchmark, #code
Cognitionvia AINewsvia AlphaSignal

NotebookLM passe à l'agentique et exécute du code

NotebookLM gagne un chat agentique qui planifie et enchaîne plusieurs étapes seul. Chaque notebook dispose d'un ordinateur cloud sécurisé pour écrire et exécuter du code, plus de 100 skills, la recherche autonome de sources via Google Search et de nouveaux exports (PDF, DOCX, XLSX, PPTX, CSV, JSON, PNG, SVG). Le tout sur Gemini 3.5, avec un taux de victoire de 65 % face à l'ancienne version, d'abord pour les abonnés AI Ultra.

#google, #notebooklm
GoogleThe Vergevia AlphaSignal

Kimi Work : un agent de bureau qui lance 300 sous-agents en local

Moonshot lance Kimi Work, app de bureau propulsée par Kimi K2.6 qui décompose une tâche en jusqu'à 300 sous-agents travaillant en parallèle sur la machine (×3 vs la génération précédente). Elle pilote le vrai navigateur via Chrome DevTools Protocol, planifie des tâches en cron et lit les fichiers locaux. App gratuite, swarm complet réservé aux paliers payants ; quand le portable se ferme, les tâches s'arrêtent.

#agent, #moonshot
Decryptvia Superhumanvia AlphaSignal

Amazon veut des agents IA qui n'hallucinent pas dans l'entrepôt

Amazon détaille Project Eluna, un agent cloud qui pilote ses centres de distribution. Le risque visé n'est plus une hallucination textuelle mais physique, aux conséquences matérielles ou humaines. La parade : quatre méthodes d'ancrage — apprentissage guidé par la physique, données métier, simulations numériques, sources externes — appuyées sur ses Foundation Models et une collaboration avec UC San Diego.

#amazon, #agents
Amazon Sciencevia Vision IA

Nouveaux modèles & outils open-source

  • Roblox Cube — modèle de fondation 3D open-source qui génère objets et scènes de jeu à partir de texte (newsroom).
  • Magenta RealTime 2 — génération musicale temps réel en open-weights, latence ~200 ms, pilotable au MIDI et intégrable en plugin DAW (poids).
  • Microsoft Lens — générateur d'images de 3,8 Md de paramètres entraîné sur 800 M de légendes détaillées, code et poids ouverts.
  • Gemma 4 MTP — la prédiction multi-tokens fusionnée dans llama.cpp double le débit ; ~140 tok/s sur RTX 4070 Super.
#open-source, #modèles
via AINewsvia AlphaSignal

Robotique

L'Europe ouvre la voie aux robotaxis, Pony.ai déjà commercial à Zagreb

Après les États-Unis et la Chine, les taxis autonomes arrivent en Europe : l'UE lance un cadre de test harmonisé pour autoriser des essais transfrontaliers et raccourcir les homologations. Pony.ai exploite déjà une dizaine de véhicules à Zagreb depuis avril, son premier service commercial européen. La Chine aligne, elle, près de 8 000 robotaxis.

#autonome, #europe
TechXplorevia Vision IA

Un humanoïde Unitree gravit le Chimborazo en 16 heures

Un Unitree G1 modifié, baptisé Pemba, a atteint en 16 heures le sommet du Chimborazo (6 200 m), le point de la surface terrestre le plus éloigné du centre de la Terre. Le robot marche en autonomie sous 30 degrés de pente, avec assistance sur les sections plus raides — première d'une série de trois ascensions extrêmes.

#humanoïde, #exploit
Pablo Berlanga (X)via Vision IA

Finance & Marchés

OpenAI dépose à son tour un dossier d'IPO confidentiel

OpenAI a déposé un S-1 confidentiel auprès du régulateur, une semaine après Anthropic et juste avant l'entrée en Bourse attendue de SpaceX vendredi. Aucun calendrier n'est arrêté — l'entreprise évoque « des choses plus simples à faire en restant privée » — mais l'opération pose les jalons de l'une des plus grosses IPO de l'histoire. Perplexity, de son côté, vise 2028.

#openai, #ipo
CNNCNBCvia Aktionnaire

La facture de calcul de l'IA structure les marchés du crédit

Anthropic boucle 35 Md$ de dette privée (Apollo, Blackstone, soutien de Broadcom) pour acheter et louer des TPU Google — l'une des plus grosses opérations de crédit privé jamais montées. En parallèle, Google versera 920 M$/mois à SpaceX d'octobre 2026 à juin 2029 pour 110 000 GPU Nvidia ; cumulés aux 220 000 processeurs réservés par Anthropic, ces contrats dépassent 70 Md$ et concentrent une part critique du hardware IA chez SpaceX, juste avant son IPO. Débordé, TSMC pousse Google et Nvidia à se tourner vers Intel comme fonderie de secours.

#infrastructure, #semi-conducteurs
BloombergTechCrunchvia Vision IA

En bref

  • SaaSpocalypse : les rachats de logiciels par le private equity tombent à 50 Md$ sur 5 mois (vs 88 Md$ un an plus tôt), 2026 vers sa pire année depuis 2018. Financial Times
  • SCAF : la France et l'Allemagne actent l'abandon de l'avion de combat du futur après l'échec Dassault-Airbus sur la gouvernance. Zone Militaire
  • Banques italiennes : Intesa Sanpaolo dégaine une offre de 31 Md€ sur Monte dei Paschi. La Tribune
  • Meta retire discrètement le code de reconnaissance faciale de l'app de ses lunettes Ray-Ban. Engadget
  • New York gèle un an les data centers de plus de 20 MW, le temps d'en évaluer l'impact environnemental. The Verge
#en-bref
Aktionnairevia Vision IA
© 2026 Damien Schneider