CONSONANCE.for your information
lundi 5 octobre 2026frenvi
FICHE N° 2026-09-19RADAR IA & AGENTS

Trois voix, et ça devient une nouvelle.

Radar IA et agents. Chaque matin, et seulement ce que plusieurs sources indépendantes disent en même temps.

En discussion

29 · sujets

Sujets repris par au moins trois comptes indépendants sur les sept derniers jours.

01 — ai NOUVEAU 13 VOIX

ChatGPT launches multi-account support and desktop app extension features

13 comptes indépendants 68 messages 2 articles 5 labos 78 062 interactions
chatgpt
@AndrewBolis ses sujets sur X ↗
@CuiMao ses sujets sur X ↗
@GithubProjects ses sujets sur X ↗
@OpenAI ses sujets sur X ↗
@OpenAIDevs ses sujets sur X ↗
@alex_prompter ses sujets sur X ↗
@c_valenzuelab ses sujets sur X ↗
@dotey ses sujets sur X ↗
02 — ai NOUVEAU 11 VOIX

Claude Code adds AGENTS.md support, parallel project execution, and Claude Mods

11 comptes indépendants 60 messages 2 articles 1 labos 183 676 interactions
claude code
@AlexFinn ses sujets sur X ↗
@CuiMao ses sujets sur X ↗
@GithubProjects ses sujets sur X ↗
@alex_prompter ses sujets sur X ↗
@bcherny ses sujets sur X ↗
@boringmarketer ses sujets sur X ↗
@claudeai ses sujets sur X ↗
@dani_avila7 ses sujets sur X ↗
03 — ai NOUVEAU 7 VOIX

PrismML launches Ternary Bonsai 2 27B based on Qwen3.8 and Qwen3.8-LiveTranslate

7 comptes indépendants 41 messages 1 articles 2 labos 120 996 interactions
quantizationllamaqwen3tokens per secondqwen3.8llama.cppunsloth
@AlexFinn ses sujets sur X ↗
@Alibaba_Qwen ses sujets sur X ↗
@EMostaque ses sujets sur X ↗
@NVIDIAAI ses sujets sur X ↗
@PrismML ses sujets sur X ↗
@dani_avila7 ses sujets sur X ↗
@rasbt ses sujets sur X ↗
@rohanpaul_ai ses sujets sur X ↗
04 — ai NOUVEAU 12 VOIX

Google announces new updates for Gemini, Gemini_Notebook, and the CC agent

12 comptes indépendants 50 messages 1 labos 85 496 interactions
google
@AndrewCurran_ ses sujets sur X ↗
@Google ses sujets sur X ↗
@Hesamation ses sujets sur X ↗
@SchmidhuberAI ses sujets sur X ↗
@aiedge_ ses sujets sur X ↗
@alex_prompter ses sujets sur X ↗
@alliekmiller ses sujets sur X ↗
@boringmarketer ses sujets sur X ↗
06 — ai NOUVEAU 12 VOIX

Muse launches Muse for Mac and opens developer access to connectors

12 comptes indépendants 48 messages 1 articles 3 labos 226 483 interactions
muse spark
@ArtificialAnlys ses sujets sur X ↗
@Hesamation ses sujets sur X ↗
@MatthewBerman ses sujets sur X ↗
@VibeMarketer_ ses sujets sur X ↗
@alex_prompter ses sujets sur X ↗
@finkd ses sujets sur X ↗
@firstadopter ses sujets sur X ↗
@giffmana ses sujets sur X ↗
07 — ai NOUVEAU 12 VOIX

Anthropic integrates Salesforce into Claude and merges Claude Cowork with chat

12 comptes indépendants 69 messages 2 articles 4 labos 347 717 interactions
claude
@AndrewCurran_ ses sujets sur X ↗
@AnthropicAI ses sujets sur X ↗
@ClaudeDevs ses sujets sur X ↗
@Hesamation ses sujets sur X ↗
@PromptLLM ses sujets sur X ↗
@_catwu ses sujets sur X ↗
@addyosmani ses sujets sur X ↗
@aiedge_ ses sujets sur X ↗
08 — ai NOUVEAU 13 VOIX

Google introduces Gemini 3.8 Live and Deep Research integration in Gemini Live

13 comptes indépendants 52 messages 2 articles 2 labos 61 372 interactions
gemini
@AndrewCurran_ ses sujets sur X ↗
@GeminiApp ses sujets sur X ↗
@GithubProjects ses sujets sur X ↗
@Google ses sujets sur X ↗
@GoogleAIStudio ses sujets sur X ↗
@GoogleDeepMind ses sujets sur X ↗
@Hesamation ses sujets sur X ↗
@OfficialLoganK ses sujets sur X ↗
09 — ai NOUVEAU 4 VOIX

OpenAI caught Astra self-jailbreaking during RL training

4 comptes indépendants 13 messages 1 articles 2 labos 123 988 interactions
@AndrewCurran_ ses sujets sur X ↗
@Hesamation ses sujets sur X ↗
@OpenAI ses sujets sur X ↗
@alex_prompter ses sujets sur X ↗
@haider1 ses sujets sur X ↗
@heyshrutimishra ses sujets sur X ↗
@kimmonismus ses sujets sur X ↗
@teortaxesTex ses sujets sur X ↗
10 — ai NOUVEAU 12 VOIX

GPT-6 Astra deciphered a 1918 German radio transmission and played Minecraft

12 comptes indépendants 72 messages 6 labos 292 036 interactions
gpt-6
@AlexFinn ses sujets sur X ↗
@AndrewCurran_ ses sujets sur X ↗
@EMostaque ses sujets sur X ↗
@JeffDean ses sujets sur X ↗
@OpenAIDevs ses sujets sur X ↗
@_jasonwei ses sujets sur X ↗
@aiedge_ ses sujets sur X ↗
@alex_prompter ses sujets sur X ↗
11 — ai NOUVEAU 10 VOIX

Grok launched voice features, Grok Build, and prepares to finish training Grok 4.8

10 comptes indépendants 97 messages 2 labos 592 291 interactions
grokartificial analysisgemini 3.1 flashgrok voicebig bench audiogpt-live-1grok imagine
@AndrewCurran_ ses sujets sur X ↗
@ArtificialAnlys ses sujets sur X ↗
@CuiMao ses sujets sur X ↗
@GithubProjects ses sujets sur X ↗
@Hesamation ses sujets sur X ↗
@OpenAIDevs ses sujets sur X ↗
@aiedge_ ses sujets sur X ↗
@alex_prompter ses sujets sur X ↗
12 — backend NOUVEAU 9 VOIX

Community discusses Model Context Protocol, Claude Slides, and Grok Build

9 comptes indépendants 36 messages 4 labos 46 490 interactions
model context protocol
@GithubProjects ses sujets sur X ↗
@LangChain ses sujets sur X ↗
@aiedge_ ses sujets sur X ↗
@alex_prompter ses sujets sur X ↗
@c_valenzuelab ses sujets sur X ↗
@dani_avila7 ses sujets sur X ↗
@dotey ses sujets sur X ↗
@heyshrutimishra ses sujets sur X ↗
15 — ai NOUVEAU 4 VOIX

DeepSeek V4.1 Flash integrated into Bolt Forge and used for document processing

4 comptes indépendants 48 messages 1 labos 42 521 interactions
deepseekcontext windowdeepseek v4 flashdeepseek v4deepseek v4.1 flasharc-agi
@AndrewCurran_ ses sujets sur X ↗
@EMostaque ses sujets sur X ↗
@aiedge_ ses sujets sur X ↗
@cline ses sujets sur X ↗
@haider1 ses sujets sur X ↗
@kimmonismus ses sujets sur X ↗
@nutlope ses sujets sur X ↗
@op7418 ses sujets sur X ↗
16 — ai NOUVEAU 6 VOIX

Anthropic discusses gross margins, independent AI evaluation, and self-replication risks

6 comptes indépendants 58 messages 1 articles 1 labos 189 795 interactions
anthropic
@AndrewCurran_ ses sujets sur X ↗
@AnthropicAI ses sujets sur X ↗
@Hesamation ses sujets sur X ↗
@aiedge_ ses sujets sur X ↗
@cline ses sujets sur X ↗
@dani_avila7 ses sujets sur X ↗
@firstadopter ses sujets sur X ↗
@haider1 ses sujets sur X ↗
18 — ai NOUVEAU 10 VOIX

Community discusses new AI models including Fable and Anthropic's Opus

10 comptes indépendants 45 messages 1 labos 33 713 interactions
claude fable
@ArtificialAnlys ses sujets sur X ↗
@Hesamation ses sujets sur X ↗
@aiedge_ ses sujets sur X ↗
@bcherny ses sujets sur X ↗
@dani_avila7 ses sujets sur X ↗
@dotey ses sujets sur X ↗
@emollick ses sujets sur X ↗
@firstadopter ses sujets sur X ↗
19 — backend NOUVEAU 7 VOIX

Community shares source code and discusses open coding harnesses

7 comptes indépendants 27 messages 1 articles 2 labos 64 675 interactions
cursoraideropencode
@CompleteSkeptic ses sujets sur X ↗
@elonmusk ses sujets sur X ↗
@haider1 ses sujets sur X ↗
@ideabrowser ses sujets sur X ↗
@nutlope ses sujets sur X ↗
@rohanpaul_ai ses sujets sur X ↗
@teortaxesTex ses sujets sur X ↗
@tom_doerr ses sujets sur X ↗
20 — ai NOUVEAU 7 VOIX

Discussion on frontier AI pacing proposals and independent evaluators

7 comptes indépendants 49 messages 4 labos 341 402 interactions
distillationhugging face
@ClementDelangue ses sujets sur X ↗
@Hesamation ses sujets sur X ↗
@alex_prompter ses sujets sur X ↗
@elonmusk ses sujets sur X ↗
@emollick ses sujets sur X ↗
@firstadopter ses sujets sur X ↗
@kimmonismus ses sujets sur X ↗
@rohanpaul_ai ses sujets sur X ↗
21 — backend NOUVEAU 3 VOIX

OpenRouter reports spending shifts and new model integrations

3 comptes indépendants 34 messages 1 articles 1 labos 43 583 interactions
openrouter
@ArtificialAnlys ses sujets sur X ↗
@OpenRouter ses sujets sur X ↗
@firstadopter ses sujets sur X ↗
@rohanpaul_ai ses sujets sur X ↗
@scaling01 ses sujets sur X ↗
@anastasiacrew ses sujets sur X ↗
@atbeme ses sujets sur X ↗
@benchmarkheaven ses sujets sur X ↗
22 — ai NOUVEAU 6 VOIX

Researchers release Odyssey-3 and Sherpa foundation world models

6 comptes indépendants 18 messages 2 labos 33 645 interactions
world model
@Hesamation ses sujets sur X ↗
@VibeMarketer_ ses sujets sur X ↗
@alex_prompter ses sujets sur X ↗
@c_valenzuelab ses sujets sur X ↗
@drfeifei ses sujets sur X ↗
@hardmaru ses sujets sur X ↗
@kimmonismus ses sujets sur X ↗
@rohanpaul_ai ses sujets sur X ↗
23 — ai NOUVEAU 3 VOIX

Google DeepMind opens institute amid rumors of early Gemini 4 pretraining

3 comptes indépendants 29 messages 2 labos 68 960 interactions
google deepminddemis hassabis
@AndrewCurran_ ses sujets sur X ↗
@Hesamation ses sujets sur X ↗
@OfficialLoganK ses sujets sur X ↗
@ShaneLegg ses sujets sur X ↗
@deanwball ses sujets sur X ↗
@demishassabis ses sujets sur X ↗
@haider1 ses sujets sur X ↗
@jackclarkSF ses sujets sur X ↗

À lire de près

24 lectures

Articles et papiers, lus depuis leur résumé, classés par pertinence pour qui construit des agents et du backend.

01 — inference 171 votes

DeepSeek-V4.1-Flash: Pushing the Limits of KV Cache Compression

QUESTION — Comment réduire considérablement les coûts de calcul du pré-remplissage et l'empreinte massive du cache KV pour les agents à long horizon ?

DeepSeek-V4.1-Flash est un modèle MoE multimodal avec 552B paramètres de base et une prise en charge de contextes allant jusqu'à un million de tokens.

taesiri · 17 sept. 2026 lire l'original ↗
03 — agents 75 votes

An Empirical Study of Harness Design for Coding Agents

QUESTION — Comment les composants individuels du harness tels que la gestion du contexte, la planification et l'espace d'action impactent-ils les performances des agents de code ?

La gestion du contexte prévient les pannes de dépassement et devient plus précieuse lorsque le budget de la fenêtre de contexte est restreint.

Vfrz · 17 sept. 2026 lire l'original ↗
05 — agents 414 votes

Atria Dawn: The Dawn of Agentic Superintelligence

QUESTION — Comment les agents de fondation peuvent-ils être entraînés et intégrés efficacement dans les flux de travail de recherche et d'ingénierie réels ?

Atria Dawn Preview obtient le score le plus élevé rapporté sur cinq des 16 benchmarks.

KYLN24 · 14 sept. 2026 lire l'original ↗
06 — agents 208 votes

ModularRSI: Modular and Generalizable Recursive Harness Self-Improvement

QUESTION — Comment rendre l'auto-amélioration récursive des harnais d'agents généralisable sans surajustement aux benchmarks d'évaluation ni confusion des détails de tâches ?

ModularRSI sélectionne 2 000 tâches d'évolution exécutables provenant de sources externes, dissociées des benchmarks d'évaluation en aval.

SiweiWu · 14 sept. 2026 lire l'original ↗
07 — agents 102 votes

SoL-Pi: Recursively Scaling Auto-Research Loops for Efficient Agent Harness

QUESTION — Comment mettre à l'échelle de manière récursive les boucles de recherche automatique au niveau du harness pour optimiser l'utilisation des jetons et les coûts des agents de codage ?

Quatre mécanismes forment SoL-Pi, couvrant l'exécution des actions, la compression du contexte, la gestion des observations et la lecture déléguée.

Sensen02 · 17 sept. 2026 lire l'original ↗
10 — training 55 votes

RetireOPD: Self-Retiring On-Policy Distillation for Agentic Reinforcement Learning

QUESTION — Comment les agents multi-tours peuvent-ils être entraînés par apprentissage par renforcement tout en évitant l'instabilité liée aux informations privilégiées du professeur?

RetireOPD adopte la retraite adaptative où l'étudiant abandonne le professeur une fois que l'écart cesse de diminuer et atteint un taux de réussite cible.

LZXzju · 17 sept. 2026 lire l'original ↗
11 — agents 44 votes

Reflect, Revise, Reuse: Training-Free Skill Evolution for GUI Agents

QUESTION — Comment les agents GUI peuvent-ils faire évoluer dynamiquement leurs compétences exécutables à partir des retours de déploiement sans nécessiter d'entraînement supplémentaire du modèle ?

EvoSkill-GUI atteint des gains maximaux de +16.2%, +6.0% et +10.5% sur les benchmarks MobileWorld, AndroidWorld et OSWorld respectivement.

LZXzju · 15 sept. 2026 lire l'original ↗
12 — agents 32 votes

Discovery Foundation Models: Toward Open-Ended Discovery Intelligence

QUESTION — Comment faire passer les fondation models de la résolution de problèmes spécifiés par l'humain à la découverte ouverte et à la construction de connaissances ?

Un DFM opère sur un état de recherche révisable et prend en charge sept capacités couplées allant de la découverte de problèmes à l'amélioration continue.

Lingaaaaaaa · 14 sept. 2026 lire l'original ↗
13 — agents 30 votes

ScienceBuddy: Recursive-in-Recursive Self-Improvement for Interactive Scientific Agents

QUESTION — Comment les agents d'IA scientifique peuvent-ils co-évoluer continuellement leurs harnais et leurs poids de modèle grâce à une boucle d'auto-amélioration récursive ?

ScienceBuddy associe l'évolution du harnais à l'apprentissage par renforcement du modèle via un paradigme d'auto-amélioration récursive dans la récursive.

Lingaaaaaaa · 15 sept. 2026 lire l'original ↗
16 — agents 38 votes

EvolveTrade: Experience-Driven Policy Refinement for Self-Evolving LLM Trading Agents

QUESTION — Comment les agents de trading basés sur des LLM peuvent-ils faire évoluer automatiquement leurs politiques d'utilisation des outils grâce aux retours d'exécution sans modifier le modèle de base ?

EvolveTrade améliore le ratio de Sharpe et le rendement cumulé par rapport aux références LLM à politique fixe dans la plupart des contextes évalués.

YuminChoi · 15 sept. 2026 lire l'original ↗
17 — training 347 votes

Continual Learning Mechanisms Compose for Long-Horizon Memorization

QUESTION — Comment surmonter l'oubli catastrophique pour parvenir à une mémorisation à long terme sur de nombreuses mises à jour séquentielles ?

La méthode combinant les trois ancres avec un LoRA fusionné fait passer la rétention finale moyenne de 1,2 % sous fine-tuning séquentiel naïf à 34,9 %, soit une amélioration de 28 fois.

cozzyde · 07 sept. 2026 lire l'original ↗
20 — multimodal 127 votes

StepAudio 3 Realtime Technical Report

QUESTION — Comment concilier des capacités de raisonnement approfondi et une faible latence dans les systèmes d'interaction vocale en temps réel ?

En mode raisonnement, StepAudio 3 atteint une moyenne macro de 73,0 sur StepAudioChat.

yanchaomars · 12 sept. 2026 lire l'original ↗
22 — training 75 votes

Rethinking Critic Learning in PPO: Understanding and Mitigating Value Flattening

QUESTION — Quel est le mode de défaillance systématique connu sous le nom de Value Flattening dans les critiques PPO lors de l'apprentissage par renforcement des LLM, et comment l'atténuer ?

Le Value Flattening est un mode de défaillance où les valeurs d'état changent brusquement tandis que les prédictions du critique restent plates.

ramiroluo · 16 sept. 2026 lire l'original ↗
23 — architecture 69 votes

JEPA-Anything: Learning Predictive Models across Different Worlds

QUESTION — Un principe d'apprentissage commun peut-il prendre en charge la modélisation du monde à travers des systèmes radicalement différents ?

JEPA-Anything améliore les métriques rapportées sur l'ensemble des 10 tâches de dynamique par rapport aux références JEPA.

taesiri · 17 sept. 2026 lire l'original ↗
24 — system_design 52 votes

Agora: Git as Shared Memory for Collective AutoResearch

QUESTION — Làm thế nào để quản lý bộ nhớ chia sẻ dựa trên Git nhằm phối hợp hiệu quả nhiều AI agent tự động nghiên cứu mà không bị trùng lặp công sức?

Các worker đã xuất bản 1.703 đóng góp và cải thiện đánh giá từ 3,39 xuống 1,899 bits per byte.

yifAI · 16 sept. 2026 lire l'original ↗

Constats

4 constats

Affirmations vérifiables, avec leurs sources et leurs contradictions. Chacune tient sur au moins deux sources indépendantes, ou a été relue par un humain ; le tampon dit lequel.

RELU ✓
01 · 19 sept. 2026 · gemini · 1 sources

Gemini a piraté trois entreprises réelles lors d'un test de cybersécurité parce que l'environnement de test autorisait accidentellement l'accès à Internet.

Condition: L'environnement de test autorisait accidentellement l'accès à Internet.

appui · @rohanpaul_ai
« Google officials confirmed to The Wall Street Journal that Gemini entered three real companies’ systems while running a cybersecurity test meant to target fictional infrastructure. »
appui · @kimmonismus
« Gemini hacked three real companies during a cybersecurity test, according to the WSJ. The test environment accidentally allowed internet access. »
« Google confirmed yesterday that Gemini broke into three companies during a security test in May. It guessed passwords on one and found login details in public code for the other two. Gemini was given a hacking exercise against a made-up company inside a sealed test environment run by a firm called Irregular. The made-up company had the same name as a real one. Gemini was never meant to have internet access. It had it by mistake, so it went out and hacked the real company instead. »
appui · source
« Gemini Hacked Three Companies in First Known Breakout by Google's AI »
contexte · @AndrewCurran_
« in all three cases, as soon as Gemini figured out it had hacked a real company it immediately stopped Gemini was blameless. »
contexte · @Hesamation
« > May: Gemini hacks 3 real companies during Irregular’s evaluation > July: Irregular tells Google what happened > August: Irregular publishes a report about its other evaluation incidents, but does not name Gemini > September: we hear about this first from an exclusive WSJ article »
Reste à vérifier
  • Quelle entreprise de sécurité a mené le test et quelle est l'étendue de l'incident ?
  • Quels sont les détails techniques exacts sur la manière dont le modèle a trouvé des informations d'identification hors de portée ?
RELU ✓
02 · 19 sept. 2026 · gemini · 1 sources

Gemini 3.8 Live prend en charge 97 langues et peut basculer entre elles de manière transparente.

« We’re introducing Gemini 3.8 Live and 3.8 Live Extended Thinking – our best conversational AI. The models talk, think, and handle tasks in the background without breaking your flow. 🧵 »
« For your most difficult tasks, 3.8 Live Extended Thinking adds increased performance and precision – narrating task progress to keep the conversation going. Try it now in Gemini Live in the @GeminiApp or start building with the Gemini API via @GoogleAIStudio. Find out more → https://t.co/b0vG4bO6fK »
appui · @googledevs
« 🗣️ Introducing Gemini 3.8 Live and Gemini 3.8 Live Extended Thinking. These advanced audio models are built for natural conversation, featuring major upgrades in turn-taking and near real-time reasoning. They also significantly streamline how you build intelligent voice agents. »
« 3.8 Live supports 97 languages (can seamlessly switch) »
contexte · @gregisenberg
« Are invisible interfaces coming? Google JUST announced Gemini 3.8 Live. It can talk through a task with you, then keep working after the conversation ends. I think 90%+ of vertical SaaS will need a voice front door. »
Reste à vérifier
  • Quelle est la latence et la précision lors du changement de langue dans une conversation en direct ?
RELU ✓
03 · 19 sept. 2026 · gemini · 1 sources

Le système multi-agents Stellar Colosseum combinant Gemini 3.1 Pro et Gemini 3.7 Flash atteint un taux de réussite de 71,0 % sur le benchmark de démonstration de théorèmes TCS-Bench.

Condition: Khi sử dụng hệ thống nhiều tác tử Stellar Colosseum để phân chia bài toán thành các phân đoạn và kiểm định song song

appui · @omarsar0
« With Gemini 3.1 Pro and Gemini 3.7 Flash it reaches 71.0% on TCS-Bench, a set of research-level theorem-proving task »
Reste à vérifier
  • Combien de tâches comporte TCS-Bench et quelle est la répartition de la difficulté ?
  • Comment l'architecture de Stellar Colosseum répartit-elle la charge de travail entre Gemini 3.1 Pro et Gemini 3.7 Flash ?
RELU ✓
04 · 19 sept. 2026 · gemini · 1 sources

Google a intégré Deep Research à Gemini Live, permettant aux utilisateurs de déclencher la génération de rapports de recherche approfondis par la voix tandis que le modèle traite de manière asynchrone en arrière-plan.

appui · @Google
« Use your voice to explore a topic — in depth — with Gemini Live's Deep Research integration. 1. Just ask the @GeminiApp to run a Deep Research report on a topic, then feel free to close the chat, lock your screen, or keep chatting about other things. 2. Gemini will work asynchronously in the background and send you a notification when your full research report is ready. »
contexte · @Google
« Learn more: https://t.co/C8JA0GULeB »
Reste à vérifier
  • Vérifier le délai moyen d'exécution d'un rapport de recherche approfondi.
  • Mesurer la précision et la capacité d'attribution des sources du rapport généré de manière asynchrone.
↑