CONSONANCE.for your information
lundi 5 octobre 2026frenvi
FICHE N° 2026-10-05RADAR IA & AGENTS

Trois voix, et ça devient une nouvelle.

Radar IA et agents. Chaque matin, et seulement ce que plusieurs sources indépendantes disent en même temps.

145 COMPTES ÉCOUTÉS
Synthèse du jourécrite par le modèle
  1. 01 Anthropic lance Sonnet 5.5Anthropic a lancé Claude Sonnet 5.5, offrant une vitesse accrue et des coûts réduits tout en intégrant des défenses renforcées contre la distillation.→ 11

Vidéo du jour

bobine n° 9 · 1:09
ÉTIQUETTEarchitecture · 23 voix

Google lance Gemini 4 Argon avec une limite de sortie d'1 million de tokens

Google a annoncé Gemini 4 Argon, offrant des performances accrues dans les flux de travail complexes en génie logiciel et en cybersécurité. Le modèle dispose d'une limite de sortie d'un million de tokens et est déployé auprès de testeurs de confiance.

GÉNÉRÉE AUTOMATIQUEMENT
Transcription

Consonance, bobine n° 9.

Lundi 5 octobre : ce que plusieurs voix indépendantes disent en même temps.

Google lance Gemini 4 Argon avec une limite de sortie d'1 million de tokens.

Google a annoncé Gemini 4 Argon, offrant des performances accrues dans les flux de travail complexes en génie logiciel et en cybersécurité.

De nouveaux modèles atteignent les sommets des benchmarks d'évaluation de l'IA.

Plusieurs nouveaux modèles d'intelligence artificielle ont atteint des positions de premier plan sur les benchmarks techniques et les indices de cybersécurité.

ChatGPT élargit son écosystème de plugins et déploie des mises à niveau de capacité pour GPT-6.1 Sol.

ChatGPT a intégré des recommandations de plugins directement dans les conversations et a mis en ligne des capacités de serveur supplémentaires pour le modèle GPT-6.1 Sol afin de répondre à la forte demande des abonnés et des API.

OpenAI lance les modèles GPT-6 avec GPT-6 Astra et GPT-6.1 Sol.

OpenAI a introduit la famille de modèles GPT-6, comprenant la version optimisée GPT-6 Astra et le modèle économique GPT-6.1 Sol.

30 sujets aujourd'hui, trois voix indépendantes au minimum pour chacun.

Les sources sont sur consonance.fyi.

En discussion

30 · sujets

Sujets repris par au moins trois comptes indépendants sur les sept derniers jours.

01 — agents · 3e jour 6 VOIX

Claude Code prend en charge la personnalisation de l'interface et du comportement via des plugins

Claude Code supports UI and behavior customization through mods and plugins

Claude Code permet aux utilisateurs de personnaliser son interface et son comportement à l'aide de mods basés sur TypeScript intégrés dans des plugins. La plateforme intègre également un plugin 'You should know' pour analyser les sorties du modèle.

6 comptes indépendants 16 messages 1 articles 1 labos 130 844 interactions
@ClaudeDevs ses sujets sur X ↗
@HamelHusain ses sujets sur X ↗
@addyosmani ses sujets sur X ↗
@amorriscode ses sujets sur X ↗
@bcherny ses sujets sur X ↗
@kimmonismus ses sujets sur X ↗
@trq212 ses sujets sur X ↗
02 — evaluation NOUVEAU 15 VOIX

De nouveaux modèles atteignent les sommets des benchmarks d'évaluation de l'IA

New models achieve top rankings across AI evaluation benchmarks

Plusieurs nouveaux modèles d'intelligence artificielle ont atteint des positions de premier plan sur les benchmarks techniques et les indices de cybersécurité. Google a lancé Gemini 4 Argon égalant GPT-6 Astra à moindre coût, tandis que Grok 4.7 s'est imposé en tête de l'AA Cyber Index et que Claude Opus 5.5 a progressé sur Drone-Bench.

15 comptes indépendants 139 messages 2 articles 7 labos 224 487 interactions
anthropicgooglegroknvidiaastradeepseekclaude opusclaude sonnet
@AlexFinn ses sujets sur X ↗
@AndrewCurran_ ses sujets sur X ↗
@AravSrinivas ses sujets sur X ↗
@ArtificialAnlys ses sujets sur X ↗
@ClaudeDevs ses sujets sur X ↗
@Hesamation ses sujets sur X ↗
@OpenAI ses sujets sur X ↗
@PromptLLM ses sujets sur X ↗
03 — system_design · 2e jour 15 VOIX

ChatGPT élargit son écosystème de plugins et déploie des mises à niveau de capacité pour GPT-6.1 Sol

ChatGPT expands plugin ecosystem and rolls out capacity upgrades for GPT-6.1 Sol

ChatGPT a intégré des recommandations de plugins directement dans les conversations et a mis en ligne des capacités de serveur supplémentaires pour le modèle GPT-6.1 Sol afin de répondre à la forte demande des abonnés et des API.

15 comptes indépendants 94 messages 4 labos 268 300 interactions
chatgpt
@AndrewBolis ses sujets sur X ↗
@GithubProjects ses sujets sur X ↗
@OpenAI ses sujets sur X ↗
@OpenAIDevs ses sujets sur X ↗
@PromptLLM ses sujets sur X ↗
@TheRundownAI ses sujets sur X ↗
@ajambrosino ses sujets sur X ↗
@alex_prompter ses sujets sur X ↗
04 — architecture · 3e jour 23 VOIX

Google lance Gemini 4 Argon avec une limite de sortie d'1 million de tokens

Google launches Gemini 4 Argon with a 1 million token output limit

Google a annoncé Gemini 4 Argon, offrant des performances accrues dans les flux de travail complexes en génie logiciel et en cybersécurité. Le modèle dispose d'une limite de sortie d'un million de tokens et est déployé auprès de testeurs de confiance.

23 comptes indépendants 127 messages 2 articles 8 labos 403 986 interactions
codexgeminigemini 3.8claude codeopencodesoraveocursor
@ArtificialAnlys ses sujets sur X ↗
@GeminiApp ses sujets sur X ↗
@Google ses sujets sur X ↗
@Hesamation ses sujets sur X ↗
@LangChain ses sujets sur X ↗
@OpenAI ses sujets sur X ↗
@OpenAIDevs ses sujets sur X ↗
@VibeMarketer_ ses sujets sur X ↗
05 — multimodal · 4e jour 10 VOIX

L'écosystème Muse s'élargit avec un micrologiciel open-source et des outils matériels

Muse ecosystem expands with open-source firmware and hardware tools

Le projet Muse a introduit Muse Gadgets, comprenant un micrologiciel ESP32 open-source et un SDK Linux pour développer des appareils matériels compatibles. Ce lancement s'accompagne d'une série continue de publications de modèles.

10 comptes indépendants 63 messages 1 articles 1 labos 73 260 interactions
muse spark
@AIatMeta ses sujets sur X ↗
@AlexFinn ses sujets sur X ↗
@ArtificialAnlys ses sujets sur X ↗
@TheRundownAI ses sujets sur X ↗
@VibeMarketer_ ses sujets sur X ↗
@aiedge_ ses sujets sur X ↗
@alex_prompter ses sujets sur X ↗
@alliekmiller ses sujets sur X ↗
06 — inference NOUVEAU 7 VOIX

Gemini 4 Argon est lancé avec des coûts d'exécution inférieurs à ceux des modèles concurrents

Gemini 4 Argon launches with lower task execution costs than competing models

Google a publié Gemini 4 Argon à un coût par tâche inférieur à celui de modèles concurrents tels qu'Astra et Opus, tout en prenant en charge le raisonnement multi-étapes grâce à sa limite de sortie d'un million de tokens.

7 comptes indépendants 13 messages 1 articles 2 labos 185 750 interactions
@AndrewCurran_ ses sujets sur X ↗
@GoogleDeepMind ses sujets sur X ↗
@Hesamation ses sujets sur X ↗
@MatthewBerman ses sujets sur X ↗
@demishassabis ses sujets sur X ↗
@eptwts ses sujets sur X ↗
@godofprompt ses sujets sur X ↗
@iScienceLuvr ses sujets sur X ↗
07 — architecture · 2e jour 15 VOIX

OpenAI lance les modèles GPT-6 avec GPT-6 Astra et GPT-6.1 Sol

OpenAI releases GPT-6 models including GPT-6 Astra and GPT-6.1 Sol

OpenAI a introduit la famille de modèles GPT-6, comprenant la version optimisée GPT-6 Astra et le modèle économique GPT-6.1 Sol. Ces nouveautés offrent des performances accrues et des capacités multimodales étendues pour les abonnés et l'API.

15 comptes indépendants 68 messages 2 articles 5 labos 179 626 interactions
gpt-6xai
@AndrewCurran_ ses sujets sur X ↗
@ArtificialAnlys ses sujets sur X ↗
@CuiMao ses sujets sur X ↗
@Hesamation ses sujets sur X ↗
@MatthewBerman ses sujets sur X ↗
@OpenAI ses sujets sur X ↗
@OpenAIDevs ses sujets sur X ↗
@OpenRouter ses sujets sur X ↗
08 — system_design · 4e jour 12 VOIX

ChatGPT ajoute le support natif pour créer et déployer des serveurs MCP directement

ChatGPT adds native support for building and deploying MCP servers directly

ChatGPT permet désormais aux utilisateurs de créer et déployer des serveurs Model Context Protocol directement depuis la plateforme. Cette mise à jour simplifie la connexion aux données et l'intégration d'extensions.

12 comptes indépendants 36 messages 1 articles 6 labos 46 192 interactions
model context protocol
@AravSrinivas ses sujets sur X ↗
@LangChain ses sujets sur X ↗
@OpenAIDevs ses sujets sur X ↗
@c_valenzuelab ses sujets sur X ↗
@derrickcchoi ses sujets sur X ↗
@godofprompt ses sujets sur X ↗
@huggingface ses sujets sur X ↗
@hwchase17 ses sujets sur X ↗
09 — agents NOUVEAU 4 VOIX

Devin intègre la facturation des abonnements ChatGPT et baisse ses tarifs

Devin integrates ChatGPT subscription billing and rolls out major price cuts

L'assistant de code Devin permet désormais d'utiliser les quotas des abonnements ChatGPT Plus ou Pro directement. En parallèle, la plateforme a réduit de manière significative les tarifs de ses formules tout en améliorant ses performances.

4 comptes indépendants 25 messages 1 labos 97 875 interactions
devin
@MatthewBerman ses sujets sur X ↗
@alex_prompter ses sujets sur X ↗
@cognition ses sujets sur X ↗
@haider1 ses sujets sur X ↗
@petergyang ses sujets sur X ↗
@thsottiaux ses sujets sur X ↗
@cwdegnan ses sujets sur X ↗
@matanSF ses sujets sur X ↗
10 — system_design · 5e jour 4 VOIX

Anthropic lance un portail dédié aux développeurs et aux ressources Claude

Anthropic launches dedicated developer portal and resource hub for Claude

Anthropic a inauguré un site web dédié aux développeurs concevant des applications avec Claude. Cette nouvelle plateforme propose des analyses techniques approfondies, des guides d'API et des retours d'expérience de l'équipe de développement.

4 comptes indépendants 7 messages 2 articles 2 labos 57 518 interactions
@ClaudeDevs ses sujets sur X ↗
@CuiMao ses sujets sur X ↗
@addyosmani ses sujets sur X ↗
@claudeai ses sujets sur X ↗
@dotey ses sujets sur X ↗
@simonw ses sujets sur X ↗
11 — architecture · 3e jour 14 VOIX

Anthropic présente Claude Sonnet 5.5, plus rapide et plus économique

Anthropic introduces Claude Sonnet 5.5 with higher speed and lower cost

Anthropic a lancé Claude Sonnet 5.5, offrant une vitesse de traitement accrue de 30 % et des coûts réduits par rapport à la version précédente. Ce modèle alimente désormais également la version gratuite du service.

14 comptes indépendants 26 messages 5 labos 253 958 interactions
@AlexFinn ses sujets sur X ↗
@AndrewCurran_ ses sujets sur X ↗
@AnthropicAI ses sujets sur X ↗
@ClaudeDevs ses sujets sur X ↗
@Hesamation ses sujets sur X ↗
@OpenRouter ses sujets sur X ↗
@PromptLLM ses sujets sur X ↗
@_catwu ses sujets sur X ↗
12 — inference NOUVEAU 4 VOIX

Les modèles GLM étendent leur disponibilité sur Cursor et Hugging Face

GLM models expand availability across Cursor and Hugging Face ecosystems

La famille de modèles GLM, incluant les versions 5.3 et 5.3 Flash, est désormais disponible dans l'environnement de développement Cursor. Ces modèles aux poids ouverts affichent des scores élevés sur CursorBench 4.0.

4 comptes indépendants 19 messages 1 articles 1 labos 33 065 interactions
glm
@cursor_ai ses sujets sur X ↗
@emollick ses sujets sur X ↗
@kimmonismus ses sujets sur X ↗
@natolambert ses sujets sur X ↗
@op7418 ses sujets sur X ↗
@teortaxesTex ses sujets sur X ↗
@TheAhmadOsman ses sujets sur X ↗
@VictorTaelin ses sujets sur X ↗
13 — inference NOUVEAU 5 VOIX

OpenRouter intègre de nouveaux modèles et enregistre une forte utilisation de Claude Opus 5.5

OpenRouter adds new models and reports high usage share for Claude Opus 5.5

OpenRouter a intégré de nouveaux modèles sur sa plateforme, dont le modèle de décision d1 de Liquid AI et la version préliminaire de Pareto 26.10. Parallèlement, Claude Opus 5.5 a rapidement capté la plus grande part des dépenses et des jetons parmi les modèles Anthropic sur le service.

5 comptes indépendants 42 messages 2 labos 36 610 interactions
openrouter
@OpenRouter ses sujets sur X ↗
@cline ses sujets sur X ↗
@heyshrutimishra ses sujets sur X ↗
@hwchase17 ses sujets sur X ↗
@mustafasuleyman ses sujets sur X ↗
@natolambert ses sujets sur X ↗
@ManusAI ses sujets sur X ↗
@PhotonHQ ses sujets sur X ↗
14 — agents · 4e jour 3 VOIX

OpenAI lance Dots, un système d'agents intelligents permanents

OpenAI launches Dots, an always-on AI agent system

OpenAI a lancé Dots, un système d'agents intelligents fonctionnant 24h/24 et 7j/7 avec accès à un navigateur dédié et à des milliers d'applications. Le système est conçu pour gérer de manière autonome des tâches complexes telles que les communications avec le service client.

3 comptes indépendants 5 messages 2 labos 157 255 interactions
@OpenAI ses sujets sur X ↗
@PromptLLM ses sujets sur X ↗
@minchoi ses sujets sur X ↗
@polynoamial ses sujets sur X ↗
@swyx ses sujets sur X ↗
15 — agents · 4e jour 3 VOIX

OpenAI lance Dots intégrant la mémoire de ChatGPT et se positionnant sur le marché des robots

OpenAI launches Dots integrating ChatGPT memory and competing in the bot market

OpenAI a publié Dots, un produit concurrent des assistants bots sur le marché. Ses principaux différenciateurs incluent une accessibilité continue et l'intégration de toutes les mémoires et interactions précédentes au sein de l'écosystème ChatGPT.

3 comptes indépendants 5 messages 1 labos 78 780 interactions
@AlexFinn ses sujets sur X ↗
@OpenAI ses sujets sur X ↗
@aiedge_ ses sujets sur X ↗
@derrickcchoi ses sujets sur X ↗
@minchoi ses sujets sur X ↗
16 — multimodal NOUVEAU 7 VOIX

Alibaba publie Qwen-Image-2.1, qui domine les classements de génération d'images

Alibaba releases Qwen-Image-2.1, topping open-weights image leaderboards

Alibaba a publié Qwen-Image-2.1, doté d'un générateur visuel de 7 milliards de paramètres qui prend la première place des classements de modèles ouverts. Par ailleurs, des modèles Qwen3.8 ont été intégrés dans des flux de travail multi-étapes et des plateformes de décision.

7 comptes indépendants 24 messages 2 articles 3 labos 19 719 interactions
qwen3gemmaqwen3.8sglangdeepseek v4 flash
@Alibaba_Qwen ses sujets sur X ↗
@ArtificialAnlys ses sujets sur X ↗
@GithubProjects ses sujets sur X ↗
@Hesamation ses sujets sur X ↗
@dair_ai ses sujets sur X ↗
@haider1 ses sujets sur X ↗
@iScienceLuvr ses sujets sur X ↗
@rohanpaul_ai ses sujets sur X ↗
17 — agents · 7e jour 9 VOIX

Nvidia présente l'Open Agent Safety Platform pour sécuriser les agents

Nvidia introduces the Open Agent Safety Platform for secure sandboxing

Nvidia s'est associé à plus de 100 organisations pour lancer l'Open Agent Safety Platform, combinant OpenShell et Sentry. La plateforme fournit des limites de sécurité robustes et des outils de cloisonnement pour les agents d'intelligence artificielle de longue durée.

9 comptes indépendants 15 messages 4 labos 148 482 interactions
@AndrewYNg ses sujets sur X ↗
@AravSrinivas ses sujets sur X ↗
@Hesamation ses sujets sur X ↗
@LangChain ses sujets sur X ↗
@NVIDIAAI ses sujets sur X ↗
@arthurmensch ses sujets sur X ↗
@heyshrutimishra ses sujets sur X ↗
@hwchase17 ses sujets sur X ↗
18 — agents NOUVEAU 4 VOIX

OpenAI se prépare à lancer un assistant toujours actif nommé o ou Aeon

OpenAI prepares to launch an always-on assistant named o or Aeon

Des indications suggèrent la révélation imminente d'un agent toujours actif de la part d'OpenAI, nommé o ou Aeon. Ce lancement fait suite aux gains de productivité significatifs observés lors des tests internes de technologies d'assistance.

4 comptes indépendants 8 messages 1 labos 269 465 interactions
@AndrewCurran_ ses sujets sur X ↗
@Hesamation ses sujets sur X ↗
@MatthewBerman ses sujets sur X ↗
@OpenAI ses sujets sur X ↗
@derrickcchoi ses sujets sur X ↗
@firstadopter ses sujets sur X ↗
@kimmonismus ses sujets sur X ↗
@swyx ses sujets sur X ↗
19 — system_design · 4e jour 4 VOIX

OpenAI ajuste les limites d'utilisation et la structure tarifaire des abonnements Pro

OpenAI adjusts usage limits and pricing structure for Pro subscriptions

OpenAI a rouvert les abonnements Pro à 200 dollars tout en modifiant le calcul des quotas d'utilisation. Cet ajustement réduit de moitié les allocations d'utilisation précédentes pour les abonnés dans le cadre du nouveau système.

4 comptes indépendants 14 messages 1 labos 57 895 interactions
@AlexFinn ses sujets sur X ↗
@Hesamation ses sujets sur X ↗
@eptwts ses sujets sur X ↗
@haider1 ses sujets sur X ↗
@op7418 ses sujets sur X ↗
@scaling01 ses sujets sur X ↗
@testingcatalog ses sujets sur X ↗
@thsottiaux ses sujets sur X ↗
20 — system_design · 2e jour 3 VOIX

OpenAI organise un événement en direct et diffuse sa conférence en ligne

OpenAI hosts a live keynote event with an online livestream

OpenAI a programmé une présentation en direct à 10h00, heure du Pacifique, accompagnée d'une rediffusion en ligne pour les participants distants.

3 comptes indépendants 3 messages 1 labos 46 769 interactions
@OpenAI ses sujets sur X ↗
@alliekmiller ses sujets sur X ↗
@derrickcchoi ses sujets sur X ↗
21 — evaluation NOUVEAU 4 VOIX

OpenAI signale une campagne d'extraction de modèles liée au développeur Moonshot AI

OpenAI reports model extraction campaign linked to Moonshot AI developers

OpenAI a enregistré une campagne visant à extraire les capacités de raisonnement cachées de ses modèles. Selon l'entreprise, un noyau de cette activité est attribué à des individus associés au développeur de Moonshot AI.

4 comptes indépendants 13 messages 1 articles 18 555 interactions
gemini 3.1 flashalibabamoonshot ai
@AndrewCurran_ ses sujets sur X ↗
@ArtificialAnlys ses sujets sur X ↗
@Google ses sujets sur X ↗
@kimmonismus ses sujets sur X ↗
@natolambert ses sujets sur X ↗
@rohanpaul_ai ses sujets sur X ↗
@teortaxesTex ses sujets sur X ↗
22 — multimodal NOUVEAU 3 VOIX

De nouvelles recherches explorent les modèles du monde et le raisonnement physique

New research explores video world models and physics reasoning

La communauté de recherche a publié de nouveaux cadres et articles axés sur les modèles du monde vidéo et le raisonnement physique. Ces initiatives visent à combler l'écart entre génération réaliste et lois physiques.

3 comptes indépendants 19 messages 4 labos 18 512 interactions
world model
@ClementDelangue ses sujets sur X ↗
@NVIDIAAI ses sujets sur X ↗
@c_valenzuelab ses sujets sur X ↗
@rohanpaul_ai ses sujets sur X ↗
@HaoranZhuX ses sujets sur X ↗
@LisaSu ses sujets sur X ↗
@MuzafferKal_ ses sujets sur X ↗
@camiinthisthang ses sujets sur X ↗
23 — inference NOUVEAU 4 VOIX

DeepSeek suspend la promotion gratuite du modèle V4.1-Flash en raison d'abus

DeepSeek pauses free V4.1-Flash promotion following high abuse

DeepSeek a temporairement suspendu la promotion gratuite de son modèle V4.1-Flash en raison d'un trafic abusif anormalement élevé. L'équipe de développement enquête actuellement pour mettre en place des mesures correctives.

4 comptes indépendants 31 messages 8 042 interactions
deepseek v4.1 flashdeepseek v4cline
@AndrewCurran_ ses sujets sur X ↗
@alex_prompter ses sujets sur X ↗
@arena ses sujets sur X ↗
@cline ses sujets sur X ↗
@scaling01 ses sujets sur X ↗
@teortaxesTex ses sujets sur X ↗
@EpochAIResearch ses sujets sur X ↗
@LeroyLi311063 ses sujets sur X ↗
24 — system_design NOUVEAU 4 VOIX

Résumé des récentes annonces et actualités de l'industrie de l'IA

Summary of recent AI industry announcements and updates

Plusieurs canaux de la communauté ont publié des récapitulatifs complets couvrant l'ensemble des annonces majeures et des lancements de produits récents au sein de l'écosystème de l'intelligence artificielle.

4 comptes indépendants 5 messages 2 articles 2 labos 7 147 interactions
@OpenAIDevs ses sujets sur X ↗
@alex_prompter ses sujets sur X ↗
@derrickcchoi ses sujets sur X ↗
@thsottiaux ses sujets sur X ↗
25 — evaluation NOUVEAU 3 VOIX

Progrès dans l'apprentissage par renforcement et nouveaux classements vidéo

Advances in reinforcement learning and updates to video generation benchmarks

Les discussions techniques se sont concentrées sur les implémentations de l'apprentissage par renforcement avec récompenses vérifiables. Parallèlement, de nouveaux modèles de génération vidéo ont intégré les classements d'évaluation.

3 comptes indépendants 7 messages 3 216 interactions
deepseek r1reinforcement learning with verifiable rewards
@arena ses sujets sur X ↗
@rasbt ses sujets sur X ↗
@teortaxesTex ses sujets sur X ↗
@jmbollenbacher ses sujets sur X ↗
@vivago_ai ses sujets sur X ↗
26 — inference NOUVEAU 3 VOIX

vLLM intègre le support de nouveaux modèles ouverts et optimise l'infrastructure

vLLM adds day-0 support for new open-weights models and scaling infrastructure

L'écosystème vLLM a ajouté un support immédiat pour de nouveaux grands modèles ouverts et mis à jour ses outils de routage sémantique. Les mainteneurs optimisent la gestion du cache KV pour les grands déploiements.

3 comptes indépendants 13 messages 1 labos 2 460 interactions
kv cachevllm
@cohere ses sujets sur X ↗
@teortaxesTex ses sujets sur X ↗
@vllm_project ses sujets sur X ↗
@IQuest_research ses sujets sur X ↗
@PrimeIntellect ses sujets sur X ↗
@PyTorch ses sujets sur X ↗
@bookwormengr ses sujets sur X ↗
@sh_reya ses sujets sur X ↗
27 — agents NOUVEAU 3 VOIX

Google DeepMind publie de nouvelles recherches sur l'agentivité et la conscience de l'IA

Google DeepMind publishes new surveys and research on AI agency and consciousness

Google DeepMind a publié une étude exhaustive cartographiant les théories de la conscience artificielle. Les chercheurs ont également souligné les perspectives d'utilisation future des agents autonomes.

3 comptes indépendants 14 messages 3 905 interactions
google deepmind
@Hesamation ses sujets sur X ↗
@ShaneLegg ses sujets sur X ↗
@TheRundownAI ses sujets sur X ↗
@eptwts ses sujets sur X ↗
@heyshrutimishra ses sujets sur X ↗
@kimmonismus ses sujets sur X ↗
@rohanpaul_ai ses sujets sur X ↗
@testingcatalog ses sujets sur X ↗
28 — agents · 4e jour 3 VOIX

LangChain lance mcp-adapters 2.0 et un cours sur les Deep Agents

LangChain releases mcp-adapters 2.0 and Deep Agents course

LangChain a publié la version 2.0 de mcp-adapters, intégrant le support de la dernière version sans état du protocole MCP pour les agents TypeScript et les outils interactifs. En parallèle, la plateforme a actualisé son programme LangChain Academy sur les Deep Agents et a introduit un outil de déploiement en une seule commande pour Managed Deep Agents.

3 comptes indépendants 18 messages 3 289 interactions
langchain
@CompleteSkeptic ses sujets sur X ↗
@LangChain ses sujets sur X ↗
@hwchase17 ses sujets sur X ↗
@LangChain_JS ses sujets sur X ↗
@amadaecheverria ses sujets sur X ↗
@assaf_elovic ses sujets sur X ↗
@ktech9999 ses sujets sur X ↗
@matt_feroz ses sujets sur X ↗

À lire de près

24 lectures

Articles et papiers, lus depuis leur résumé, classés par pertinence pour qui construit des agents et du backend.

02 — agents 13 votes

Scaling Trajectories for Complex Tasks through Recursive Self-Rewrite

QUESTION — Comment les trajectoires d'exécution diverses provenant de harnais d'agents spécialisés peuvent-elles être mises à l'échelle et reconstruites de manière systématique en données d'entraînement réutilisables ?

Trois harnais résolvent conjointement 759 tâches, soit 34,3 % de plus que le harnais individuel le plus fort du pool enregistré.

taesiri · 02 oct. 2026 lire l'original ↗
03 — system_design 9 votes

Nereus: Adaptive Parallelism for LLM Post-Training

QUESTION — Comment un runtime adaptatif peut-il ajuster les plans d'exécution lors du post-entraînement par RL des LLM face à l'évolution des ressources ?

L'adaptation TP/PP en ligne réduit la latence moyenne de 27.7% par rapport à la disposition fixe initiale avec mise à l'échelle DP.

HollowMan6 · 28 sept. 2026 lire l'original ↗
07 — training 57 votes

Does Learning Protein Folding Generalize to Broader Reasoning?

QUESTION — L'apprentissage du repliement des protéines peut-il enseigner des capacités de raisonnement réutilisables aux grands modèles de langage?

Sur FoldBench, Fold2Reason atteint des scores de prédiction de structure 2,7 à 3,5 fois supérieurs à ceux de Qwen3.5-9B.

liuyong9975 · 30 sept. 2026 lire l'original ↗
09 — agents 9 votes

AIM: Agentic Idea Management for Automated Research

QUESTION — Comment la recherche scientifique automatisée guidée par les idées peut-elle être gérée de manière autonome pour organiser les concepts et allouer les budgets ?

AIM surpasse la référence la plus solide de 1.6 point de pourcentage sur les tâches de System Optimization.

imhgchoi · 29 sept. 2026 lire l'original ↗
10 — multimodal 20 votes

FrameMorrow: Future-guided Frame Selection with Prospective Tokens for Long-Horizon Video Generation

QUESTION — Comment sélectionner efficacement les images historiques pour la génération de vidéos à long terme en fonction des besoins d'information futurs?

L'article présente FrameMorrow, un sélecteur d'images prospectives qui prédit un petit ensemble de jetons prospectifs représentant les besoins d'information futurs pour guider la sélection des images historiques. En sélectionnant les images historiques en fonction de leur pertinence par rapport aux besoins futurs, FrameMorrow permet une intégration plug-and-play à travers divers modèles génératifs, y compris les architectures open/closed-source, avec un surcoût d'inférence minimal.

YINBO0927 · 30 sept. 2026 lire l'original ↗
11 — architecture 11 votes

LOCI: Spatial Linear Memory for Streaming World Models

QUESTION — Comment maintenir une mémoire spatiale à long terme pour les modèles de monde vidéo en continu tout en contrôlant la consommation de mémoire ?

With full history, it lowers peak memory at equal length by about 30% relative to full softmax.

sum0214 · 30 sept. 2026 lire l'original ↗
17 — evaluation 17 votes

Align Then Reason: A Multimodal Lip-Sync Judge for Dubbing

QUESTION — Comment évaluer la qualité de la synchronisation labiale pour le doublage en utilisant uniquement une vidéo muette et du texte avant que l'audio ne soit généré?

Sur un benchmark à sept langues, notre méthode améliore l'AUC moyenne par rapport aux bases de référence Qwen3.5 SFT correspondantes de 59,4%, 50,2% et 50,8% avec des raisonneurs 2B, 4B et 9B.

lr10260 · 30 sept. 2026 lire l'original ↗
18 — training 13 votes

Removing the NEEDLE in the Haystack: Backdoor Removal in LLMs via Weight Orthogonalisation

QUESTION — Comment supprimer efficacement les portes dérobées (backdoors) des grands modèles de langage sans dégrader les performances bénignes ni la sécurité ?

NEEDLE est une méthode sans entraînement pour la suppression ciblée de portes dérobées qui ne nécessite ni modèle de référence propre ni données empoisonnées d'origine.

GeorgeDrayson · 29 sept. 2026 lire l'original ↗
19 — multimodal 15 votes

World Embedding Benchmark

QUESTION — Comment les représentations vidéo encodent-elles l'information physique et comment peuvent-elles être exploitées pour améliorer la fidélité de la génération de vidéos ?

Le benchmark comprend 8 000 cas de simulation contrôlés issus de 80 familles couvrant la mécanique des fluides, la mécanique des solides, la dynamique et l'optique.

gowitheflow · 02 oct. 2026 lire l'original ↗
20 — inference 11 votes

Scheduling Recursive Reasoning in Looped Transformers

QUESTION — Comment ajuster dynamiquement l'échelle de mise à jour dans les modèles de raisonnement récurrent pour améliorer l'efficacité de l'inférence ?

TAPS yields additional accuracy gains with up to 1.56 times wall-clock speedup at matched baseline accuracy.

ElvisWang111 · 29 sept. 2026 lire l'original ↗
21 — training 10 votes

LexReward: A Taxonomy-Driven Reward Framework for Legal Language Models

QUESTION — Comment construire des signaux de récompense multidimensionnels pour les modèles de langage juridiques ?

Cet article présente LexReward, un cadre basé sur une taxonomie pour la modélisation de récompense juridique. Le cadre caractérise la qualité des réponses juridiques selon trois dimensions : Style, Élément et Chaîne. Les auteurs développent des grilles d'évaluation pour chaque dimension afin de générer des données de préférence par paires pour le DPO et l'entraînement du modèle de récompense. Les expériences démontrent que les modèles de récompense appris, LexRM, améliorent les performances de la politique par apprentissage par renforcement sans nécessiter de réponses de référence.

yidacai · 30 sept. 2026 lire l'original ↗
22 — multimodal 11 votes

Devils in Question Relay: Source-Conditioned Relay Steering to Mitigate Hallucinations in Audio-visual Large Language Models

QUESTION — Comment atténuer les hallucinations de mise en correspondance confondues par la source dans les grands modèles de langage audio-visuels ?

SECRET consistently outperforms prior training-free methods, substantially mitigating source-confused grounding hallucinations (e.g., up to +18.0 and +7.1 percentage points over base models).

271754echo · 29 sept. 2026 lire l'original ↗

Sur le terrain

2026-10-05

Dépôts qui montent sur GitHub aujourd'hui, notés sur l'élan du jour, le rang, l'adoption, la fraîcheur et la santé du projet.

01 pbakaus/impeccable +1 171 Un ensemble de règles de design permettant aux développeurs de guider leurs agents IA dans la création d'interfaces utilisateur soignées. JavaScript
★ 76 573
02 DietrichGebert/ponytail +1 894 Un cadre d'agent de codage conçu pour écrire un minimum de code, destiné aux développeurs. JavaScript
★ 155 268
03 tester-army/e2e +345 Framework de test E2E nouvelle génération pour applications web et mobiles, utile pour les ingénieurs backend automatisant les tests d'intégration. TypeScript
★ 3 531
04 Panniantong/Agent-Reach +980 Un outil CLI pour collecter des données web et sociales sans frais, parfait pour doter vos agents d'un accès Internet. Python
★ 91 207
05 coreyhaines31/marketingskills +197 Un ensemble de compétences marketing pour Claude Code, destiné aux ingénieurs automatisant l'acquisition et le SEO. JavaScript
★ 53 215
06 addyosmani/agent-skills +336 Fournit des compétences d'ingénierie prêtes pour la production destinées aux agents de code. JavaScript
★ 101 316
07 thedotmack/claude-mem +628 Un système de gestion de mémoire à long terme aidant les agents IA à retenir le contexte entre les sessions. TypeScript
★ 96 278
08 calesthio/OpenMontage +245 Système de production vidéo multi-agents autonome avec plus de 100 outils, conçu pour les développeurs créant des agents de contenu multimédia. Python
★ 63 408
09 getsentry/sentry +152 Une plateforme de suivi d'erreurs et de performance de référence, indispensable pour observer les systèmes en production. Python
★ 45 443
10 michael-denyer/pstack-claude +232 Bibliothèque traduisant les workflows de Claude Code vers d'autres agent harnesses, parfaite pour les ingénieurs optimisant les boucles d'agents de code. JavaScript
★ 1 230
11 earthtojake/text-to-cad +83 Bibliothèque d'intégration CAD pour agents IA, idéale pour les développeurs construisant des agents automatisant la conception mécanique. Python
★ 17 009
12 garrytan/gstack +125 Ensemble d'outils CLI préconfigurés pour Claude Code, idéal pour les ingénieurs souhaitant automatiser des rôles de gestion technique dans les flux d'agents. TypeScript
★ 135 240
13 caddyserver/caddy +24 Serveur web haute performance avec HTTPS automatique en Go, excellent pour les ingénieurs backend déployant rapidement des passerelles API. Go
★ 76 697
14 antirez/ds4 +211 Moteur d'inférence local optimisé pour le matériel Metal, CUDA et ROCm, essentiel pour les ingénieurs exécutant des modèles locaux à faible latence. C
★ 23 500
↑