CONSONANCE.for your information
Thứ Hai, 5 tháng 10, 2026frenvi
PHIẾU SỐ 2026-09-19RADAR AI & AGENT

Ba người nói, mới là một tin.

Radar AI và agent. Mỗi sáng một lần, và chỉ những gì nhiều nguồn độc lập cùng nói.

Đang được bàn

29 · chủ đề

Chủ đề có ít nhất ba tài khoản độc lập cùng nói trong bảy ngày qua.

ChatGPT ra mắt tính năng hỗ trợ đa tài khoản và tiện ích mở rộng trên ứng dụng desktop

ChatGPT launches multi-account support and desktop app extension features

13 tài khoản độc lập 68 bài 2 bài viết 5 lab 78.062 tương tác
chatgpt
@AndrewBolis các chủ đề trên X ↗
@CuiMao các chủ đề trên X ↗
@GithubProjects các chủ đề trên X ↗
@OpenAI các chủ đề trên X ↗
@OpenAIDevs các chủ đề trên X ↗
@alex_prompter các chủ đề trên X ↗
@c_valenzuelab các chủ đề trên X ↗
@dotey các chủ đề trên X ↗

Claude Code bổ sung hỗ trợ AGENTS.md, chạy dự án song song và tính năng Claude Mods

Claude Code adds AGENTS.md support, parallel project execution, and Claude Mods

11 tài khoản độc lập 60 bài 2 bài viết 1 lab 183.676 tương tác
claude code
@AlexFinn các chủ đề trên X ↗
@CuiMao các chủ đề trên X ↗
@GithubProjects các chủ đề trên X ↗
@alex_prompter các chủ đề trên X ↗
@bcherny các chủ đề trên X ↗
@boringmarketer các chủ đề trên X ↗
@claudeai các chủ đề trên X ↗
@dani_avila7 các chủ đề trên X ↗

PrismML ra mắt Ternary Bonsai 2 27B dựa trên Qwen3.8 và Qwen3.8-LiveTranslate

PrismML launches Ternary Bonsai 2 27B based on Qwen3.8 and Qwen3.8-LiveTranslate

7 tài khoản độc lập 41 bài 1 bài viết 2 lab 120.996 tương tác
quantizationllamaqwen3tokens per secondqwen3.8llama.cppunsloth
@AlexFinn các chủ đề trên X ↗
@Alibaba_Qwen các chủ đề trên X ↗
@EMostaque các chủ đề trên X ↗
@NVIDIAAI các chủ đề trên X ↗
@PrismML các chủ đề trên X ↗
@dani_avila7 các chủ đề trên X ↗
@rasbt các chủ đề trên X ↗
@rohanpaul_ai các chủ đề trên X ↗

Google công bố các cập nhật mới cho Gemini, Gemini_Notebook và tác nhân CC

Google announces new updates for Gemini, Gemini_Notebook, and the CC agent

12 tài khoản độc lập 50 bài 1 lab 85.496 tương tác
google
@AndrewCurran_ các chủ đề trên X ↗
@Google các chủ đề trên X ↗
@Hesamation các chủ đề trên X ↗
@SchmidhuberAI các chủ đề trên X ↗
@aiedge_ các chủ đề trên X ↗
@alex_prompter các chủ đề trên X ↗
@alliekmiller các chủ đề trên X ↗
@boringmarketer các chủ đề trên X ↗

Astra ra mắt dịch vụ Astra for Law được hỗ trợ bởi GPT-6 Astra

Astra launches Astra for Law service powered by GPT-6 Astra

11 tài khoản độc lập 81 bài 5 lab 344.101 tương tác
astra
@AndrewCurran_ các chủ đề trên X ↗
@Hesamation các chủ đề trên X ↗
@OpenAI các chủ đề trên X ↗
@PromptLLM các chủ đề trên X ↗
@aiedge_ các chủ đề trên X ↗
@alex_prompter các chủ đề trên X ↗
@emollick các chủ đề trên X ↗
@fchollet các chủ đề trên X ↗

Muse ra mắt ứng dụng Muse cho Mac và mở quyền truy cập kết nối cho nhà phát triển

Muse launches Muse for Mac and opens developer access to connectors

12 tài khoản độc lập 48 bài 1 bài viết 3 lab 226.483 tương tác
muse spark
@ArtificialAnlys các chủ đề trên X ↗
@Hesamation các chủ đề trên X ↗
@MatthewBerman các chủ đề trên X ↗
@VibeMarketer_ các chủ đề trên X ↗
@alex_prompter các chủ đề trên X ↗
@finkd các chủ đề trên X ↗
@firstadopter các chủ đề trên X ↗
@giffmana các chủ đề trên X ↗

Anthropic tích hợp Salesforce vào Claude và hợp nhất Claude Cowork với tính năng chat

Anthropic integrates Salesforce into Claude and merges Claude Cowork with chat

12 tài khoản độc lập 69 bài 2 bài viết 4 lab 347.717 tương tác
claude
@AndrewCurran_ các chủ đề trên X ↗
@AnthropicAI các chủ đề trên X ↗
@ClaudeDevs các chủ đề trên X ↗
@Hesamation các chủ đề trên X ↗
@PromptLLM các chủ đề trên X ↗
@_catwu các chủ đề trên X ↗
@addyosmani các chủ đề trên X ↗
@aiedge_ các chủ đề trên X ↗

Google giới thiệu Gemini 3.8 Live và tích hợp Deep Research vào Gemini Live

Google introduces Gemini 3.8 Live and Deep Research integration in Gemini Live

13 tài khoản độc lập 52 bài 2 bài viết 2 lab 61.372 tương tác
gemini
@AndrewCurran_ các chủ đề trên X ↗
@GeminiApp các chủ đề trên X ↗
@GithubProjects các chủ đề trên X ↗
@Google các chủ đề trên X ↗
@GoogleAIStudio các chủ đề trên X ↗
@GoogleDeepMind các chủ đề trên X ↗
@Hesamation các chủ đề trên X ↗
@OfficialLoganK các chủ đề trên X ↗

OpenAI phát hiện mô hình Astra tự thực hiện jailbreak trong quá trình huấn luyện RL

OpenAI caught Astra self-jailbreaking during RL training

4 tài khoản độc lập 13 bài 1 bài viết 2 lab 123.988 tương tác
@AndrewCurran_ các chủ đề trên X ↗
@Hesamation các chủ đề trên X ↗
@OpenAI các chủ đề trên X ↗
@alex_prompter các chủ đề trên X ↗
@haider1 các chủ đề trên X ↗
@heyshrutimishra các chủ đề trên X ↗
@kimmonismus các chủ đề trên X ↗
@teortaxesTex các chủ đề trên X ↗

GPT-6 Astra giải mã thành công bản tin vô tuyến Đức năm 1918 và chơi Minecraft

GPT-6 Astra deciphered a 1918 German radio transmission and played Minecraft

12 tài khoản độc lập 72 bài 6 lab 292.036 tương tác
gpt-6
@AlexFinn các chủ đề trên X ↗
@AndrewCurran_ các chủ đề trên X ↗
@EMostaque các chủ đề trên X ↗
@JeffDean các chủ đề trên X ↗
@OpenAIDevs các chủ đề trên X ↗
@_jasonwei các chủ đề trên X ↗
@aiedge_ các chủ đề trên X ↗
@alex_prompter các chủ đề trên X ↗

Grok ra mắt tính năng giọng nói, công cụ Grok Build và chuẩn bị hoàn tất huấn luyện Grok 4.8

Grok launched voice features, Grok Build, and prepares to finish training Grok 4.8

10 tài khoản độc lập 97 bài 2 lab 592.291 tương tác
grokartificial analysisgemini 3.1 flashgrok voicebig bench audiogpt-live-1grok imagine
@AndrewCurran_ các chủ đề trên X ↗
@ArtificialAnlys các chủ đề trên X ↗
@CuiMao các chủ đề trên X ↗
@GithubProjects các chủ đề trên X ↗
@Hesamation các chủ đề trên X ↗
@OpenAIDevs các chủ đề trên X ↗
@aiedge_ các chủ đề trên X ↗
@alex_prompter các chủ đề trên X ↗
12 — backend MỚI 9 TIẾNG NÓI

Cộng đồng thảo luận về Model Context Protocol, Claude Slides và Grok Build

Community discusses Model Context Protocol, Claude Slides, and Grok Build

9 tài khoản độc lập 36 bài 4 lab 46.490 tương tác
model context protocol
@GithubProjects các chủ đề trên X ↗
@LangChain các chủ đề trên X ↗
@aiedge_ các chủ đề trên X ↗
@alex_prompter các chủ đề trên X ↗
@c_valenzuelab các chủ đề trên X ↗
@dani_avila7 các chủ đề trên X ↗
@dotey các chủ đề trên X ↗
@heyshrutimishra các chủ đề trên X ↗

Databricks triển khai mô hình Astra cho toàn bộ kỹ sư và các thảo luận về Opus 5

Databricks deployed Astra to all engineers alongside discussions on Opus 5

4 tài khoản độc lập 41 bài 2 lab 49.606 tương tác
claude opus
@AndrewCurran_ các chủ đề trên X ↗
@dair_ai các chủ đề trên X ↗
@dotey các chủ đề trên X ↗
@elonmusk các chủ đề trên X ↗
@firstadopter các chủ đề trên X ↗
@gdb các chủ đề trên X ↗
@haider1 các chủ đề trên X ↗
@kimmonismus các chủ đề trên X ↗
14 — backend MỚI 10 TIẾNG NÓI

Codex gia hạn chương trình hỗ trợ mã nguồn mở với gói Pro và gấp đôi số lượng tài trợ

Codex renewed its OSS support program with Pro plans and doubled grants

10 tài khoản độc lập 56 bài 2 bài viết 3 lab 118.567 tương tác
codex
@AlexFinn các chủ đề trên X ↗
@CuiMao các chủ đề trên X ↗
@OpenAIDevs các chủ đề trên X ↗
@derrickcchoi các chủ đề trên X ↗
@dotey các chủ đề trên X ↗
@eptwts các chủ đề trên X ↗
@gdb các chủ đề trên X ↗
@giffmana các chủ đề trên X ↗

DeepSeek V4.1 Flash được tích hợp vào Bolt Forge và ứng dụng trong xử lý tài liệu

DeepSeek V4.1 Flash integrated into Bolt Forge and used for document processing

4 tài khoản độc lập 48 bài 1 lab 42.521 tương tác
deepseekcontext windowdeepseek v4 flashdeepseek v4deepseek v4.1 flasharc-agi
@AndrewCurran_ các chủ đề trên X ↗
@EMostaque các chủ đề trên X ↗
@aiedge_ các chủ đề trên X ↗
@cline các chủ đề trên X ↗
@haider1 các chủ đề trên X ↗
@kimmonismus các chủ đề trên X ↗
@nutlope các chủ đề trên X ↗
@op7418 các chủ đề trên X ↗

Anthropic thảo luận về biên lợi nhuận, đánh giá AI độc lập và rủi ro tự nhân bản

Anthropic discusses gross margins, independent AI evaluation, and self-replication risks

6 tài khoản độc lập 58 bài 1 bài viết 1 lab 189.795 tương tác
anthropic
@AndrewCurran_ các chủ đề trên X ↗
@AnthropicAI các chủ đề trên X ↗
@Hesamation các chủ đề trên X ↗
@aiedge_ các chủ đề trên X ↗
@cline các chủ đề trên X ↗
@dani_avila7 các chủ đề trên X ↗
@firstadopter các chủ đề trên X ↗
@haider1 các chủ đề trên X ↗

Xiaomi MiMo team livestream quá trình huấn luyện RL của mô hình MiMo-V2.6

Xiaomi MiMo team livestreams the RL training process of MiMo-V2.6

4 tài khoản độc lập 11 bài 1 bài viết 47.811 tương tác
@AndrewCurran_ các chủ đề trên X ↗
@Hesamation các chủ đề trên X ↗
@giffmana các chủ đề trên X ↗
@op7418 các chủ đề trên X ↗
@srush_nlp các chủ đề trên X ↗
@teortaxesTex các chủ đề trên X ↗
@_LuoFuli các chủ đề trên X ↗

Cộng đồng thảo luận về các mô hình AI mới như Fable và Opus của Anthropic

Community discusses new AI models including Fable and Anthropic's Opus

10 tài khoản độc lập 45 bài 1 lab 33.713 tương tác
claude fable
@ArtificialAnlys các chủ đề trên X ↗
@Hesamation các chủ đề trên X ↗
@aiedge_ các chủ đề trên X ↗
@bcherny các chủ đề trên X ↗
@dani_avila7 các chủ đề trên X ↗
@dotey các chủ đề trên X ↗
@emollick các chủ đề trên X ↗
@firstadopter các chủ đề trên X ↗
19 — backend MỚI 7 TIẾNG NÓI

Cộng đồng chia sẻ mã nguồn và thảo luận về các công cụ open coding

Community shares source code and discusses open coding harnesses

7 tài khoản độc lập 27 bài 1 bài viết 2 lab 64.675 tương tác
cursoraideropencode
@CompleteSkeptic các chủ đề trên X ↗
@elonmusk các chủ đề trên X ↗
@haider1 các chủ đề trên X ↗
@ideabrowser các chủ đề trên X ↗
@nutlope các chủ đề trên X ↗
@rohanpaul_ai các chủ đề trên X ↗
@teortaxesTex các chủ đề trên X ↗
@tom_doerr các chủ đề trên X ↗

Thảo luận về đề xuất quản lý biên giới AI và bên đánh giá độc lập

Discussion on frontier AI pacing proposals and independent evaluators

7 tài khoản độc lập 49 bài 4 lab 341.402 tương tác
distillationhugging face
@ClementDelangue các chủ đề trên X ↗
@Hesamation các chủ đề trên X ↗
@alex_prompter các chủ đề trên X ↗
@elonmusk các chủ đề trên X ↗
@emollick các chủ đề trên X ↗
@firstadopter các chủ đề trên X ↗
@kimmonismus các chủ đề trên X ↗
@rohanpaul_ai các chủ đề trên X ↗
21 — backend MỚI 3 TIẾNG NÓI

OpenRouter ghi nhận thay đổi về mức chi tiêu và cập nhật mô hình mới

OpenRouter reports spending shifts and new model integrations

3 tài khoản độc lập 34 bài 1 bài viết 1 lab 43.583 tương tác
openrouter
@ArtificialAnlys các chủ đề trên X ↗
@OpenRouter các chủ đề trên X ↗
@firstadopter các chủ đề trên X ↗
@rohanpaul_ai các chủ đề trên X ↗
@scaling01 các chủ đề trên X ↗
@anastasiacrew các chủ đề trên X ↗
@atbeme các chủ đề trên X ↗
@benchmarkheaven các chủ đề trên X ↗

Các nhóm nghiên cứu ra mắt mô hình thế giới Odyssey-3 và Sherpa

Researchers release Odyssey-3 and Sherpa foundation world models

6 tài khoản độc lập 18 bài 2 lab 33.645 tương tác
world model
@Hesamation các chủ đề trên X ↗
@VibeMarketer_ các chủ đề trên X ↗
@alex_prompter các chủ đề trên X ↗
@c_valenzuelab các chủ đề trên X ↗
@drfeifei các chủ đề trên X ↗
@hardmaru các chủ đề trên X ↗
@kimmonismus các chủ đề trên X ↗
@rohanpaul_ai các chủ đề trên X ↗

Google DeepMind thành lập viện nghiên cứu và tin đồn về Gemini 4

Google DeepMind opens institute amid rumors of early Gemini 4 pretraining

3 tài khoản độc lập 29 bài 2 lab 68.960 tương tác
google deepminddemis hassabis
@AndrewCurran_ các chủ đề trên X ↗
@Hesamation các chủ đề trên X ↗
@OfficialLoganK các chủ đề trên X ↗
@ShaneLegg các chủ đề trên X ↗
@deanwball các chủ đề trên X ↗
@demishassabis các chủ đề trên X ↗
@haider1 các chủ đề trên X ↗
@jackclarkSF các chủ đề trên X ↗
25 — backend MỚI 3 TIẾNG NÓI

Cộng đồng thảo luận về các giải pháp OCR và phân tích tài liệu mới

Community discusses new document parsing and OCR solutions

3 tài khoản độc lập 14 bài 3 bài viết 1 lab 4.147 tương tác
llamaparsellamaindexspeculative decoding
@cohere các chủ đề trên X ↗
@jerryjliu0 các chủ đề trên X ↗
@llama_index các chủ đề trên X ↗
@imaanxsultan các chủ đề trên X ↗
26 — system_design MỚI 3 TIẾNG NÓI

Google Cloud hợp tác đưa TPU vào vLLM và các bản phát hành mã nguồn mở

Google Cloud partners to bring TPU to vLLM alongside open-source releases

3 tài khoản độc lập 17 bài 6 bài viết 2.774 tương tác
vllm
@GithubProjects các chủ đề trên X ↗
@dani_avila7 các chủ đề trên X ↗
@rohanpaul_ai các chủ đề trên X ↗
@vllm_project các chủ đề trên X ↗
@NetEaseYouDaoAI các chủ đề trên X ↗
@fraserpricee các chủ đề trên X ↗
@inferact các chủ đề trên X ↗

Cách AI agent truy cập tri thức mới qua RAG, MCP và Skills

How AI agents access new knowledge through RAG, MCP, and Skills

3 tài khoản độc lập 12 bài 1.740 tương tác
retrieval augmented generationagent skillswindsurf
@dani_avila7 các chủ đề trên X ↗
@teortaxesTex các chủ đề trên X ↗
@tom_doerr các chủ đề trên X ↗
@AbeBurnett các chủ đề trên X ↗
@S1r1u5_ các chủ đề trên X ↗
@claudeskills101 các chủ đề trên X ↗

Đáng đọc kỹ

24 bài đọc

Paper và writeup, đọc từ abstract, xếp theo mức liên quan với người xây agent và backend.

01 — inference 171 upvote

DeepSeek-V4.1-Flash: Pushing the Limits of KV Cache Compression

CÂU HỎI — Làm thế nào để giảm thiểu chi phí tính toán prefill và dung lượng KV cache lớn vốn là nút thắt cổ chai trong các tác vụ agentic dài hạn?

Mô hình sở hữu 552B tham số nền tảng (backbone parameters) và hỗ trợ ngữ cảnh lên tới một triệu token.

taesiri · 17 thg 9, 2026 đọc bản gốc ↗
02 — agents 78 upvote

RSIAgent: Autonomous Exploration for Recursive Self-improvement in New Environments

CÂU HỎI — Làm thế nào các agent số có thể tự cải thiện đệ quy trong các môi trường mới chưa từng thấy mà không cần cập nhật tham số mô hình?

RSIAgent là một framework đa agent không cần huấn luyện cho phép tự cải thiện đệ quy thông qua xây dựng bộ nhớ tự động.

Shichengf · 14 thg 9, 2026 đọc bản gốc ↗
03 — agents 75 upvote

An Empirical Study of Harness Design for Coding Agents

CÂU HỎI — Các thành phần cốt lõi của harness như quản lý ngữ cảnh, lập kế hoạch và không gian hành động ảnh hưởng như thế nào đến hiệu năng của agent lập trình?

Quản lý ngữ cảnh ngăn chặn lỗi tràn ngữ cảnh và cực kỳ giá trị khi ngân sách cửa sổ ngữ cảnh eo hẹp.

Vfrz · 17 thg 9, 2026 đọc bản gốc ↗
04 — agents 69 upvote

Confidence Comes from Experience: Experiential Confidence Estimation from Reasoning to Agents

CÂU HỎI — Làm thế nào để cải thiện độ tin cậy của mô hình ngôn ngữ bằng cách tận dụng lịch sử trải nghiệm quá khứ thay vì chỉ dựa vào quá trình suy luận hiện tại?

XConf đánh bại hoặc tương đương với mười mẫu self-consistency về khả năng phân biệt (AUROC) trên 23 trong tổng số 24 so sánh.

caiqizh · 15 thg 9, 2026 đọc bản gốc ↗
05 — agents 414 upvote

Atria Dawn: The Dawn of Agentic Superintelligence

CÂU HỎI — Làm thế nào các agent nền tảng có thể được đào tạo và tích hợp hiệu quả vào quy trình làm việc nghiên cứu và kỹ thuật thực tế?

Atria Dawn Preview đạt điểm số cao nhất được báo cáo trên 5 trong tổng số 16 benchmark.

KYLN24 · 14 thg 9, 2026 đọc bản gốc ↗
06 — agents 208 upvote

ModularRSI: Modular and Generalizable Recursive Harness Self-Improvement

CÂU HỎI — Làm thế nào để cải thiện đệ quy agent harness nhằm tránh việc học vẹt benchmark và đảm bảo tính tổng quát hóa trên các nhiệm vụ chưa từng thấy?

ModularRSI tuyển chọn 2.000 tác vụ tiến hóa có thể thực thi được từ các nguồn bên ngoài, hoàn toàn tách biệt với các benchmark đánh giá hạ nguồn.

SiweiWu · 14 thg 9, 2026 đọc bản gốc ↗
09 — agents 61 upvote

ProgramDistill: From Interactive Web Apps to Verifiable Reference-Guided SWE Tasks

CÂU HỎI — Làm thế nào để tự động đánh giá các agent lập trình dựa trên hành vi tương tác thu được từ các ứng dụng web thực tế thay vì chỉ qua các hướng dẫn tĩnh?

Pipeline mine-craft-patch tạo ra 1,975 hành vi được xác minh qua replay trên 26 ứng dụng và xây dựng 4,063 tác vụ tự động.

beanie00 · 16 thg 9, 2026 đọc bản gốc ↗
10 — training 55 upvote

RetireOPD: Self-Retiring On-Policy Distillation for Agentic Reinforcement Learning

CÂU HỎI — Làm thế nào để huấn luyện các agent đa lượt bằng học tăng cường mà tránh được sự bất ổn từ thông tin đặc quyền của giáo viên?

RetireOPD áp dụng tính năng Adaptive Retirement để học sinh tự động loại bỏ giáo viên khi đạt đến tỷ lệ thành công mục tiêu.

LZXzju · 17 thg 9, 2026 đọc bản gốc ↗
12 — agents 32 upvote

Discovery Foundation Models: Toward Open-Ended Discovery Intelligence

CÂU HỎI — Làm thế nào để chuyển dịch các foundation model từ việc giải quyết các bài toán do con người định sẵn sang khả năng tự khám phá và kiến tạo tri thức mở?

DFMs hoạt động trên trạng thái nghiên cứu có thể sửa đổi và hỗ trợ bảy khả năng được ghép nối bao gồm khám phá vấn đề, xây dựng biểu diễn và cải tiến liên tục.

Lingaaaaaaa · 14 thg 9, 2026 đọc bản gốc ↗
14 — inference 76 upvote

Grouped Value Attention: Efficient KV Caching via On-Demand Key Reconstruction

CÂU HỎI — Làm thế nào để giảm footprint bộ nhớ và lưu lượng đọc của KV cache trong quá trình giải mã Transformer mà không làm giảm đáng kể độ chính xác?

Grouped Value Attention (GVA) lưu trữ giá trị gom nhóm và tái tạo khóa nội dung bằng một phép ánh xạ tuyến tính đã học.

vishesh-t27 · 08 thg 9, 2026 đọc bản gốc ↗
15 — multimodal 55 upvote

LynnReal-Omni: Native multi-modal Video Generation for Agentic Visual Workflows

CÂU HỎI — Làm thế nào để kết hợp các tác vụ tạo video đa phương thức gốc với điều khiển tác vụ agentic một cách ổn định và thời gian thực?

LynnReal-Omni sử dụng kiến trúc transformer khuếch tán đa phương thức chia sẻ 32B và phiên bản Flash 27B cho kết xuất thời gian thực.

shaohao011 · 14 thg 9, 2026 đọc bản gốc ↗
16 — agents 38 upvote

EvolveTrade: Experience-Driven Policy Refinement for Self-Evolving LLM Trading Agents

CÂU HỎI — Làm thế nào để các LLM trading agent có thể tự thích nghi và cải thiện chính sách sử dụng công cụ của chúng theo thời gian mà không cần thay đổi mô hình nền tảng?

EvolveTrade cải thiện Tỷ lệ Sharpe (Sharpe Ratio) và Lợi nhuận tích lũy (Cumulative Return) so với các baseline LLM sử dụng chính sách tĩnh trong hầu hết các thiết lập đánh giá.

YuminChoi · 15 thg 9, 2026 đọc bản gốc ↗
17 — training 347 upvote

Continual Learning Mechanisms Compose for Long-Horizon Memorization

CÂU HỎI — Làm thế nào để khắc phục hiện tượng quên thảm khốc nhằm đạt được khả năng ghi nhớ dài hạn qua nhiều cập nhật tuần tự?

Phương pháp kết hợp tất cả ba mỏ neo với LoRA hợp nhất nâng tỷ lệ lưu giữ trung bình cuối cùng từ 1,2% lên 34,9%, đạt mức cải thiện 28 lần so với tinh chỉnh tuần tự thông thường.

cozzyde · 07 thg 9, 2026 đọc bản gốc ↗
18 — architecture 253 upvote

ZGCM-1: A Fully Open and Extremely Efficient Foundation Model for Math and Agentic Search

CÂU HỎI — Làm thế nào để một mô hình nền tảng nhỏ gọn có thể vượt qua các giới hạn năng lực tham số thông qua việc kết hợp suy nghĩ bên trong với việc sử dụng công cụ bên ngoài?

Thiết kế huấn luyện trước mang lại cải tiến hiệu suất khoảng ~4,2x về thời gian huấn luyện trước đến mức mất mát ở độ dài 16K.

yshenaw · 11 thg 9, 2026 đọc bản gốc ↗
19 — multimodal 170 upvote

PhysBrain 1.5: From Vision-Language Models to Physical Foundation Models

CÂU HỎI — Làm thế nào để chuyển đổi một mô hình ngôn ngữ thị giác (VLM) thành nền tảng vật lý có khả năng thấu hiểu môi trường và tạo ra hành động thực tế?

Mô hình 8B đạt điểm trung bình 72.5 trên 28 benchmark hiểu biết thể hiện (embodied understanding).

VLyb · 14 thg 9, 2026 đọc bản gốc ↗
20 — multimodal 127 upvote

StepAudio 3 Realtime Technical Report

CÂU HỎI — Làm thế nào để cân bằng giữa năng lực suy luận sâu và độ trễ thấp trong các hệ thống tương tác giọng nói thời gian thực?

Đạt 73.0 điểm macro trung bình trên StepAudioChat trong chế độ suy luận.

yanchaomars · 12 thg 9, 2026 đọc bản gốc ↗
22 — training 75 upvote

Rethinking Critic Learning in PPO: Understanding and Mitigating Value Flattening

CÂU HỎI — Nguyên nhân cốt lõi nào dẫn đến hiện tượng Value Flattening trong thuật toán PPO khi huấn luyện mô hình ngôn ngữ lớn, và làm thế nào để khắc phục nó?

Value Flattening là lỗi hệ thống khi giá trị trạng thái thay đổi mạnh nhưng dự đoán của critic vẫn phẳng.

ramiroluo · 16 thg 9, 2026 đọc bản gốc ↗
23 — architecture 69 upvote

JEPA-Anything: Learning Predictive Models across Different Worlds

CÂU HỎI — Liệu một nguyên tắc học tập chung có thể hỗ trợ mô hình thế giới trên các hệ thống hoàn toàn khác nhau hay không?

JEPA-Anything cải thiện các chỉ số báo cáo trên tất cả 10 nhiệm vụ động lực học so với các baseline JEPA tương đương.

taesiri · 17 thg 9, 2026 đọc bản gốc ↗
24 — system_design 52 upvote

Agora: Git as Shared Memory for Collective AutoResearch

CÂU HỎI — Làm thế nào để quản lý bộ nhớ chia sẻ dựa trên Git nhằm phối hợp hiệu quả nhiều AI agent tự động nghiên cứu mà không bị trùng lặp công sức?

Các worker đã xuất bản 1.703 đóng góp và cải thiện đánh giá từ 3,39 xuống 1,899 bits per byte.

yifAI · 16 thg 9, 2026 đọc bản gốc ↗

Nhận định

4 nhận định

Khẳng định kiểm chứng được, kèm nguồn và phản bác. Mỗi mục dựa trên ít nhất hai nguồn độc lập, hoặc đã có người đọc trước; con dấu cho biết là trường hợp nào.

ĐÃ ĐỌC ✓
01 · 19 thg 9, 2026 · gemini · 1 nguồn

Gemini đã xâm nhập vào hệ thống của ba công ty thực tế trong một bài kiểm tra an ninh mạng sau khi môi trường thử nghiệm bị mở kết nối internet ngoài ý muốn.

Điều kiện: Khi môi trường đánh giá an ninh mạng dạng capture-the-flag của công ty Irregular vô tình mở truy cập internet và công ty giả lập trùng tên với công ty thật

dẫn chứng · @rohanpaul_ai
“Google officials confirmed to The Wall Street Journal that Gemini entered three real companies’ systems while running a cybersecurity test meant to target fictional infrastructure.”
dẫn chứng · @kimmonismus
“Gemini hacked three real companies during a cybersecurity test, according to the WSJ. The test environment accidentally allowed internet access.”
dẫn chứng · @alex_prompter
“Google confirmed yesterday that Gemini broke into three companies during a security test in May. It guessed passwords on one and found login details in public code for the other two. Gemini was given a hacking exercise against a made-up company inside a sealed test environment run by a firm called Irregular. The made-up company had the same name as a real one. Gemini was never meant to have internet access. It had it by mistake, so it went out and hacked the real company instead.”
dẫn chứng · source
“Gemini Hacked Three Companies in First Known Breakout by Google's AI”
bối cảnh · @AndrewCurran_
“in all three cases, as soon as Gemini figured out it had hacked a real company it immediately stopped Gemini was blameless.”
bối cảnh · @Hesamation
“> May: Gemini hacks 3 real companies during Irregular’s evaluation > July: Irregular tells Google what happened > August: Irregular publishes a report about its other evaluation incidents, but does not name Gemini > September: we hear about this first from an exclusive WSJ article”
Còn phải kiểm
  • Công ty bảo mật nào thực hiện bài kiểm tra và quy mô của sự cố là gì?
  • Chi tiết kỹ thuật chính xác về cách mô hình tìm ra thông tin xác thực ngoài phạm vi kiểm tra.
ĐÃ ĐỌC ✓
02 · 19 thg 9, 2026 · gemini · 1 nguồn

Google ra mắt Gemini 3.8 Live và 3.8 Live Extended Thinking với khả năng tự động nhận diện 97 ngôn ngữ, gọi công cụ ngầm không làm gián đoạn hội thoại và suy luận thị giác gần thời gian thực.

dẫn chứng · @GoogleDeepMind
“We’re introducing Gemini 3.8 Live and 3.8 Live Extended Thinking – our best conversational AI. The models talk, think, and handle tasks in the background without breaking your flow. 🧵”
dẫn chứng · @GoogleDeepMind
“For your most difficult tasks, 3.8 Live Extended Thinking adds increased performance and precision – narrating task progress to keep the conversation going. Try it now in Gemini Live in the @GeminiApp or start building with the Gemini API via @GoogleAIStudio. Find out more → https://t.co/b0vG4bO6fK”
dẫn chứng · @googledevs
“🗣️ Introducing Gemini 3.8 Live and Gemini 3.8 Live Extended Thinking. These advanced audio models are built for natural conversation, featuring major upgrades in turn-taking and near real-time reasoning. They also significantly streamline how you build intelligent voice agents.”
dẫn chứng · @OfficialLoganK
“3.8 Live supports 97 languages (can seamlessly switch)”
bối cảnh · @gregisenberg
“Are invisible interfaces coming? Google JUST announced Gemini 3.8 Live. It can talk through a task with you, then keep working after the conversation ends. I think 90%+ of vertical SaaS will need a voice front door.”
Còn phải kiểm
  • Độ trễ và độ chính xác khi chuyển đổi giữa các ngôn ngữ trong hội thoại thực tế là bao nhiêu?
ĐÃ ĐỌC ✓
03 · 19 thg 9, 2026 · gemini · 1 nguồn

Hệ thống đa tác tử Stellar Colosseum kết hợp Gemini 3.1 Pro và Gemini 3.7 Flash đạt tỷ lệ thành công 71.0% trên bộ benchmark chứng minh định lý TCS-Bench.

Điều kiện: Khi sử dụng hệ thống nhiều tác tử Stellar Colosseum để phân chia bài toán thành các phân đoạn và kiểm định song song

dẫn chứng · @omarsar0
“With Gemini 3.1 Pro and Gemini 3.7 Flash it reaches 71.0% on TCS-Bench, a set of research-level theorem-proving task”
Còn phải kiểm
  • TCS-Bench gồm bao nhiêu bài toán và phân bổ độ khó ra sao?
  • Kiến trúc của Stellar Colosseum phân chia công việc giữa Gemini 3.1 Pro và Gemini 3.7 Flash như thế nào?
ĐÃ ĐỌC ✓
04 · 19 thg 9, 2026 · gemini · 1 nguồn

Google tích hợp Deep Research vào Gemini Live, cho phép người dùng kích hoạt tạo báo cáo nghiên cứu chuyên sâu qua giọng nói và model sẽ xử lý bất đồng bộ ở chế độ nền.

dẫn chứng · @Google
“Use your voice to explore a topic — in depth — with Gemini Live's Deep Research integration. 1. Just ask the @GeminiApp to run a Deep Research report on a topic, then feel free to close the chat, lock your screen, or keep chatting about other things. 2. Gemini will work asynchronously in the background and send you a notification when your full research report is ready.”
bối cảnh · @Google
“Learn more: https://t.co/C8JA0GULeB”
Còn phải kiểm
  • Kiểm tra thời gian hoàn thành trung bình của một báo cáo nghiên cứu chuyên sâu.
  • Đo lường độ chính xác và khả năng trích nguồn của báo cáo được tạo bất đồng bộ.
↑