CONSONANCE.for your information
Thứ Hai, 5 tháng 10, 2026frenvi
PHIẾU SỐ 2026-09-24RADAR AI & AGENT

Ba người nói, mới là một tin.

Radar AI và agent. Mỗi sáng một lần, và chỉ những gì nhiều nguồn độc lập cùng nói.

Đang được bàn

32 · chủ đề

Chủ đề có ít nhất ba tài khoản độc lập cùng nói trong bảy ngày qua.

01 — multimodal · ngày thứ 2 15 TIẾNG NÓI

OpenAI ra mắt GPT-6 Sol và GPT-6 Luna, cùng các công cụ video Tesseract

OpenAI releases GPT-6 Sol and GPT-6 Luna alongside Tesseract video tools

OpenAI đã giới thiệu dòng mô hình GPT-6 Sol và GPT-6 Luna kế thừa từ GPT-6 Astra nhằm cung cấp các tùy chọn nhanh và tiết kiệm chi phí hơn. Đồng thời, hãng cũng ra mắt Tesseract, một bộ công cụ sáng tạo video dành cho các tác nhân AI.

15 tài khoản độc lập 80 bài 1 bài viết 8 lab 480.254 tương tác
gpt-6
@AndrewCurran_ các chủ đề trên X ↗
@ArtificialAnlys các chủ đề trên X ↗
@Hesamation các chủ đề trên X ↗
@OpenAI các chủ đề trên X ↗
@OpenAIDevs các chủ đề trên X ↗
@OpenRouter các chủ đề trên X ↗
@PromptLLM các chủ đề trên X ↗
@aiedge_ các chủ đề trên X ↗
02 — evaluation · ngày thứ 3 8 TIẾNG NÓI

SpaceXAI ra mắt Grok 4.7 với hiệu năng vượt trội trên bảng xếp hạng Artificial Analysis

SpaceXAI launches Grok 4.7 with high performance on the Artificial Analysis Intelligence Index

SpaceXAI đã phát hành Grok 4.7, đạt 46 điểm trên Artificial Analysis Intelligence Index và đưa phòng nghiên cứu này vào top 4 các phòng thí nghiệm AI. Mô hình này cải thiện hiệu suất lập trình đáng kể với tốc độ cao và chi phí thấp.

8 tài khoản độc lập 116 bài 1 bài viết 1 lab 2.424.577 tương tác
artificial analysisgrokcontext windowdeepsweopencodegrok voiceterminal-benchgrok imagine
@AlexFinn các chủ đề trên X ↗
@AndrewCurran_ các chủ đề trên X ↗
@ArtificialAnlys các chủ đề trên X ↗
@GithubProjects các chủ đề trên X ↗
@Hesamation các chủ đề trên X ↗
@aiedge_ các chủ đề trên X ↗
@dotey các chủ đề trên X ↗
@elonmusk các chủ đề trên X ↗
03 — architecture · ngày thứ 2 10 TIẾNG NÓI

Anthropic phát hành Claude Opus 5.5 với chi phí vận hành thấp hơn 40%

Anthropic releases Claude Opus 5.5 with 40% lower operating costs

Anthropic đã giới thiệu Claude Opus 5.5, mẫu mô hình đầu tiên trong gia đình Claude 5.5 đạt hiệu năng tương đương Claude Fable 5.1 nhưng có chi phí vận hành thấp hơn 40% so với phiên bản Opus 5.

10 tài khoản độc lập 18 bài 2 lab 422.935 tương tác
@AlexFinn các chủ đề trên X ↗
@AndrewCurran_ các chủ đề trên X ↗
@AnthropicAI các chủ đề trên X ↗
@Hesamation các chủ đề trên X ↗
@OpenRouter các chủ đề trên X ↗
@PromptLLM các chủ đề trên X ↗
@aiedge_ các chủ đề trên X ↗
@alex_prompter các chủ đề trên X ↗
04 — system_design MỚI 9 TIẾNG NÓI

DigitalOcean công bố bản public preview của Managed Agents

DigitalOcean announces public preview of Managed Agents

DigitalOcean đã tung ra bản public preview cho dịch vụ Managed Agents, cho phép chạy các tác nhân như Claude Code hoặc Codex trong môi trường thời gian thực tự động tạm dừng khi không hoạt động.

9 tài khoản độc lập 60 bài 3 lab 180.825 tương tác
codex
@CuiMao các chủ đề trên X ↗
@GithubProjects các chủ đề trên X ↗
@OpenAIDevs các chủ đề trên X ↗
@aiedge_ các chủ đề trên X ↗
@alex_prompter các chủ đề trên X ↗
@alliekmiller các chủ đề trên X ↗
@dani_avila7 các chủ đề trên X ↗
@dotey các chủ đề trên X ↗
05 — system_design · ngày thứ 2 10 TIẾNG NÓI

NVIDIA cung cấp hạ tầng phần cứng gia tốc cho Grok 4.7 và hệ sinh thái AI

NVIDIA provides accelerated computing infrastructure for Grok 4.7 and the AI ecosystem

Hạ tầng tính toán tăng tốc của NVIDIA tiếp tục hỗ trợ các mô hình trong hệ sinh thái AI, trong đó có việc hậu thuẫn cho Grok 4.7 của SpaceXAI trong các tác vụ lập trình và xử lý tri thức.

10 tài khoản độc lập 48 bài 2 lab 190.994 tương tác
nvidia
@ArtificialAnlys các chủ đề trên X ↗
@CuiMao các chủ đề trên X ↗
@NVIDIAAI các chủ đề trên X ↗
@SchmidhuberAI các chủ đề trên X ↗
@alex_prompter các chủ đề trên X ↗
@dair_ai các chủ đề trên X ↗
@elonmusk các chủ đề trên X ↗
@firstadopter các chủ đề trên X ↗
06 — agents MỚI 8 TIẾNG NÓI

ChatGPT mở rộng tính năng giọng nói, plugin đa tài khoản và tiện ích Chrome

ChatGPT expands voice capabilities, multi-account plugins, and Chrome extensions

OpenAI cập nhật ứng dụng ChatGPT với khả năng giọng nói tích hợp plugin từ email, lịch và Slack. Nền tảng cũng cho phép kết nối nhiều tài khoản với plugin và hỗ trợ tiện ích mở rộng Chrome trên ứng dụng máy tính.

8 tài khoản độc lập 66 bài 2 bài viết 4 lab 106.885 tương tác
chatgpt
@AndrewBolis các chủ đề trên X ↗
@CuiMao các chủ đề trên X ↗
@OpenAI các chủ đề trên X ↗
@OpenAIDevs các chủ đề trên X ↗
@VibeMarketer_ các chủ đề trên X ↗
@alex_prompter các chủ đề trên X ↗
@dotey các chủ đề trên X ↗
@gdb các chủ đề trên X ↗
07 — multimodal MỚI 10 TIẾNG NÓI

Google ra mắt dòng mô hình âm thanh Gemini 3.8 Flash và Flash-Lite TTS

Google launches Gemini 3.8 Flash and Flash-Lite TTS audio model family

Google giới thiệu Gemini 3.8 Flash TTS và Gemini 3.8 Flash-Lite TTS, các mô hình chuyển văn bản thành giọng nói với hơn 2.000 giọng đọc chuẩn sản xuất và hỗ trợ 100 ngôn ngữ. Cập nhật này cũng mở rộng tính năng cho Gemini 3.8 Live trong công cụ tìm kiếm.

10 tài khoản độc lập 32 bài 2 bài viết 3 lab 51.900 tương tác
gemini 3.8big bench audio
@Alibaba_Qwen các chủ đề trên X ↗
@AndrewCurran_ các chủ đề trên X ↗
@ArtificialAnlys các chủ đề trên X ↗
@EMostaque các chủ đề trên X ↗
@Google các chủ đề trên X ↗
@GoogleAIStudio các chủ đề trên X ↗
@OfficialLoganK các chủ đề trên X ↗
@aiedge_ các chủ đề trên X ↗
08 — architecture · ngày thứ 2 6 TIẾNG NÓI

DeepSeek phát triển mô hình lớn và thông tin lộ trình huấn luyện phần cứng

DeepSeek advances large model development and outlines hardware training roadmap

DeepSeek đang tiến hành huấn luyện các mô hình quy mô lớn 2 nghìn tỷ và 8 nghìn tỷ tham số, đồng thời dự kiến sử dụng chip huấn luyện của Huawei vào cuối năm 2026 hoặc đầu năm 2027. Nền tảng cũng tích hợp mô hình DeepSeek V4.1 Flash vào các công cụ phát triển.

6 tài khoản độc lập 28 bài 3 lab 121.304 tương tác
dspydeepseek v4deepseek v4 flashdeepseek v4.1 flash
@EMostaque các chủ đề trên X ↗
@Hesamation các chủ đề trên X ↗
@elonmusk các chủ đề trên X ↗
@ollama các chủ đề trên X ↗
@op7418 các chủ đề trên X ↗
@teortaxesTex các chủ đề trên X ↗
@vllm_project các chủ đề trên X ↗
@TheAhmadOsman các chủ đề trên X ↗
09 — agents MỚI 10 TIẾNG NÓI

Muse ra mắt ứng dụng máy tính tích hợp trợ lý AI đa năng cho nhà phát triển

Muse launches Mac app integrating versatile AI agent assistant for developers

Ứng dụng Muse cho máy tính Mac chính thức phát hành, hoạt động trên các tệp tin, lịch, ghi chú và tin nhắn. Nền tảng này mở quyền truy cập cho các nhà phát triển xây dựng trình kết nối API và hợp tác với Shopify để tối ưu hóa mua sắm.

10 tài khoản độc lập 74 bài 1 bài viết 2 lab 215.272 tương tác
muse sparkmeta ai
@AIatMeta các chủ đề trên X ↗
@VibeMarketer_ các chủ đề trên X ↗
@aiedge_ các chủ đề trên X ↗
@dani_avila7 các chủ đề trên X ↗
@emollick các chủ đề trên X ↗
@finkd các chủ đề trên X ↗
@firstadopter các chủ đề trên X ↗
@frankdegods các chủ đề trên X ↗
10 — system_design MỚI 9 TIẾNG NÓI

Google giới thiệu dòng laptop Googlebook tích hợp ngăn xếp Android và ChromeOS

Google introduces Googlebook laptop line powered by Android and ChromeOS stack

Google ra mắt Googlebook, dòng laptop mới trang bị màn hình cảm ứng OLED độ phân giải 2.8K và thời lượng pin 14 giờ. Thiết bị chạy trên nền tảng công nghệ Android kết hợp với hệ sinh thái máy tính để bàn ChromeOS.

9 tài khoản độc lập 73 bài 1 bài viết 2 lab 56.190 tương tác
geminigemini 3.1 flash
@Alibaba_Qwen các chủ đề trên X ↗
@AndrewCurran_ các chủ đề trên X ↗
@ArtificialAnlys các chủ đề trên X ↗
@GeminiApp các chủ đề trên X ↗
@GithubProjects các chủ đề trên X ↗
@Google các chủ đề trên X ↗
@GoogleDeepMind các chủ đề trên X ↗
@Hesamation các chủ đề trên X ↗
11 — evaluation · ngày thứ 5 11 TIẾNG NÓI

Anthropic hợp tác đánh giá độc lập với Accenture và thành lập phòng thí nghiệm sinh học

Anthropic partners with Accenture on independent evaluation and establishes biological lab

Anthropic hợp tác với Accenture để thực hiện đánh giá độc lập đối với các hệ thống AI tiên tiến với khoản đầu tư ít nhất 1 tỷ USD. Công ty cũng đã thành lập một phòng thí nghiệm sinh học vật lý tại San Francisco để tiến hành nghiên cứu thực nghiệm.

11 tài khoản độc lập 78 bài 1 bài viết 3 lab 104.057 tương tác
anthropicclaude sonnetclaude haikuaime
@AlexFinn các chủ đề trên X ↗
@AndrewCurran_ các chủ đề trên X ↗
@AnthropicAI các chủ đề trên X ↗
@CuiMao các chủ đề trên X ↗
@Hesamation các chủ đề trên X ↗
@aiedge_ các chủ đề trên X ↗
@alex_prompter các chủ đề trên X ↗
@dair_ai các chủ đề trên X ↗
12 — multimodal MỚI 6 TIẾNG NÓI

NVIDIA ra mắt mô hình phân đoạn giọng nói Nemotron 3 Diarization

NVIDIA releases Nemotron 3 Diarization model for multi-speaker audio tracking

NVIDIA phát hành mô hình Nemotron 3 Diarization với 100 triệu tham số, có khả năng theo dõi tối đa tám người nói và xử lý giọng nói chồng chéo. Hệ thống giúp xác định chính xác thời điểm từng người phát biểu trong các đoạn ghi âm phức tạp.

6 tài khoản độc lập 43 bài 9 bài viết 4 lab 101.287 tương tác
chain of thoughthugging face
@AndrewCurran_ các chủ đề trên X ↗
@ClementDelangue các chủ đề trên X ↗
@GithubProjects các chủ đề trên X ↗
@Gradio các chủ đề trên X ↗
@Hesamation các chủ đề trên X ↗
@NVIDIAAI các chủ đề trên X ↗
@_akhaliq các chủ đề trên X ↗
@alex_prompter các chủ đề trên X ↗
13 — agents · ngày thứ 6 11 TIẾNG NÓI

Claude Code bổ sung tệp cấu hình AGENTS.md và tính năng phiên làm việc trên mây

Claude Code adds AGENTS.md configuration support and cloud session capabilities

Claude Code cập nhật phiên bản 2.1.277, hỗ trợ tệp AGENTS.md khi thư mục không có tệp CLAUDE.md. Tính năng phiên làm việc trên mây cũng chính thức ra mắt, cho phép Claude tiếp tục thực hiện các tác vụ song song ngay cả khi người dùng đóng máy tính.

11 tài khoản độc lập 69 bài 1 bài viết 1 lab 226.932 tương tác
claude code
@AlexFinn các chủ đề trên X ↗
@ArtificialAnlys các chủ đề trên X ↗
@ClaudeDevs các chủ đề trên X ↗
@CuiMao các chủ đề trên X ↗
@aiedge_ các chủ đề trên X ↗
@alex_prompter các chủ đề trên X ↗
@alliekmiller các chủ đề trên X ↗
@bcherny các chủ đề trên X ↗
14 — agents MỚI 12 TIẾNG NÓI

Giới thiệu agent CC và thông tin vận động hành lang về quản lý AI

Introduction of the CC agent and lobbying efforts over AI regulation

Google vừa công bố CC, một trợ lý AI được thiết kế để hỗ trợ các gia đình quản lý lịch trình và công việc chung. Trong một diễn biến khác, các lãnh đạo công nghệ lớn được cho là đã thúc ép chính quyền loại bỏ một đề xuất quản lý AI do người đứng đầu Google DeepMind đề xuất.

12 tài khoản độc lập 45 bài 1 bài viết 3 lab 109.756 tương tác
googlegoogle deepminddemis hassabisjason wei
@Google các chủ đề trên X ↗
@Hesamation các chủ đề trên X ↗
@JeffDean các chủ đề trên X ↗
@OfficialLoganK các chủ đề trên X ↗
@aiedge_ các chủ đề trên X ↗
@alliekmiller các chủ đề trên X ↗
@boringmarketer các chủ đề trên X ↗
@dair_ai các chủ đề trên X ↗
15 — agents MỚI 7 TIẾNG NÓI

Nghiên cứu về ontology tự phát triển và tích hợp giao thức MCP cho agent

Research on self-evolving ontologies and MCP integration for agents

Các nghiên cứu mới đây cho thấy việc áp dụng tầng ontology tự phát triển giúp cải thiện đáng kể hiệu suất của các tác nhân AI trên các benchmark phức tạp. Bên cạnh đó, hệ sinh thái công cụ cũng đang mở rộng với việc tích hợp các máy chủ Model Context Protocol.

7 tài khoản độc lập 29 bài 1 bài viết 3 lab 46.961 tương tác
model context protocolmicrosoft research
@aiedge_ các chủ đề trên X ↗
@alex_prompter các chủ đề trên X ↗
@c_valenzuelab các chủ đề trên X ↗
@dair_ai các chủ đề trên X ↗
@dani_avila7 các chủ đề trên X ↗
@dotey các chủ đề trên X ↗
@ideabrowser các chủ đề trên X ↗
@op7418 các chủ đề trên X ↗
16 — multimodal · ngày thứ 2 3 TIẾNG NÓI

PixVerse công bố mô hình thế giới R2 và tác động của khung điều khiển

PixVerse unveils the R2 world model and the impact of harness design

PixVerse đã ra mắt R2, mô hình thế giới thời gian thực cho phép người dùng tương tác và chỉnh sửa môi trường sống động bằng câu lệnh. Ngoài ra, các nghiên cứu cũng chỉ ra rằng việc sử dụng khung điều khiển (harness) phù hợp có thể nâng cao đáng kể độ chính xác của mô hình trong các tác vụ robot dài hạn.

3 tài khoản độc lập 11 bài 1 bài viết 3 lab 25.064 tương tác
yann lecunworld model
@_akhaliq các chủ đề trên X ↗
@alex_prompter các chủ đề trên X ↗
@c_valenzuelab các chủ đề trên X ↗
@dair_ai các chủ đề trên X ↗
@tszzl các chủ đề trên X ↗
@10ayaGoldsen các chủ đề trên X ↗
@AmOptimistShow các chủ đề trên X ↗
@FuturLucide các chủ đề trên X ↗
17 — inference · ngày thứ 6 8 TIẾNG NÓI

Phát hành Ternary Bonsai 2 27B và mô hình dịch thuật thời gian thực Qwen3.8

Release of Ternary Bonsai 2 27B and the Qwen3.8 real-time translation model

Ternary Bonsai 2 27B vừa được ra mắt với kích thước nhỏ hơn 9 lần so với nguyên bản Qwen3.8 nhưng vẫn duy trì 98.2% hiệu suất benchmark. Cùng lúc đó, dòng Qwen3.8 cũng bổ sung phiên bản LiveTranslate chuyên dụng cho dịch thuật đồng thời thời gian thực.

8 tài khoản độc lập 52 bài 2 bài viết 3 lab 120.411 tương tác
kv cachemixture of expertsqwen3.8qwen3tokens per second
@Alibaba_Qwen các chủ đề trên X ↗
@ArtificialAnlys các chủ đề trên X ↗
@EMostaque các chủ đề trên X ↗
@OpenRouter các chủ đề trên X ↗
@PrismML các chủ đề trên X ↗
@godofprompt các chủ đề trên X ↗
@heyshrutimishra các chủ đề trên X ↗
@hwchase17 các chủ đề trên X ↗
18 — evaluation MỚI 4 TIẾNG NÓI

MiMo-V2.6-Pro dẫn đầu bảng xếp hạng mã nguồn mở của Artificial Analysis

MiMo-V2.6-Pro leads the open weights rankings on Artificial Analysis

MiMo-V2.6-Pro vừa vươn lên vị trí dẫn đầu trong số các mô hình có trọng số mở trên bảng xếp hạng của Artificial Analysis. Mô hình này sử dụng kiến trúc chú thích truy vấn nhóm cổ điển và đạt hiệu quả cao trên biên Pareto giữa năng lực và chi phí.

4 tài khoản độc lập 4 bài 1 lab 14.067 tương tác
@ArtificialAnlys các chủ đề trên X ↗
@ClementDelangue các chủ đề trên X ↗
@rasbt các chủ đề trên X ↗
@teortaxesTex các chủ đề trên X ↗
19 — evaluation MỚI 7 TIẾNG NÓI

Grok 4.7 xHigh cạnh tranh đỉnh bảng và tiến triển mới của Kimi K3

Grok 4.7 xHigh competes at the top alongside updates on Kimi K3

Grok 4.7 xHigh đã đạt mức điểm sát nút với các mô hình dẫn đầu trên benchmark AA-Briefcase của Artificial Analysis. Trong khi đó, các thông tin mới hé lộ sự chuẩn bị ra mắt của Kimi K3.1 và khả năng chạy mô hình dung lượng lớn trên phần cứng tối thiểu.

7 tài khoản độc lập 34 bài 1 lab 19.598 tương tác
glmkimi k3
@AndrewCurran_ các chủ đề trên X ↗
@Hesamation các chủ đề trên X ↗
@OpenRouter các chủ đề trên X ↗
@aiedge_ các chủ đề trên X ↗
@cline các chủ đề trên X ↗
@kimmonismus các chủ đề trên X ↗
@nutlope các chủ đề trên X ↗
@rohanpaul_ai các chủ đề trên X ↗
20 — agents MỚI 3 TIẾNG NÓI

Thảo luận về tự động hóa nghiên cứu AI và hệ thống đa tác nhân

Discussions on automated AI research and multi-agent systems

Cộng đồng thảo luận về tiềm năng tự động hóa nghiên cứu khoa học thông qua các hệ thống đa tác nhân. Các ý kiến xoay quanh triển vọng và thách thức khi siêu trí tuệ có khả năng tự phát triển các tiến bộ toán học và kỹ thuật.

3 tài khoản độc lập 15 bài 1 lab 37.455 tương tác
noam brown
@deanwball các chủ đề trên X ↗
@haider1 các chủ đề trên X ↗
@jerryjliu0 các chủ đề trên X ↗
@polynoamial các chủ đề trên X ↗
@scaling01 các chủ đề trên X ↗
@teortaxesTex các chủ đề trên X ↗
@tszzl các chủ đề trên X ↗
@dwarkesh_sp các chủ đề trên X ↗
21 — inference MỚI 3 TIẾNG NÓI

Tối ưu hóa hệ thống suy luận và tăng tốc độ xử lý cho mô hình ngôn ngữ lớn

Optimizing inference systems and accelerating execution for large language models

智谱 công bố GLM-5.3-Flash vận hành trên hơn 10.000 bộ tăng tốc AI nội địa, đạt mức tăng 3,2 lần về thông lượng nhờ tối ưu hóa tự động bằng tác nhân AI. Trong khi đó, các mô hình như DiffusionGemma và Ternary-Bonsai được tích hợp vào các framework vLLM và MLX.

3 tài khoản độc lập 23 bài 1 bài viết 2 lab 9.227 tương tác
sglangvllm
@AndrewCurran_ các chủ đề trên X ↗
@AravSrinivas các chủ đề trên X ↗
@dotey các chủ đề trên X ↗
@teortaxesTex các chủ đề trên X ↗
@vllm_project các chủ đề trên X ↗
@PyTorch các chủ đề trên X ↗
@XiaomiMiMo các chủ đề trên X ↗
@aiDotEngineer các chủ đề trên X ↗
22 — architecture MỚI 3 TIẾNG NÓI

DeepSeek thử nghiệm hạ tầng máy chủ lớn và Xiaomi ra mắt dòng MiMo-V2.6

DeepSeek trials large-scale server infrastructure and Xiaomi launches MiMo-V2.6

DeepSeek vận hành các đơn vị quy mô sản xuất gồm khoảng 160 nút, phục vụ khoảng 3 triệu hộp cát mỗi ngày. Cùng lúc, Xiaomi phát hành dòng MiMo-V2.6 gồm hai phiên bản Pro và Flash, trong đó bản Pro đạt 46 điểm trên bảng đánh giá Artificial Analysis.

3 tài khoản độc lập 48 bài 2 lab 8.396 tương tác
deepseekdeepseek r1moonshot ai
@Hesamation các chủ đề trên X ↗
@MatthewBerman các chủ đề trên X ↗
@dotey các chủ đề trên X ↗
@kimmonismus các chủ đề trên X ↗
@teortaxesTex các chủ đề trên X ↗
@54158zxc các chủ đề trên X ↗
@PeterDiamandis các chủ đề trên X ↗
@SemiAnalysis_ các chủ đề trên X ↗
23 — inference MỚI 4 TIẾNG NÓI

Chạy mô hình trọng số mở cục bộ trên thiết bị phần cứng hạn chế

Running local open-weight models on constrained hardware devices

Các nhà phát triển triển khai mô hình 27 tỷ tham số định dạng tam phân ở mức 1,72 bit mỗi trọng số trên một card đồ họa duy nhất với 12GB VRAM. Bên cạnh đó, các bản cập nhật tích hợp nhân Metal của llama.cpp và hỗ trợ SGLang cho mô hình tạo ảnh đã được phát hành.

4 tài khoản độc lập 20 bài 3 lab 11.277 tương tác
llama.cppllamaquantizationunslothgemma
@Alibaba_Qwen các chủ đề trên X ↗
@emollick các chủ đề trên X ↗
@teortaxesTex các chủ đề trên X ↗
@vllm_project các chủ đề trên X ↗
@ylecun các chủ đề trên X ↗
@DogukanUrker các chủ đề trên X ↗
@HuggingModels các chủ đề trên X ↗
@NewsFromGoogle các chủ đề trên X ↗
24 — system_design MỚI 3 TIẾNG NÓI

Alibaba công bố kế hoạch hạ tầng AI quy mô lớn và không gian mô phỏng RecreationWorld

Alibaba announces large-scale AI infrastructure plans and RecreationWorld sandbox

Alibaba đặt mục tiêu đạt 20 gigawatt công suất trung tâm dữ liệu toàn cầu vào năm 2032 cùng kế hoạch phát triển dòng mô hình Qwen từ 5 đến 10 nghìn tỷ tham số. Nhóm nghiên cứu Qwen cũng phát hành RecreationWorld, một không gian mô phỏng năm nền tảng cho các tác nhân sử dụng máy tính.

3 tài khoản độc lập 15 bài 1 lab 1.804 tương tác
bytedancealibabaalibaba qwen
@AravSrinivas các chủ đề trên X ↗
@Hesamation các chủ đề trên X ↗
@alex_prompter các chủ đề trên X ↗
@rohanpaul_ai các chủ đề trên X ↗
@teortaxesTex các chủ đề trên X ↗
@AlibabaGroup các chủ đề trên X ↗
@HuggingPapers các chủ đề trên X ↗
@perplexity_ai các chủ đề trên X ↗
25 — agents MỚI 3 TIẾNG NÓI

Cải tiến phương pháp tối ưu hóa kỹ năng cho tác nhân AI

Improving skill optimization methods for AI agents

Các nhà nghiên cứu giới thiệu phương pháp mới giúp tác nhân AI tự cải thiện lời nhắc kỹ năng thông qua việc xếp hạng các ứng viên, giúp giảm từ 40% đến 70% chi phí mã thông báo so với các phương pháp thông thường. NVIDIA cũng công bố cách chuyển đổi kỹ năng tác nhân thành môi trường học tăng cường.

3 tài khoản độc lập 9 bài 1.980 tương tác
agent skills
@NVIDIAAI các chủ đề trên X ↗
@aiedge_ các chủ đề trên X ↗
@dair_ai các chủ đề trên X ↗
@dani_avila7 các chủ đề trên X ↗
@claudeskills101 các chủ đề trên X ↗
26 — evaluation MỚI 3 TIẾNG NÓI

Đánh giá tỷ lệ từ chối an toàn trên các bảng xếp hạng tác nhân lập trình

Evaluating safety refusal rates on coding agent benchmarks

Artificial Analysis tích hợp tính năng báo cáo tỷ lệ từ chối an toàn vào phiên bản 1.5 của bộ chỉ số Tác nhân Lập trình nhằm giải thích sự khác biệt về hành vi giữa các mô hình. Dữ liệu cho thấy các mô hình khác nhau có tỷ lệ từ chối an toàn đáng chú ý khi thực hiện các tác vụ lập trình.

3 tài khoản độc lập 5 bài 1.583 tương tác
devin
@ArtificialAnlys các chủ đề trên X ↗
@Hesamation các chủ đề trên X ↗
@NVIDIAAI các chủ đề trên X ↗
@0x15f các chủ đề trên X ↗
27 — agents MỚI 3 TIẾNG NÓI

Ứng dụng học tập tự động và cải tiến phương pháp truy xuất cho tài chính

Automated learning applications and improved retrieval methods for finance

Một nghiên cứu phối hợp từ các trường đại học giới thiệu phương pháp giúp tác nhân tài chính tự học hỏi từ các lỗi trong hồ sơ SEC, yêu cầu mọi hành vi mới phải vượt qua bài kiểm tra hồi quy trước khi áp dụng. Các hệ thống truy xuất dữ liệu thích ứng mới cũng được phát triển để phục vụ các truy vấn chuyên biệt.

3 tài khoản độc lập 9 bài 1.393 tương tác
retrieval augmented generation
@AndrewBolis các chủ đề trên X ↗
@GithubProjects các chủ đề trên X ↗
@alex_prompter các chủ đề trên X ↗
@rohanpaul_ai các chủ đề trên X ↗
@boltzbit các chủ đề trên X ↗

Đáng đọc kỹ

24 bài đọc

Paper và writeup, đọc từ abstract, xếp theo mức liên quan với người xây agent và backend.

01 — agents 217 upvote

Realtime-Venus: A full-duplex interaction system with asynchronous delegation

CÂU HỎI — Làm thế nào để xây dựng một hệ thống tương tác full-duplex tích hợp khả năng nhận thức liên tục, điều khiển cuộc hội thoại và thực thi tác vụ nền bất đồng bộ bằng các 9B model?

Realtime-Venus-Omni đạt điểm số cao nhất trên sáu trong số tám video benchmark, bao gồm StreamingBench (70.2%), OVO-Bench (64.7%) và Daily-Omni (81.3%).

AdinaY · 12 thg 9, 2026 đọc bản gốc ↗
02 — system_design 67 upvote

Document Retrieval-Aware Chunking (D-RAC): Universal Retrieval-Aware Ingestion of Enterprise Documents via PDF Normalization and Multimodal Markdown Conversion

CÂU HỎI — Làm thế nào để chuyển đổi và chia nhỏ các tài liệu doanh nghiệp định dạng hỗn hợp (PDF, Word, scan) thành dữ liệu Markdown tối ưu cho retrieval mà vẫn tiết kiệm chi phí token và thời gian xử lý?

Trên tập benchmark gồm 236 tài liệu và 795 trang PDF, D-RAC chuyển đổi và chia nhỏ toàn bộ corpus trong 72 phút với 0 lỗi, tạo ra 1,748 chunk sẵn sàng cho retrieval.

udayallu · 21 thg 9, 2026 đọc bản gốc ↗
03 — agents 39 upvote

Just-in-Time Memory: Learning to Curate Task-Adaptive Memory for LLM Agents

CÂU HỎI — Làm thế nào để tối ưu hóa hệ thống bộ nhớ cho LLM agent bằng cách chuyển việc quản lý từ thời điểm ghi sang thời điểm đọc?

Trên ALFWorld, WebShop và τ^2-bench, JitMem cải thiện điểm số success-rate so với baseline mạnh nhất lần lượt là 16.2, 16.3 và 3.9 điểm tuyệt đối.

yli-ml · 23 thg 9, 2026 đọc bản gốc ↗
05 — agents 26 upvote

Agensh: Scaling Organizational Intelligence to 1,024 Agents

CÂU HỎI — Làm thế nào để mở rộng quy mô các tổ chức đa tác nhân (multi-agent organizations) vượt qua giới hạn của bộ điều phối trung tâm?

Scaling from 1 to 128 agents raises the mean final test-pass rate from 19.31% to 28.78%, an approximately 49% relative improvement.

zhan88855 · 22 thg 9, 2026 đọc bản gốc ↗
06 — training 23 upvote

PACT: From Credit Assignment to Critic Alignment

CÂU HỎI — Làm thế nào để định nghĩa toán học token-level credit và cải thiện quá trình huấn luyện actor-critic trong LLM post-training?

Trong lý luận toán học dạng agentic, PACT đạt độ chính xác trung bình 72.87% trên bốn benchmark, vượt qua GRPO và PPO lần lượt là 8.80 và 13.16 điểm phần trăm.

Eclipse2001 · 22 thg 9, 2026 đọc bản gốc ↗
07 — agents 12 upvote

MemBodied: Recurrent Associative Memory for Vision-Language-Action Models

CÂU HỎI — Làm thế nào để cung cấp bộ nhớ ngữ cảnh dài hạn cho các Vision-Language-Action models mà không làm phình to context hay tăng độ trễ inference?

MemBodied đạt tỷ lệ thành công trung bình gấp 7.81times so với chính sách phi trạng thái và 2.98times so với vanilla recurrent memory trên năm tác vụ RMBench.

soujanyaporia · 23 thg 9, 2026 đọc bản gốc ↗
10 — inference 42 upvote

JEV-as-a-Judge: Accept When Confident, Escalate When Unsure

CÂU HỎI — Làm thế nào để sử dụng một decision-only judge nhằm giảm chi phí suy luận của LLM-as-a-judge mà vẫn đảm bảo độ chính xác?

JEV is within three percentage points of a state-of-the-art LLM judge on ordinary preference and evidence-grounded factuality at 0.36% of the comparator's fee.

yubol · 22 thg 9, 2026 đọc bản gốc ↗
11 — training 17 upvote

Towards Full Pipeline FP8 Reinforcement Learning for LLMs

CÂU HỎI — Nguyên nhân gốc rễ nào gây ra sự bất ổn định trong quá trình huấn luyện Reinforcement Learning toàn pipeline bằng FP8 cho LLM, và làm thế nào để khắc phục nó?

Nhiễu lượng tử hóa FP8 tích lũy làm bóp méo tỷ lệ quan trọng, đẩy các token có lợi thế âm ra ngoài vùng tin cậy và làm mất gradient của chúng.

CFC · 19 thg 9, 2026 đọc bản gốc ↗
12 — training 11 upvote

Think Like a World Model, Act Like a VLA: Distilling World-Model Representations into Compact Robot Policies

CÂU HỎI — Làm thế nào để truyền đạt các biểu diễn thế giới vật lý từ world model sang các mô hình Vision-Language-Action nhỏ gọn mà không làm tăng độ trễ thời gian chạy?

Chính sách triển khai chạy trong 32 ms và chiếm 1.86 GB trên GPU tiêu dùng RTX 5090, hoàn toàn giống về cấu trúc với baseline không chưng cất.

termanteus · 21 thg 9, 2026 đọc bản gốc ↗
14 — training 16 upvote

1% of Tokens Can Be Enough: On Gradient Estimation in On-Policy Distillation

CÂU HỎI — Làm thế nào để cải thiện độ chính xác của ước tính gradient khi phân bổ giám sát thưa thớt từ giáo viên trong quá trình chưng cất trực tuyến (on-policy distillation)?

Sparse configurations matching or exceeding full OPD without token selection at small token budgets of 0.1%--1%.

HuanxinSheng · 21 thg 9, 2026 đọc bản gốc ↗
15 — training 13 upvote

From Pretraining to Proficiency: Real-World Subtask RL for Long-Horizon Manipulation with Minimal Human Intervention

CÂU HỎI — Làm thế nào để áp dụng RL fine-tuning cho các tác vụ thao tác dài hạn ngoài đời thực với sự can thiệp tối thiểu của con người?

Trên các tác vụ bimanual YAM và single-arm Franka, PARTS cải thiện tỷ lệ thành công toàn bộ tác vụ từ 32% lên 61% và từ 50% lên 95%.

Sichang0621 · 18 thg 9, 2026 đọc bản gốc ↗
16 — training 101 upvote

RULER: Instance-aware Rubric Rewards for SVG Generation

CÂU HỎI — Làm thế nào để tối ưu hóa chính sách học tăng cường (RL) cho tác vụ tạo mã SVG mở mà không phụ thuộc vào dữ liệu ground truth hay nhãn ưu đãi của con người?

Prompt một VLM judge với rubric nhiều trục tương quan tốt hơn với phán đoán của con người so với các thang đo scalar.

hangyuran · 21 thg 9, 2026 đọc bản gốc ↗
17 — architecture 49 upvote

The Past Frames the Future: Memory for Autoregressive Video Generation

CÂU HỎI — Cơ chế bộ nhớ nào duy trì tính liên tục và thông tin lịch sử trong việc tạo video tự hồi quy khi đối mặt với giới hạn ngữ cảnh?

Bài báo cung cấp một tổng quan hệ thống và toàn diện về các cơ chế bộ nhớ trong việc tạo video tự hồi quy (AR). Khi chuỗi video mở rộng, các mô hình thực tế phải hoạt động dưới các giới hạn nghiêm ngặt về cửa sổ ngữ cảnh, bộ nhớ lưu trữ và tính toán, khiến thông tin lịch sử quan trọng bị trôi đi. Nghiên cứu định hình bộ nhớ theo phương diện vận hành như thông tin lịch sử được duy trì qua các bước AR bên ngoài để ảnh hưởng đến việc tạo tương lai. Các tác giả tổ chức tài liệu theo năm góc nhìn bổ sung: Hình thức (Forms), Chức năng (Functions), Hoạt động (Operations), Học tập (Learning) và Đánh giá (Evaluation), qua đó đặt nền tảng cấu trúc cho các hệ thống tạo video điều kiện hóa bộ nhớ đáng tin cậy.

Harold328 · 23 thg 9, 2026 đọc bản gốc ↗
18 — multimodal 48 upvote

Spatial-Interactor: Learning Spatial Reasoning through Interaction with the Observable Physical World

CÂU HỎI — Làm thế nào để huấn luyện các vision-language models mô phỏng các chuyển đổi trạng thái trong thế giới vật lý thông qua tương tác?

Xây dựng tập dữ liệu Learning from Spatial Interaction (LSI-108K) từ các quỹ đạo tương tác mô phỏng và thực tế.

zwq2018 · 19 thg 9, 2026 đọc bản gốc ↗
21 — agents 14 upvote

DeformSmith: Physics Harness-Guided Hierarchical Generation of Deformable Assets for Robot Manipulation

CÂU HỎI — Làm thế nào để tự động tạo ra các tài sản có thể biến dạng cho robot thao tác từ text hoặc ảnh bằng một hệ thống agentic?

DeformSmith tạo ra các tài sản có chất lượng trực quan và tính hợp lý vật lý tốt hơn các baseline hiện tại bao gồm PhysGen3D, PhysGM và PhysX-Omni.

Canlee · 17 thg 9, 2026 đọc bản gốc ↗
22 — agents 11 upvote

PackLab: A Comprehensive Framework for Developing, Training, and Evaluating MLLMs in Robotic Bin Packing

CÂU HỎI — Làm thế nào để phát triển, huấn luyện và đánh giá các MLLM thực hiện việc sắp xếp đồ vật bằng robot theo chuỗi thời gian dài và khép kín?

PackLab-VLM vượt trội hơn các heuristic đóng gói thông thường, phương pháp reinforcement learning truyền thống và các MLLM đa dụng trên các tập đối tượng và cấu hình container khác nhau.

donghao-zhou · 20 thg 9, 2026 đọc bản gốc ↗
23 — evaluation 45 upvote

HappyWorld-Bench

CÂU HỎI — Làm thế nào để đánh giá toàn diện tính nhất quán và khả năng phản hồi của các world model khi agent tương tác và khám phá?

Spatial models achieve at best 70.14% placement accuracy and 73.33% edit execution.

CheeryLJH · 21 thg 9, 2026 đọc bản gốc ↗
24 — multimodal 69 upvote

GAE: Learning a Geometry-Native Latent Space for 3D-Consistent World Generation

CÂU HỎI — Làm thế nào để xây dựng một không gian tiềm ẩn (latent space) chuẩn hình học nhằm cải thiện tính nhất quán 3D và chất lượng hình ảnh trong việc tạo dựng world generation?

Thay thế latent thông thường bằng GAE làm giảm chỉ số FVD xuống 12.7% và 23.1% lần lượt trên các tập dữ liệu RealEstate10K và DL3DV.

Michaelqaz · 21 thg 9, 2026 đọc bản gốc ↗

Thực chiến

2026-09-24

Repo đang lên trên GitHub hôm nay, chấm theo đà trong ngày, thứ hạng, quy mô, độ tươi và sức khoẻ dự án.

01 anthropics/financial-services +664 Bộ ví dụ mẫu tích hợp LLM dành cho các kỹ sư backend xây dựng ứng dụng tài chính an toàn với Claude. Python
★ 37.102
02 davila7/claude-code-templates +389 Công cụ dòng lệnh tối ưu hóa cấu hình và theo dõi Claude Code, dành cho lập trình viên muốn tinh chỉnh workflow lập trình AI. Python
★ 31.625
03 google/ax +1.543 Runtime điều phối agentic bằng Go do Google phát triển, dành cho backend developer xây dựng hệ thống đa tác nhân quy mô lớn. Go
★ 9.465
04 obra/superpowers +474 Phương pháp luận và bộ kỹ năng cấu trúc giúp lập trình viên viết code hiệu quả hơn cùng các coding agent. Shell
★ 290.870
05 dream-num/univer +1.142 Bộ runtime tích hợp spreadsheet, docs và canvas, dành cho các kỹ sư muốn trao quyền thao tác Office trực tiếp cho AI agent. TypeScript
★ 16.544
06 pbakaus/impeccable +304 Hệ thống tiêu chuẩn thiết kế UI/UX giúp backend developers hướng dẫn AI agents tạo giao diện đẹp mắt hơn. JavaScript
★ 70.514
07 agent-substrate/substrate +558 Hạ tầng cốt lõi bằng Go dành cho các kỹ sư xây dựng hệ thống backend chịu trách nhiệm thực thi và quản lý vòng đời của AI agent. Go
★ 3.618
08 superdesigndev/treg +506 Gateway định tuyến API dạng OpenRouter chuyên cho tool-call của agent, dành cho backend developer quản lý linh hoạt các công cụ LLM. Python
★ 2.861
09 browser-use/video-use +746 Bộ công cụ tích hợp coding agent để chỉnh sửa video tự động, dành cho kỹ sư phát triển pipeline xử lý đa phương tiện điều khiển bằng LLM. Python
★ 26.647
10 BuilderIO/agent-native +87 Framework TypeScript hỗ trợ kỹ sư backend thiết kế và triển khai các ứng dụng agentic phức tạp. TypeScript
★ 6.678
11 DeusData/codebase-memory-mcp +190 High-performance code intelligence MCP server. Indexes codebases into a persistent knowledge graph — average repo in milliseconds. 158 languages, sub-ms queries, 99% fewer tokens. Single static binary, zero dependencies. C
★ 44.714
12 strands-agents/harness-sdk +115 SDK nguồn mở hỗ trợ xây dựng và điều phối hạ tầng agent đa nền tảng cho môi trường production. Python
★ 7.982
13 HKUDS/CLI-Anything +57 Bộ công cụ chuyển đổi phần mềm thông thường thành giao diện dòng lệnh tương thích với agent để tự động hóa. Python
★ 50.065
14 TNT-Likely/PanWatch +95 盯盘侠 PanWatch · 自托管 AI 盯盘助手,集成 TradingAgents 多 Agent 投资决策 | A股/港股/美股实时监控、持仓管理、智能分析、全渠道推送 Python
★ 1.666
15 harry7557558/spirula-studio +69 Cross-vendor 3D Gaussian Splatting trainer - video to splat to mesh, Vulkan or CUDA. C++
★ 824

Nhận định

1 nhận định

Khẳng định kiểm chứng được, kèm nguồn và phản bác. Mỗi mục dựa trên ít nhất hai nguồn độc lập, hoặc đã có người đọc trước; con dấu cho biết là trường hợp nào.

HAI NGUỒN · CHƯA ĐỌC
01 · 24 thg 9, 2026 · claude · 2 nguồn

Claude đã phát hiện ra một loại enzyme chưa từng được mô tả trước đây giống như CRISPR thông qua quá trình tìm kiếm cơ sở dữ liệu trình tự DNA bởi các tác nhân AI.

dẫn chứng · @nc_frey
“We’ve set up a molecular biology lab at Anthropic and we’re announcing our first discovery! Claude discovered a new CRISPR-like enzyme. 950 agents spent 21 hours searching through a database of DNA sequences until one of the agents found something striking”
dẫn chứng · @BoWang87
“About 950 Claude agent sessions ran over 21 hours, surveyed ~200,000 reverse transcriptases, and produced 19 reports.”
Còn phải kiểm
  • Kiểm tra lại cơ sở dữ liệu DNA được khảo sát và xác minh thực nghiệm trong phòng thí nghiệm về hoạt động của enzyme.
↑