CONSONANCE.for your information
Thứ Hai, 5 tháng 10, 2026frenvi
PHIẾU SỐ 2026-09-27RADAR AI & AGENT

Ba người nói, mới là một tin.

Radar AI và agent. Mỗi sáng một lần, và chỉ những gì nhiều nguồn độc lập cùng nói.

Tổng hợp trong ngàydo mô hình viết
  1. 01 Xiaomi MiMo-V2.6 ra mắt trên OpenRouter và vLLMDòng mô hình MiMo-V2.6 của Xiaomi cùng cửa sổ ngữ cảnh 1M token đã chính thức có mặt trên cả nền tảng OpenRouter và vLLM.→ 2023
  2. 02 OpenAI và Anthropic đồng loạt ra mắt mô…OpenAI và Anthropic đều giới thiệu các dòng mô hình mới kèm theo mức giá API được cắt giảm đáng kể so với các thế hệ trước.→ 0912
  3. 03 Google đưa thử nghiệm TPU lên không gian…Google triển khai các nguyên mẫu vệ tinh mang theo bộ xử lý TPU để đánh giá khả năng vận hành trong điều kiện ngoài không gian.→ 0217

Video trong ngày

cuộn số 1 · 1:16
NHÃNarchitecture · 22 tiếng nói

Anthropic ra mắt Claude Opus 5.5 với chi phí vận hành thấp hơn 40%

Anthropic đã giới thiệu Claude Opus 5.5, mẫu mô hình đầu tiên trong dòng Claude 5.5, đạt hiệu suất tương đương Claude Fable 5.1 trong hầu hết các tác vụ nhưng có chi phí vận hành thấp hơn 40% so với Opus 5. Mô hình này cải thiện khả năng giao tiếp rõ ràng và tối ưu hóa lượng token sử dụng trên mọi mức độ nỗ lực.

tiếng nói · @emollick · @haider1 · @CuiMao
TẠO TỰ ĐỘNG
Lời đọc

Consonance, số 1.

Chủ Nhật, 27 tháng 9: điều nhiều nguồn độc lập cùng nói.

Thị trường AI chào đón hàng loạt mô hình và agent mới với chi phí vận hành tối ưu hơn.

Anthropic ra mắt Claude Opus 5.5 với chi phí vận hành thấp hơn 40 phần trăm.

OpenAI giới thiệu bộ đôi GPT-6 Sol và GPT-6 Luna có giá API thấp hơn 50 phần trăm.

Các nền tảng trợ lý và công cụ lập trình liên tục bổ sung tính năng tiên tiến.

Claude Code ra mắt chính thức các phiên đám mây chạy khi tắt máy.

GitHub Copilot cập nhật chế độ Autopilot chủ động và tích hợp mô hình mới.

Công nghệ âm thanh và trợ lý thông minh mở rộng khả năng tích hợp toàn cầu.

Google giới thiệu bộ đôi mô hình âm thanh với hàng nghìn giọng đọc.

Meta công bố các đối tác tích hợp chiến lược mới cho trợ lý Muse.

xAI vừa phát hành phiên bản Grok 4.7 với nhiều cải thiện đáng kể về điểm số trên bảng xếp hạng.

Phiên bản này đạt điểm số cao trên Artificial Analysis Intelligence Index và vượt qua GPT-5.6 Sol trên Coding Agent Index.

Bài viết mới nghiên cứu cách cải thiện đồng thời độ chính xác suy luận và hiệu năng tính toán.

Khung hậu kỳ này kết hợp các khả năng được học độc lập từ các mô hình chuyên gia vào một học viên duy nhất.

29 chủ đề hôm nay, ít nhất ba nguồn độc lập cho mỗi chủ đề.

Nguồn có trên consonance.fyi.

Đang được bàn

29 · chủ đề

Chủ đề có ít nhất ba tài khoản độc lập cùng nói trong bảy ngày qua.

01 — agents · ngày thứ 4 13 TIẾNG NÓI

Claude Code cập nhật tính năng phiên đám mây và giới hạn

Claude Code updates cloud sessions and usage limits

Claude Code ra mắt chính thức các phiên đám mây cho phép chạy khi tắt máy, đồng thời bổ sung cơ chế tìm điểm dừng mượt mà khi chạm giới hạn 5 tiếng. Nền tảng cũng khôi phục phí cho các yêu cầu bị chặn bởi bộ lọc bảo mật.

13 tài khoản độc lập 76 bài 3 lab 204.916 tương tác
claude code
@ArtificialAnlys các chủ đề trên X ↗
@ClaudeDevs các chủ đề trên X ↗
@GithubProjects các chủ đề trên X ↗
@Hesamation các chủ đề trên X ↗
@addyosmani các chủ đề trên X ↗
@aiedge_ các chủ đề trên X ↗
@alex_prompter các chủ đề trên X ↗
@alliekmiller các chủ đề trên X ↗
02 — system_design · ngày thứ 2 9 TIẾNG NÓI

Google thử nghiệm TPU ngoài không gian và công bố nghiên cứu AGI

Google tests TPUs in space and publishes new DeepMind essays

Dự án Suncatcher của Google đưa nguyên mẫu vệ tinh tích hợp TPU lên không gian thông qua sứ mệnh của SpaceX. Google DeepMind cũng công bố các tiểu luận về việc kiểm soát hành vi trong bầy đàn tác nhân và phân phối công bằng lợi ích AGI.

9 tài khoản độc lập 38 bài 6 lab 127.035 tương tác
googlegoogle deepmind
@Google các chủ đề trên X ↗
@JeffDean các chủ đề trên X ↗
@ShaneLegg các chủ đề trên X ↗
@c_valenzuelab các chủ đề trên X ↗
@dair_ai các chủ đề trên X ↗
@dotey các chủ đề trên X ↗
@elonmusk các chủ đề trên X ↗
@firstadopter các chủ đề trên X ↗
03 — evaluation MỚI 5 TIẾNG NÓI

Hugging Face xem xét quyền truy cập internet của tác nhân AI

Hugging Face reviews internet access for AI agents during evaluation

Hugging Face tiến hành đánh giá toàn diện về việc các tác nhân AI sử dụng internet trong quá trình huấn luyện và kiểm định. Cùng lúc đó, các mô hình diarization mới được giới thiệu để xử lý việc nhận diện nhiều người nói.

5 tài khoản độc lập 37 bài 3 bài viết 5 lab 118.206 tương tác
hugging face
@AndrewCurran_ các chủ đề trên X ↗
@ClementDelangue các chủ đề trên X ↗
@Gradio các chủ đề trên X ↗
@Hesamation các chủ đề trên X ↗
@NVIDIAAI các chủ đề trên X ↗
@OpenAI các chủ đề trên X ↗
@_akhaliq các chủ đề trên X ↗
@kimmonismus các chủ đề trên X ↗
04 — multimodal · ngày thứ 2 15 TIẾNG NÓI

ChatGPT Voice tích hợp plugin và mở rộng cấu trúc giá

ChatGPT Voice integrates plugins and expands pricing tiers

ChatGPT Voice bổ sung khả năng sử dụng các plugin như email, lịch và Slack, đồng thời hỗ trợ trên web và di động. Nền tảng cũng chuẩn bị các gói đăng ký cao cấp mới với mức giá lên tới 500 USD.

15 tài khoản độc lập 76 bài 4 lab 114.972 tương tác
chatgpt
@AndrewBolis các chủ đề trên X ↗
@CompleteSkeptic các chủ đề trên X ↗
@Hesamation các chủ đề trên X ↗
@MatthewBerman các chủ đề trên X ↗
@OpenAI các chủ đề trên X ↗
@SchmidhuberAI các chủ đề trên X ↗
@ajambrosino các chủ đề trên X ↗
@alex_prompter các chủ đề trên X ↗
05 — multimodal · ngày thứ 2 13 TIẾNG NÓI

Google ra mắt bộ đôi mô hình âm thanh Gemini 3.8 Flash TTS

Google introduces Gemini 3.8 Flash TTS and Flash-Lite TTS

Google giới thiệu Gemini 3.8 Flash TTS và Gemini 3.8 Flash-Lite TTS với hơn 2.000 giọng đọc sẵn sàng sản xuất, hỗ trợ 100 ngôn ngữ, thiết kế giọng nói mới và khả năng sao chép giọng nói.

13 tài khoản độc lập 72 bài 1 bài viết 4 lab 153.931 tương tác
gemini 3.8geminigemini 3.1 flash
@AndrewCurran_ các chủ đề trên X ↗
@ArtificialAnlys các chủ đề trên X ↗
@EMostaque các chủ đề trên X ↗
@GeminiApp các chủ đề trên X ↗
@GithubProjects các chủ đề trên X ↗
@Google các chủ đề trên X ↗
@GoogleAIStudio các chủ đề trên X ↗
@GoogleDeepMind các chủ đề trên X ↗
06 — agents · ngày thứ 2 3 TIẾNG NÓI

Microsoft công bố bản cập nhật GitHub Copilot lớn với Autopilot và GPT-6

Microsoft announces major GitHub Copilot update with Autopilot and GPT-6 models

Microsoft đã công bố bản cập nhật lớn cho GitHub Copilot, giới thiệu tính năng Autopilot chủ động cùng hai mô hình mới là GPT-6 Sol và GPT-6 Luna. Bản cập nhật này cũng đi kèm một ứng dụng Copilot mới với các chế độ Home, Code và Copilot nhằm kết nối các công cụ làm việc.

3 tài khoản độc lập 15 bài 2 lab 59.038 tương tác
github copilot
@AndrewBolis các chủ đề trên X ↗
@emollick các chủ đề trên X ↗
@mustafasuleyman các chủ đề trên X ↗
@rohanpaul_ai các chủ đề trên X ↗
@testingcatalog các chủ đề trên X ↗
@alexeheath các chủ đề trên X ↗
@github các chủ đề trên X ↗
@jacobandreou các chủ đề trên X ↗
07 — agents MỚI 11 TIẾNG NÓI

DigitalOcean ra mắt DigitalOcean Managed Agents dưới dạng public preview

DigitalOcean launches Managed Agents in public preview

DigitalOcean đã phát hành DigitalOcean Managed Agents ở trạng thái public preview, cho phép người dùng chạy Claude Code, Codex hoặc các tác nhân LangGraph trong môi trường thời gian chạy tự động tạm dừng khi nhàn rỗi. Dịch vụ này tích hợp các công cụ đằng sau một điểm cuối được quản lý và cung cấp quyền truy cập từ hơn 75 nguồn mở.

11 tài khoản độc lập 61 bài 1 bài viết 2 lab 224.616 tương tác
codex
@GithubProjects các chủ đề trên X ↗
@OpenAIDevs các chủ đề trên X ↗
@aiedge_ các chủ đề trên X ↗
@alex_prompter các chủ đề trên X ↗
@alliekmiller các chủ đề trên X ↗
@dani_avila7 các chủ đề trên X ↗
@derrickcchoi các chủ đề trên X ↗
@dotey các chủ đề trên X ↗
08 — evaluation · ngày thứ 2 7 TIẾNG NÓI

Grok 4.7 xHigh đạt 58% trên benchmark AA-Briefcase của Artificial Analysis

Grok 4.7 xHigh scores 58% on Artificial Analysis AA-Briefcase benchmark

Grok 4.7 xHigh đạt 58% trên benchmark AA-Briefcase của Artificial Analysis, đứng sát phía sau Claude Fable 5.1 Max với 59%. Ngoài ra, mô hình ẩn danh Pixel Canary đã ra mắt trên Cline, đạt thành tích ngang bằng GPT-6 Astra và vượt qua Kimi K3 trên benchmark Next.js Agent Evals dành cho phát triển web và di động.

7 tài khoản độc lập 36 bài 3 lab 207.318 tương tác
kimi k3glmllamallama.cpp
@Hesamation các chủ đề trên X ↗
@aiedge_ các chủ đề trên X ↗
@alex_prompter các chủ đề trên X ↗
@cline các chủ đề trên X ↗
@dotey các chủ đề trên X ↗
@elonmusk các chủ đề trên X ↗
@kimmonismus các chủ đề trên X ↗
@rohanpaul_ai các chủ đề trên X ↗
09 — architecture · ngày thứ 5 19 TIẾNG NÓI

OpenAI ra mắt bộ đôi mô hình GPT-6 Sol và GPT-6 Luna

OpenAI introduces GPT-6 Sol and GPT-6 Luna models

OpenAI đã ra mắt GPT-6 Sol và GPT-6 Luna, mang các điểm mạnh của GPT-6 Astra vào các mô hình nhanh hơn và tiết kiệm chi phí hơn để hỗ trợ công việc ở quy mô lớn. Giá API của cả hai mô hình này thấp hơn 50% so với GPT-5.6. Cùng lúc đó, công ty cũng giới thiệu Tesseract, bộ công cụ sáng tạo video dành cho các tác nhân AI.

19 tài khoản độc lập 85 bài 1 bài viết 8 lab 311.465 tương tác
gpt-6deepsweartificial analysisterminal-bench
@AndrewCurran_ các chủ đề trên X ↗
@AravSrinivas các chủ đề trên X ↗
@ArtificialAnlys các chủ đề trên X ↗
@Hesamation các chủ đề trên X ↗
@OpenAI các chủ đề trên X ↗
@OpenAIDevs các chủ đề trên X ↗
@OpenRouter các chủ đề trên X ↗
@PromptLLM các chủ đề trên X ↗
10 — agents MỚI 10 TIẾNG NÓI

Meta công bố các tính năng và đối tác tích hợp mới cho Muse tại sự kiện Connect

Meta announces new features and integration partners for Muse at Connect

Tại sự kiện Connect, Meta đã công bố các hợp tác tích hợp chiến lược cho trợ lý cá nhân AI Muse với Shopify, Expedia và PayPal. Các liên minh này cho phép người dùng tìm kiếm sản phẩm, sắp xếp khách sạn và thực hiện thanh toán liền mạch thông qua trợ lý Muse trên toàn cầu.

10 tài khoản độc lập 81 bài 1 bài viết 2 lab 136.383 tương tác
muse spark
@AIatMeta các chủ đề trên X ↗
@AlexFinn các chủ đề trên X ↗
@aiedge_ các chủ đề trên X ↗
@alliekmiller các chủ đề trên X ↗
@dani_avila7 các chủ đề trên X ↗
@dotey các chủ đề trên X ↗
@emollick các chủ đề trên X ↗
@finkd các chủ đề trên X ↗
11 — agents MỚI 6 TIẾNG NÓI

Anthropic ra mắt cổng quản lý plugin và cập nhật quy trình tích hợp MCP

Anthropic launches plugin submission portal and expands MCP integration

Anthropic đã ra mắt cổng thông tin mới giúp nhà phát triển gửi plugin, theo dõi kiểm duyệt và xem dữ liệu sử dụng cho Claude. Các plugin này đóng gói giao thức Model Context Protocol (MCP) và các kỹ năng chuyên biệt nhằm chuẩn hóa cách thức xây dựng ứng dụng trên nền tảng của Anthropic.

6 tài khoản độc lập 32 bài 1 bài viết 2 lab 42.829 tương tác
model context protocolmicrosoft research
@ClaudeDevs các chủ đề trên X ↗
@alex_prompter các chủ đề trên X ↗
@bcherny các chủ đề trên X ↗
@c_valenzuelab các chủ đề trên X ↗
@dair_ai các chủ đề trên X ↗
@dani_avila7 các chủ đề trên X ↗
@dotey các chủ đề trên X ↗
@levelsio các chủ đề trên X ↗
12 — architecture · ngày thứ 5 22 TIẾNG NÓI

Anthropic ra mắt Claude Opus 5.5 với chi phí vận hành thấp hơn 40%

Anthropic launches Claude Opus 5.5 with 40% lower operational costs

Anthropic đã giới thiệu Claude Opus 5.5, mẫu mô hình đầu tiên trong dòng Claude 5.5, đạt hiệu suất tương đương Claude Fable 5.1 trong hầu hết các tác vụ nhưng có chi phí vận hành thấp hơn 40% so với Opus 5. Mô hình này cải thiện khả năng giao tiếp rõ ràng và tối ưu hóa lượng token sử dụng trên mọi mức độ nỗ lực.

22 tài khoản độc lập 76 bài 7 lab 666.134 tương tác
claude fable
@AlexFinn các chủ đề trên X ↗
@AndrewCurran_ các chủ đề trên X ↗
@AnthropicAI các chủ đề trên X ↗
@AravSrinivas các chủ đề trên X ↗
@ArtificialAnlys các chủ đề trên X ↗
@CuiMao các chủ đề trên X ↗
@Hesamation các chủ đề trên X ↗
@OpenRouter các chủ đề trên X ↗
13 — architecture MỚI 3 TIẾNG NÓI

Claude Sonnet 5.5 lộ diện trong giai đoạn thử nghiệm với cửa sổ ngữ cảnh 1 triệu token

Claude Sonnet 5.5 spotted in stealth testing with a 1M-token context window

Claude Sonnet 5.5 đang được thử nghiệm ẩn danh với cửa sổ ngữ cảnh 1 triệu token và độ dài đầu ra tối đa 128K token. Mức giá được ghi nhận cho mỗi triệu token là 2 USD cho đầu vào và 10 USD cho đầu vào/đầu ra, được giới chuyên môn nhìn nhận là phản ứng trực tiếp đối với các dòng mô hình cạnh tranh.

3 tài khoản độc lập 27 bài 3 lab 40.867 tương tác
claude sonnetclaude haiku
@ClaudeDevs các chủ đề trên X ↗
@CuiMao các chủ đề trên X ↗
@GithubProjects các chủ đề trên X ↗
@alexalbert__ các chủ đề trên X ↗
@dani_avila7 các chủ đề trên X ↗
@dotey các chủ đề trên X ↗
@haider1 các chủ đề trên X ↗
@kimmonismus các chủ đề trên X ↗
14 — inference MỚI 3 TIẾNG NÓI

Anthropic tăng tốc hiệu suất Claude.ai gấp 3 lần sau hai tuần

Anthropic speeds up Claude.ai performance by 3x in two weeks

Anthropic đã tăng tốc hiệu suất của trang claude.ai và ứng dụng desktop lên gấp 3 lần chỉ trong vòng hai tuần. Đội ngũ phát triển đã chia sẻ các phương pháp và câu lệnh cụ thể được sử dụng cùng Claude để đo lường, gỡ lỗi và cải thiện tốc độ.

3 tài khoản độc lập 5 bài 2 bài viết 1 lab 50.040 tương tác
@ClaudeDevs các chủ đề trên X ↗
@amorriscode các chủ đề trên X ↗
@bcherny các chủ đề trên X ↗
@trq212 các chủ đề trên X ↗
@edwinarbus các chủ đề trên X ↗
15 — architecture · ngày thứ 2 9 TIẾNG NÓI

Grok 4.7 ra mắt với sự hỗ trợ từ hệ thống tính toán NVIDIA

Grok 4.7 launches with support from NVIDIA accelerated computing

SpaceXAI vừa phát hành mô hình Grok 4.7, được định vị là phiên bản có năng lực vượt trội nhất từ trước đến nay dành cho công việc viết mã và tri thức. Quá trình phát triển mô hình này có sự hỗ trợ phần cứng từ hệ thống tính toán tăng tốc của NVIDIA.

9 tài khoản độc lập 48 bài 3 lab 203.499 tương tác
nvidiaflash attentionquantization
@ArtificialAnlys các chủ đề trên X ↗
@CuiMao các chủ đề trên X ↗
@Hesamation các chủ đề trên X ↗
@NVIDIAAI các chủ đề trên X ↗
@SchmidhuberAI các chủ đề trên X ↗
@alex_prompter các chủ đề trên X ↗
@elonmusk các chủ đề trên X ↗
@firstadopter các chủ đề trên X ↗
16 — multimodal · ngày thứ 3 3 TIẾNG NÓI

Sakana AI bổ nhiệm Jürgen Schmidhuber làm Cố vấn Khoa học Trưởng

Sakana AI appoints Jürgen Schmidhuber as Chief Scientific Advisor

Jürgen Schmidhuber, nhà tiên phong trong lĩnh vực học siêu cấp, tự cải thiện đệ quy và mô hình thế giới từ những năm 1990, đã chính thức gia nhập Sakana AI với tư cách là Cố vấn Khoa học Trưởng. Cùng lúc đó, công ty cũng giới thiệu Agora-2, mô hình thế giới đa tác nhân thế hệ mới hỗ trợ tương tác thời gian thực cho tối đa 20 người và tác nhân.

3 tài khoản độc lập 20 bài 2 bài viết 2 lab 42.482 tương tác
world modeldavid ha
@SchmidhuberAI các chủ đề trên X ↗
@_akhaliq các chủ đề trên X ↗
@alex_prompter các chủ đề trên X ↗
@haider1 các chủ đề trên X ↗
@hardmaru các chủ đề trên X ↗
@rohanpaul_ai các chủ đề trên X ↗
@AmOptimistShow các chủ đề trên X ↗
@Markus50726803 các chủ đề trên X ↗
17 — system_design MỚI 3 TIẾNG NÓI

Google thử nghiệm đưa bộ xử lý TPU lên không gian vũ trụ

Google launches a satellite to test TPU performance in orbit

Google hợp tác cùng công ty Planet phóng một vệ tinh nguyên mẫu mang theo bốn bộ xử lý Tensor (TPU) vào không gian quỹ đạo. Dự án này nhằm mục đích đánh giá khả năng chịu đựng của phần cứng trước điều kiện khắc nghiệt ngoài vũ trụ và kiểm tra tiềm năng triển khai máy học trên quỹ đạo.

3 tài khoản độc lập 11 bài 1 lab 25.820 tương tác
moonshot ai
@Google các chủ đề trên X ↗
@Hesamation các chủ đề trên X ↗
@teortaxesTex các chủ đề trên X ↗
@PeterDiamandis các chủ đề trên X ↗
@TheStalwart các chủ đề trên X ↗
18 — architecture MỚI 7 TIẾNG NÓI

Apple phát hành mô hình dựa trên Qwen3.5-9B tinh chỉnh xử lý văn bản

Apple releases a Qwen3.5-9B finetune converting documents into images

Apple vừa phát hành trên nền tảng Hugging Face một mô hình tinh chỉnh dựa trên Qwen3.5-9B có khả năng chuyển đổi các tài liệu dài thành các hình ảnh trang nhỏ nhằm tiết kiệm lượng mã thông báo, sau đó trích xuất toàn bộ văn bản của những trang liên quan trực tiếp đến truy vấn.

7 tài khoản độc lập 33 bài 2 bài viết 1 lab 20.123 tương tác
qwen3.8qwen3context windowkv cachegemmamixture of experts
@AlexFinn các chủ đề trên X ↗
@ArtificialAnlys các chủ đề trên X ↗
@OpenRouter các chủ đề trên X ↗
@PrismML các chủ đề trên X ↗
@dair_ai các chủ đề trên X ↗
@heyshrutimishra các chủ đề trên X ↗
@hwchase17 các chủ đề trên X ↗
@rohanpaul_ai các chủ đề trên X ↗
19 — agents · ngày thứ 2 3 TIẾNG NÓI

Hệ thống agent kết hợp System One models và Contrastive Language Model

Agent harnesses integrate System One models and Contrastive Language Model

Cộng đồng xây dựng agent đang thử nghiệm các mô hình System One như Jev và Contrastive Language Model trong bộ khung tùy chỉnh. Những mô hình này đóng vai trò bộ định tuyến hoặc bộ xác thực tốc độ cao để cải thiện hiệu suất cho các tác vụ agent.

3 tài khoản độc lập 13 bài 1 bài viết 1 lab 6.895 tương tác
dspy
@CompleteSkeptic các chủ đề trên X ↗
@lateinteraction các chủ đề trên X ↗
@typesafeai các chủ đề trên X ↗
@DSPyOSS các chủ đề trên X ↗
@MaximeRivest các chủ đề trên X ↗
@dbreunig các chủ đề trên X ↗
@isaacbmiller1 các chủ đề trên X ↗
@omarsar0 các chủ đề trên X ↗
20 — inference MỚI 4 TIẾNG NÓI

Xiaomi MiMo-V2.6 và System One model Jev có mặt trên OpenRouter

Xiaomi MiMo-V2.6 and System One model Jev launch on OpenRouter

Nền tảng OpenRouter bổ sung hàng loạt mô hình mới bao gồm dòng Xiaomi MiMo-V2.6 đa phương thức với cửa sổ ngữ cảnh 1M token và mô hình System One Jev. Các nhà phát triển đang thử nghiệm các mô hình này cho các ứng dụng yêu cầu phản hồi nhanh.

4 tài khoản độc lập 37 bài 1 bài viết 13.047 tương tác
openrouter
@CompleteSkeptic các chủ đề trên X ↗
@LangChain các chủ đề trên X ↗
@OpenRouter các chủ đề trên X ↗
@giffmana các chủ đề trên X ↗
@heyshrutimishra các chủ đề trên X ↗
@KonstantinPilz các chủ đề trên X ↗
@alexatallah các chủ đề trên X ↗
@chromatique các chủ đề trên X ↗
21 — evaluation · ngày thứ 2 4 TIẾNG NÓI

Xiaomi MiMo-V2.6-Pro dẫn đầu bảng xếp hạng mô hình mã nguồn mở

Xiaomi MiMo-V2.6-Pro tops open weights model benchmarks

MiMo-V2.6-Pro đạt vị trí số một trên bảng xếp hạng Artificial Analysis Intelligence Index dành cho mô hình trọng số mở. Mô hình sử dụng kiến trúc Grouped Query Attention kinh điển và đạt hiệu quả chi phí cạnh tranh trên mỗi tác vụ.

4 tài khoản độc lập 4 bài 1 lab 14.067 tương tác
@ArtificialAnlys các chủ đề trên X ↗
@ClementDelangue các chủ đề trên X ↗
@rasbt các chủ đề trên X ↗
@teortaxesTex các chủ đề trên X ↗
22 — training MỚI 4 TIẾNG NÓI

Nghiên cứu mới về phương pháp distillation và học tăng cường cho agent

New research explores distillation and reinforcement learning for agents

Các nhà nghiên cứu công bố phương pháp hậu huấn luyện giúp agent học hỏi từ phiên làm việc thực tế của người dùng thông qua việc bắt chước quỹ đạo tốt và sửa lỗi. Một nghiên cứu khác từ Google đánh giá tác động của việc chưng cất bộ khung agent đối với tỷ lệ hoàn thành tác vụ.

4 tài khoản độc lập 15 bài 1 bài viết 1 lab 5.866 tương tác
distillation
@AravSrinivas các chủ đề trên X ↗
@natolambert các chủ đề trên X ↗
@rasbt các chủ đề trên X ↗
@teortaxesTex các chủ đề trên X ↗
@MatthewParrott các chủ đề trên X ↗
@baselabs các chủ đề trên X ↗
@omarsar0 các chủ đề trên X ↗
@perplexity_ai các chủ đề trên X ↗
23 — inference · ngày thứ 2 4 TIẾNG NÓI

vLLM hỗ trợ ngày đầu cho Xiaomi MiMo-V2.6 và DiffusionGemma-Jev

vLLM adds day-one support for Xiaomi MiMo-V2.6 and DiffusionGemma-Jev

Hệ thống vLLM triển khai hỗ trợ ngay lập tức cho các mô hình MiMo-V2.6 dung lượng lớn và DiffusionGemma-Jev. Các phiên bản Pro và Flash đều mang lại khả năng xử lý ngữ cảnh dài và đa phương thức trên nền tảng phục vụ.

4 tài khoản độc lập 21 bài 2 lab 7.171 tương tác
vllmsglang
@AravSrinivas các chủ đề trên X ↗
@GithubProjects các chủ đề trên X ↗
@teortaxesTex các chủ đề trên X ↗
@vllm_project các chủ đề trên X ↗
@PyTorch các chủ đề trên X ↗
@SemiAnalysis_ các chủ đề trên X ↗
@XiaomiMiMo các chủ đề trên X ↗
@googlegemma các chủ đề trên X ↗
24 — evaluation MỚI 3 TIẾNG NÓI

Tencent ARC Lab ra mắt GameHorizon Suite đánh giá game agent

Tencent ARC Lab releases GameHorizon Suite for evaluating game agents

Tencent ARC Lab giới thiệu bộ công cụ dữ liệu và đánh giá GameHorizon Suite nhằm đo lường năng lực chơi game AAA qua nhiều mốc thời gian đối với các mô hình đa phương thức, mô hình GUI và agent lập trình.

3 tài khoản độc lập 11 bài 1 bài viết 1 lab 3.652 tương tác
tencentling-3.0openbmbzhipu ai
@ClementDelangue các chủ đề trên X ↗
@levelsio các chủ đề trên X ↗
@rohanpaul_ai các chủ đề trên X ↗
@teortaxesTex các chủ đề trên X ↗
@G2AIStack các chủ đề trên X ↗
@HuggingPapers các chủ đề trên X ↗
@OnSoloAI các chủ đề trên X ↗
@Thom_Wolf các chủ đề trên X ↗
25 — agents MỚI 4 TIẾNG NÓI

Quán quân hackathon của Anthropic mã nguồn mở hóa toàn bộ thiết lập Claude Code

Anthropic hackathon winner open-sources complete Claude Code setup

Quán quân cuộc thi hackathon của Anthropic đã công bố mã nguồn toàn bộ thiết lập Claude Code, bao gồm các kỹ năng đại diện, tiện ích bổ sung và kinh nghiệm thực tế. Cùng lúc đó, các nghiên cứu mới giới thiệu phương pháp tiến hóa kỹ năng đại diện giúp giảm 40 đến 70 phần trăm chi phí mã thông báo so với các phương pháp biên, cũng như công trình chuyển đổi kỹ năng thành môi trường học tăng cường từ NVIDIA.

4 tài khoản độc lập 7 bài 2.152 tương tác
agent skills
@NVIDIAAI các chủ đề trên X ↗
@aiedge_ các chủ đề trên X ↗
@dair_ai các chủ đề trên X ↗
@dani_avila7 các chủ đề trên X ↗
@tom_doerr các chủ đề trên X ↗
26 — system_design MỚI 3 TIẾNG NÓI

Alibaba công bố kế hoạch phát triển hạ tầng và mô hình Qwen thế hệ mới

Alibaba announces infrastructure plans and next-generation Qwen models

Alibaba đặt mục tiêu đạt 20 gigawatt công suất trung tâm dữ liệu toàn cầu vào năm 2032 để phục vụ tham vọng trí tuệ nhân tạo tổng hợp, cùng kế hoạch phát triển mô hình Qwen từ 5 đến 10 nghìn tỷ tham số và các dòng chip AI thế hệ mới. Ngoài ra, nhóm Qwen vừa phát hành sandbox RecreationWorld trên Hugging Face để các đại diện sử dụng máy tính kiểm tra và xây dựng ứng dụng.

3 tài khoản độc lập 15 bài 1.427 tương tác
alibabaalibaba qwen
@ArtificialAnlys các chủ đề trên X ↗
@Hesamation các chủ đề trên X ↗
@alex_prompter các chủ đề trên X ↗
@teortaxesTex các chủ đề trên X ↗
@AlibabaGroup các chủ đề trên X ↗
@HuggingPapers các chủ đề trên X ↗
@poezhao0605 các chủ đề trên X ↗
@tphuang các chủ đề trên X ↗

Đáng đọc kỹ

24 bài đọc

Paper và writeup, đọc từ abstract, xếp theo mức liên quan với người xây agent và backend.

01 — agents 20 upvote

Agent-Editing World Model: Rethinking World Modeling for LLM Agents

CÂU HỎI — Làm thế nào để cải thiện LLM agents bằng cách mô hình hóa tiến trình nhiệm vụ và chỉnh sửa trạng thái reasoning thay vì chỉ dự đoán phản hồi từ tool?

AEWM đạt 70.5% macro-F1 trên Action Judge benchmark, vượt baseline mạnh nhất 10.6 điểm.

SNHE · 23 thg 9, 2026 đọc bản gốc ↗
02 — agents 11 upvote

PUBG Ally: A Conversational Embodied Agent as an AI Teammate

CÂU HỎI — Làm thế nào để xây dựng một tác nhân hội thoại đồng hành trong trò chơi thời gian thực, đáp ứng các ràng buộc về độ trễ và phối hợp nhịp nhàng với người chơi?

Thu thập dữ liệu qua gần 39k phiên chơi thực tế kết hợp người chơi và tác nhân để huấn luyện lặp đi lặp lại.

taesiri · 24 thg 9, 2026 đọc bản gốc ↗
05 — agents 11 upvote

Coding Agents for Generalized Task and Motion Planning Problems

CÂU HỎI — Liệu các coding agent có thể tự động hóa việc tổng hợp chương trình để giải quyết các bài toán lập kế hoạch tác vụ và chuyển động (TAMP) tổng quát không?

Nghiên cứu đánh giá 980 chương trình được sinh ra trên 100 trường hợp giữ lại cho mỗi chương trình, tổng cộng có 98.000 tập đánh giá.

merlerm · 24 thg 9, 2026 đọc bản gốc ↗
07 — training 5 upvote

EDGEGEN: Improving Tool-Calling Agents Beyond Happy Paths with Synthetic Edge Case Generation

CÂU HỎI — Làm thế nào để tự động sinh ra các trường hợp biên (edge case) phục vụ đánh giá và tối ưu hóa agent gọi công cụ mà không cần chú thích thủ công từ con người?

Fine-tuning trên dữ liệu EdgeGen mang lại mức cải thiện tiến độ trung bình từ 2 phần trăm đến 42 phần trăm trên miền hàng không tau2bench.

ashutosh1919 · 21 thg 9, 2026 đọc bản gốc ↗
10 — agents 3 upvote

EmbodiedSWE: Coding Agents for Long Horizon Dexterous Robotics

CÂU HỎI — Liệu các tác nhân viết mã (coding agents) có thể cung cấp giám sát có khả năng mở rộng để huấn luyện chính sách robot khéo léo dài hạn không?

Frontier coding agents có thể giải quyết các tác vụ tương tác phong phú, biến dạng và kéo dài tới nửa giờ tương tác liên tục.

zeyush · 23 thg 9, 2026 đọc bản gốc ↗
11 — training 2 upvote

Lightning Weave: Improving the Accuracy-Efficiency Frontier of Reasoning Models through Capability Composition

CÂU HỎI — Làm thế nào để cải thiện đồng thời độ chính xác suy luận và hiệu năng tính toán của LLM thông qua việc kết hợp các khả năng đã học độc lập?

On Qwen3.5-4B, it raises HMMT 2025 accuracy from 59.2% to 64.0% with 10.7% fewer response tokens, and LiveCodeBench v5 accuracy from 41.7% to 54.2% with 9.6% fewer response tokens.

gbcfchc · 13 thg 9, 2026 đọc bản gốc ↗
12 — agents 6 upvote

Self-Organizing Agent Teams Learn to Reason Together

CÂU HỎI — Làm thế nào để các đội ngũ tác nhân AI có thể tự tổ chức học hỏi chiến lược hợp tác và giải quyết các bài toán phức tạp vượt quá năng lực của từng thành viên?

Các đội tự tổ chức đạt độ chính xác trung bình 66.7% trên năm benchmark toán học và vật lý, so với 48.8% của thành viên mạnh nhất.

apappu97 · 19 thg 9, 2026 đọc bản gốc ↗
14 — evaluation 15 upvote

Capable yet Parsimonious: Extracting and Characterizing Hidden Chain-of-Thought in Frontier Models

CÂU HỎI — Làm thế nào để trích xuất và phân tích chuỗi suy luận ẩn (hidden CoT) từ các mô hình ngôn ngữ lớn đóng kín thông qua API tiêu chuẩn?

Nghiên cứu này khai thác một custom tool đơn giản đăng ký qua API tiêu chuẩn để ép các mô hình biên (frontier models) ngoại hóa quá trình suy luận trung gian vốn bị ẩn trong các hệ thống đóng. Bằng cách so sánh với native CoT trên các mô hình mở và mở rộng sang các hệ thống như GPT-6 Astra, các tác giả chứng minh rằng chuỗi suy luận được trích xuất đạt hiệu suất tương đương native CoT và vượt trội hơn hẳn các baseline không có suy luận trong các bài toán toán học cạnh tranh, khoa học và sinh mã. Phân tích cấu trúc cho thấy các mô hình như Astra thể hiện khả năng hướng dẫn suy luận hiệu quả về token, xử lý các bước sơ cấp bên trong và chỉ ngoại hóa các phần cốt lõi.

Xiaoyuluoit97 · 22 thg 9, 2026 đọc bản gốc ↗
16 — training 5 upvote

AV-GRPO: Modality-Anchored Decoupling Diffusion Reinforcement Learning for Joint Audio-Video Generation

CÂU HỎI — Làm thế nào để giải quyết vấn đề tín hiệu học tập bị lẫn lộn trong tối ưu hóa reinforcement learning cho việc sinh đồng thời âm thanh và video?

AV-GRPO vượt trội hơn LTX-2.3 về chất lượng sinh, căn chỉnh ngữ nghĩa và đồng bộ hóa chéo phương thức dưới dạng LoRA và fine-tuning toàn phần.

Dr-Loser · 24 thg 9, 2026 đọc bản gốc ↗
17 — evaluation 4 upvote

Prediction-Powered Smoothing and Validation for Disaggregated AI Evaluation

CÂU HỎI — Làm thế nào để cải thiện độ chính xác và giảm chi phí khi đánh giá hiệu suất hệ thống AI theo từng phân khúc (disaggregated evaluation)?

Đề xuất phương pháp Prediction-Powered Smoothing (PP-S) và PP-TS nhằm cải thiện độ chính xác ước lượng điểm và khoảng cho từng miền nhiệm vụ.

kokomarina · 17 thg 9, 2026 đọc bản gốc ↗
19 — multimodal 4 upvote

DeltaWAM: Delta World Action Models for Bimanual Manipulation

CÂU HỎI — Làm thế nào để cải thiện hiệu suất và độ trễ của world-action models trong điều khiển robot bimanual?

DeltaWAM với SDM cải thiện độ chính xác trung bình trên RoboTwin từ 81,3% lên 85,4% trong môi trường sạch và từ 75,8% lên 83,9% dưới điều kiện ngẫu nhiên hóa hình ảnh.

SteveZeyuZhang · 23 thg 9, 2026 đọc bản gốc ↗
20 — inference 3 upvote

ViRDM: Taming Representation Distribution Matching for Few-Step Causal Video Generation

CÂU HỎI — Có thể loại bỏ hoàn toàn teacher-critic stack tốn kém trong việc huấn luyện hậu kỳ video tạo sinh bằng cách nào?

With only 20 generator updates, the recipe reaches 84.87 on the official VBench evaluation, outperforming the previous best few-step causal baseline by 0.36, while requiring 16 A100 GPU-hours.

cr8br0ze · 24 thg 9, 2026 đọc bản gốc ↗
21 — agents 2 upvote

Knowledge Pull Requests for Continual Document Authoring

CÂU HỎI — Làm thế nào để tích hợp kiến thức mới vào việc soạn thảo tài liệu liên tục một cách có thể giải thích được?

KPRs tích hợp nhiều thông tin hơn và bảo tồn nội dung hiện có tốt hơn so với việc viết lại từ nguồn hoặc tạo lại từ đầu.

alexmartin1722 · 22 thg 9, 2026 đọc bản gốc ↗
22 — multimodal 2 upvote

X-Planner: Event-Structured Task Planning for Embodied Intelligence

CÂU HỎI — Làm thế nào để cải thiện cấu trúc trung gian và sự giám sát trong việc lập kế hoạch tác vụ dài hạn cho các hệ thống Vision-Language-Action?

X-Planner xếp thứ hai trong bốn mô hình được đánh giá trên cả BERTScore-F1 lẫn điểm Overall dựa trên giám khảo trong đánh giá lập kế hoạch ngoại tuyến hai bước.

wisdompan · 21 thg 9, 2026 đọc bản gốc ↗
24 — evaluation 9 upvote

Just Ask Jev: Reinforcement Learning for Calibrated Decisions as a Zero-Shot Detector of AI Alignment Failures

CÂU HỎI — Làm thế nào để phát hiện các lỗi căn chỉnh của mô hình ngôn ngữ lớn một cách hiệu quả và tiết kiệm chi phí mà không cần dùng đến các giám khảo sinh văn bản tốn kém?

Jev đạt giá trị AUROC trung vị là 0.886 ở chế độ zero-shot trên RLCDAlignBench.

sumleo · 24 thg 9, 2026 đọc bản gốc ↗

Thực chiến

2026-09-27

Repo đang lên trên GitHub hôm nay, chấm theo đà trong ngày, thứ hạng, quy mô, độ tươi và sức khoẻ dự án.

01 paperclipai/paperclip +2.527 Nền tảng mã nguồn mở giúp lập trình viên backend quản lý và điều phối các AI agents làm việc trong môi trường doanh nghiệp. TypeScript
★ 89.110
02 vectorize-io/hindsight +4.463 Thư viện quản lý bộ nhớ dài hạn cho AI agent, giúp trích xuất và học hỏi từ lịch sử tương tác qua thời gian thực. Python
★ 36.336
03 debpalash/VoiceStudio +3.060 Công cụ clone giọng nói và xử lý audio hoàn toàn local này phù hợp cho backend developer xây dựng tính năng voice cho agent. Python
★ 39.304
04 rohitg00/ai-engineering-from-scratch +848 Một khóa học thực hành xây dựng các ứng dụng AI và agent từ đầu, lý tưởng cho các backend developer muốn bước chân vào lĩnh vực AI. Python
★ 59.007
05 NVIDIA/Model-Optimizer +357 Thư viện tối ưu hóa mô hình của NVIDIA chuyên dùng cho lượng tử hóa và tăng tốc suy luận trên GPU. Python
★ 4.833
06 zhaoxuya520/reverse-skill +361 Gói kỹ năng định tuyến công cụ tự động cho Claude Code và Cursor, phù hợp với các lập trình viên phát triển agent lập trình. PowerShell
★ 38.152
07 openbao/openbao +364 Giải pháp mã nguồn mở quản lý và phân phối dữ liệu nhạy cảm, giúp backend developers bảo mật API key cho hệ thống LLM. Go
★ 8.061
08 dream-num/univer +920 Bộ runtime tích hợp spreadsheet, docs và canvas, dành cho các kỹ sư muốn trao quyền thao tác Office trực tiếp cho AI agent. TypeScript
★ 20.015
09 tensorflow/tensorflow +46 Thư viện học máy kinh điển hỗ trợ huấn luyện mô hình sâu cho các kỹ sư AI và nghiên cứu viên. C++
★ 200.507
10 microsoft/vscode +95 Trình soạn thảo mã nguồn phổ biến dành cho mọi lập trình viên xây dựng ứng dụng và công cụ phát triển. TypeScript
★ 193.118
11 mobile-next/mobile-mcp +168 Máy chủ Model Context Protocol giúp agent tự động hóa và cạo dữ liệu trên thiết bị di động thật và giả lập. TypeScript
★ 7.515
12 vercel-labs/scriptc +76 Compiler TypeScript sang native giúp tối ưu hiệu năng cho dev xây dựng backend system tốc độ cao. TypeScript
★ 5.301
13 mvschwarz/openrig +114 Multi-agent harness kết hợp Claude Code và Codex, lý tưởng cho lập trình viên xây dựng hệ thống agent lập trình tự động. TypeScript
★ 780
14 llvm/llvm-project +41 Bộ công cụ biên dịch mô đun dành cho các kỹ sư hệ thống phát triển trình dịch và tối ưu hóa mã máy. LLVM
★ 40.779
15 vercel/next.js +54 Framework React toàn diện dành cho các lập trình viên web xây dựng ứng dụng frontend và SSR. JavaScript
★ 142.708
16 anthropics/claude-code-action +31 Action GitHub tích hợp Claude Code vào quy trình CI/CD dành cho các kỹ sư tự động hóa việc rà soát mã nguồn. TypeScript
★ 9.153
↑