CONSONANCE.for your information
Thứ Hai, 5 tháng 10, 2026frenvi
PHIẾU SỐ 2026-09-29RADAR AI & AGENT

Ba người nói, mới là một tin.

Radar AI và agent. Mỗi sáng một lần, và chỉ những gì nhiều nguồn độc lập cùng nói.

Video trong ngày

cuộn số 3 · 1:07
NHÃNarchitecture · 22 tiếng nói

Giới thiệu mô hình Claude Opus 5.5 với chi phí vận hành thấp hơn 40%

Mô hình Claude Opus 5.5 chính thức ra mắt, đạt hiệu năng tương đương Claude Fable 5.1 trong phần lớn các tác vụ nhưng có chi phí vận hành thấp hơn 40% so với phiên bản Opus tiền nhiệm. Bản cập nhật này cũng mang lại cải tiến về tốc độ và hiệu quả sử dụng token.

tiếng nói · @scaling01 · @simonw · @andonlabs
TẠO TỰ ĐỘNG
Lời đọc

Consonance, số 3.

Thứ Ba, 29 tháng 9: điều nhiều nguồn độc lập cùng nói.

Nhiều mô hình lớn ra đời với hiệu suất tăng và giá giảm.

Claude Opus 5.5 giảm 40% chi phí vận hành mà vẫn duy trì hiệu suất.

GPT-6 Sol và GPT-6 Luna có giá API giảm 50%.

Claude Sonnet 5.5 chạy nhanh hơn hơn 30% với chi phí giảm.

Các công cụ và nền tảng tác nhân thông minh tích hợp tính năng năng suất mới.

Claude Code giờ quản lý giới hạn tác vụ và khởi chạy phiên đám mây.

ChatGPT tích hợp công cụ năng suất và mở rộng các gói đăng ký.

Muse ra mắt thiết bị phần cứng và tính năng cuộc gọi.

Google ra mắt các mô hình Gemini 3.8 Flash TTS và Flash-Lite TTS.

Các tính năng mới hỗ trợ hơn 100 ngôn ngữ và giọng nói sẵn sàng sản xuất.

Nghiên cứu khám phá phương pháp mới để huấn luyện tác nhân hiệu quả.

Làm sao tự động tổng hợp môi trường thực thi và tác vụ phức tạp từ kỹ năng có sẵn để huấn luyện tác nhân AI?

30 chủ đề hôm nay, ít nhất ba nguồn độc lập cho mỗi chủ đề.

Nguồn có trên consonance.fyi.

Đang được bàn

30 · chủ đề

Chủ đề có ít nhất ba tài khoản độc lập cùng nói trong bảy ngày qua.

01 — architecture · ngày thứ 4 14 TIẾNG NÓI

Anthropic ra mắt Claude Sonnet 5.5 với tốc độ nhanh hơn và chi phí thấp hơn

Anthropic launches Claude Sonnet 5.5 with higher speed and lower cost

Anthropic đã phát hành Claude Sonnet 5.5, mang lại cải thiện về hiệu suất và đạt 56 điểm trên Artificial Analysis Intelligence Index. Mô hình này chạy nhanh hơn 30% và có chi phí thấp hơn tới 30% so với thế hệ trước, đồng thời đi kèm các biện pháp bảo vệ an toàn mạng mới.

14 tài khoản độc lập 66 bài 1 bài viết 3 lab 63.230 tương tác
claude sonnetterminal-benchartificial analysiscontext window
@ArtificialAnlys các chủ đề trên X ↗
@ClaudeDevs các chủ đề trên X ↗
@FactoryAI các chủ đề trên X ↗
@Hesamation các chủ đề trên X ↗
@OpenRouter các chủ đề trên X ↗
@addyosmani các chủ đề trên X ↗
@alex_prompter các chủ đề trên X ↗
@arena các chủ đề trên X ↗
02 — agents MỚI 11 TIẾNG NÓI

NVIDIA giới thiệu Open Agent Safety Platform với OpenShell và Sentry

NVIDIA introduces Open Agent Safety Platform with OpenShell and Sentry

NVIDIA đã công bố Open Agent Safety Platform, được thiết kế để cung cấp không gian thực thi bảo mật cho các tác nhân trí tuệ nhân tạo. Nền tảng này kết hợp OpenShell và Sentry nhằm thiết lập các ranh giới rõ ràng và theo dõi hoạt động của tác nhân.

11 tài khoản độc lập 43 bài 6 lab 186.618 tương tác
nvidia
@AndrewYNg các chủ đề trên X ↗
@AravSrinivas các chủ đề trên X ↗
@ClementDelangue các chủ đề trên X ↗
@CuiMao các chủ đề trên X ↗
@Hesamation các chủ đề trên X ↗
@LangChain các chủ đề trên X ↗
@NVIDIAAI các chủ đề trên X ↗
@alex_prompter các chủ đề trên X ↗
03 — agents MỚI 11 TIẾNG NÓI

Muse ra mắt thiết bị phần cứng và tính năng gọi điện thoại trợ lý AI

Muse launches hardware device and AI assistant phone call features

Nền tảng trợ lý cá nhân Muse công bố các tính năng gọi điện thoại mới cùng thiết bị đeo tay Muse Charm dự kiến giao hàng vào tháng 12. Công ty cũng hợp tác với các đối tác thương mại điện tử và thanh toán để tích hợp tác nhân AI vào quy trình mua sắm.

11 tài khoản độc lập 72 bài 1 bài viết 2 lab 118.256 tương tác
muse spark
@AIatMeta các chủ đề trên X ↗
@AlexFinn các chủ đề trên X ↗
@NVIDIAAI các chủ đề trên X ↗
@TheRundownAI các chủ đề trên X ↗
@VibeMarketer_ các chủ đề trên X ↗
@aiedge_ các chủ đề trên X ↗
@alliekmiller các chủ đề trên X ↗
@dotey các chủ đề trên X ↗
04 — evaluation MỚI 3 TIẾNG NÓI

Cộng đồng thảo luận về các nội dung châm biếm ngành trí tuệ nhân tạo

Community discussions on satirical media regarding artificial intelligence

Truyền thông và cộng đồng trực tuyến đang bàn luận về các chương trình truyền hình châm biếm hình ảnh của các nhà lãnh đạo và các phòng thí nghiệm trí tuệ nhân tạo trong bối cảnh các đợt huy động vốn lớn.

3 tài khoản độc lập 5 bài 66.572 tương tác
@firstadopter các chủ đề trên X ↗
@iScienceLuvr các chủ đề trên X ↗
@teortaxesTex các chủ đề trên X ↗
@nbcsnl các chủ đề trên X ↗
05 — system_design · ngày thứ 2 10 TIẾNG NÓI

OpenAI khắc phục sự cố gián đoạn dịch vụ Codex

OpenAI resolves service disruption affecting Codex

Hệ thống Codex đã gặp phải tình trạng ngừng hoạt động ngoài dự kiến, khiến dịch vụ phải tạm dừng. Đội ngũ kỹ thuật đã khôi phục hoàn toàn và đưa hệ thống trở lại hoạt động bình thường.

10 tài khoản độc lập 56 bài 1 bài viết 3 lab 81.069 tương tác
codex
@Hesamation các chủ đề trên X ↗
@OpenAIDevs các chủ đề trên X ↗
@TheRundownAI các chủ đề trên X ↗
@aiedge_ các chủ đề trên X ↗
@alex_prompter các chủ đề trên X ↗
@arena các chủ đề trên X ↗
@dani_avila7 các chủ đề trên X ↗
@derrickcchoi các chủ đề trên X ↗
06 — agents · ngày thứ 6 13 TIẾNG NÓI

Claude Code cập nhật tính năng phiên đám mây và giới hạn ngắt nhiệm vụ

Claude Code updates cloud sessions and mid-task limit handling

Claude Code bổ sung cơ chế dùng hạn mức nhỏ để hoàn tất công việc khi chạm trần 5 tiếng, đồng thời chính thức phát hành các phiên làm việc trên đám mây. Bản cập nhật cũng đưa vào hoạt động nền tảng quản lý tác vụ và tiếp tục thu phí với các yêu cầu bị bộ lọc chặn.

13 tài khoản độc lập 71 bài 1 lab 279.847 tương tác
claude code
@AlexFinn các chủ đề trên X ↗
@ArtificialAnlys các chủ đề trên X ↗
@ClaudeDevs các chủ đề trên X ↗
@Hesamation các chủ đề trên X ↗
@LangChain các chủ đề trên X ↗
@addyosmani các chủ đề trên X ↗
@aiedge_ các chủ đề trên X ↗
@alex_prompter các chủ đề trên X ↗
07 — multimodal · ngày thứ 4 13 TIẾNG NÓI

Google ra mắt bộ đôi mô hình tổng hợp giọng nói Gemini 3.8 Flash TTS

Google launches Gemini 3.8 Flash TTS text-to-speech models

Google giới thiệu Gemini 3.8 Flash TTS và Flash-Lite TTS với khả năng hỗ trợ hơn 100 ngôn ngữ và kho giọng đọc sẵn sàng cho sản xuất. Các mô hình này cung cấp tính năng thiết kế giọng nói tùy chỉnh, đối thoại hai người và chỉnh sửa chi tiết từng dòng.

13 tài khoản độc lập 73 bài 1 bài viết 2 lab 77.597 tương tác
alibabageminigemini 3.8gemini 3.1 flash
@AndrewCurran_ các chủ đề trên X ↗
@ArtificialAnlys các chủ đề trên X ↗
@GeminiApp các chủ đề trên X ↗
@GithubProjects các chủ đề trên X ↗
@Google các chủ đề trên X ↗
@GoogleAIStudio các chủ đề trên X ↗
@GoogleDeepMind các chủ đề trên X ↗
@OfficialLoganK các chủ đề trên X ↗
08 — agents MỚI 5 TIẾNG NÓI

Grok ghi nhận mức độ sử dụng tăng trưởng mạnh mẽ và ra mắt tính năng mới

Grok records rapid usage growth and rolls out new features

Mức độ sử dụng chatbot Grok ghi nhận đà tăng trưởng nhanh chóng cùng hàng loạt tính năng mới được bổ sung, bao gồm khả năng quản lý tài chính. Bên cạnh đó, phiên bản mô hình kích thước nhỏ Grok 4.7 đạt hiệu suất khả quan.

5 tài khoản độc lập 77 bài 1 bài viết 1 lab 2.089.854 tương tác
grokxai
@AlexFinn các chủ đề trên X ↗
@CuiMao các chủ đề trên X ↗
@aiedge_ các chủ đề trên X ↗
@alex_prompter các chủ đề trên X ↗
@elonmusk các chủ đề trên X ↗
@godofprompt các chủ đề trên X ↗
@haider1 các chủ đề trên X ↗
@iScienceLuvr các chủ đề trên X ↗
09 — agents MỚI 10 TIẾNG NÓI

OpenAI chuẩn bị cho sự kiện DevDay và mở rộng năng lực của Astra

OpenAI prepares for DevDay and expands capabilities for Astra

Đội ngũ phát triển chuẩn bị cho sự kiện DevDay với nhiều cập nhật nhằm thay đổi quy trình làm việc. Hệ thống Astra ghi nhận các bước tiến mới trong việc tạo dựng không gian 3D chi tiết và vận hành tác vụ.

10 tài khoản độc lập 67 bài 4 lab 88.645 tương tác
astra
@AlexFinn các chủ đề trên X ↗
@AravSrinivas các chủ đề trên X ↗
@alex_prompter các chủ đề trên X ↗
@c_valenzuelab các chủ đề trên X ↗
@derrickcchoi các chủ đề trên X ↗
@dotey các chủ đề trên X ↗
@emollick các chủ đề trên X ↗
@firstadopter các chủ đề trên X ↗
10 — agents MỚI 13 TIẾNG NÓI

ChatGPT tích hợp công cụ làm việc và mở rộng các gói dịch vụ cao cấp

ChatGPT integrates workspace tools and expands high-tier subscription plans

ChatGPT bổ sung khả năng sử dụng các tiện ích mở rộng như email, lịch và Slack thông qua chế độ giọng nói, đồng thời ra mắt bộ công cụ sáng tạo video Tesseract. Nền tảng cũng chuẩn bị điều chỉnh cấu trúc giá với các gói dịch vụ cao cấp mới.

13 tài khoản độc lập 64 bài 5 lab 133.376 tương tác
chatgpt
@AndrewBolis các chủ đề trên X ↗
@CompleteSkeptic các chủ đề trên X ↗
@Hesamation các chủ đề trên X ↗
@MatthewBerman các chủ đề trên X ↗
@OpenAI các chủ đề trên X ↗
@SchmidhuberAI các chủ đề trên X ↗
@TheRundownAI các chủ đề trên X ↗
@ajambrosino các chủ đề trên X ↗
11 — agents · ngày thứ 4 3 TIẾNG NÓI

GitHub Copilot công bố bản cập nhật lớn với tính năng Autopilot chủ động

GitHub Copilot announces major update featuring proactive Autopilot

GitHub Copilot triển khai bản cập nhật lớn nhất từ trước đến nay, tích hợp tính năng Autopilot mang lại khả năng hỗ trợ chủ động. Nền tảng cũng bổ sung thêm hai mô hình mã hóa mới và giới thiệu giao diện ứng dụng Copilot với các chế độ Home, Code và Copilot.

3 tài khoản độc lập 14 bài 2 lab 58.775 tương tác
github copilot
@AndrewBolis các chủ đề trên X ↗
@emollick các chủ đề trên X ↗
@mustafasuleyman các chủ đề trên X ↗
@rohanpaul_ai các chủ đề trên X ↗
@testingcatalog các chủ đề trên X ↗
@alexeheath các chủ đề trên X ↗
@github các chủ đề trên X ↗
@jacobandreou các chủ đề trên X ↗
12 — inference · ngày thứ 7 17 TIẾNG NÓI

Ra mắt dòng mô hình GPT-6 Sol và GPT-6 Luna với giá API thấp hơn 50%

GPT-6 Sol and GPT-6 Luna launched with API prices 50% lower

Dòng mô hình GPT-6 Sol và GPT-6 Luna vừa được giới thiệu nhằm mang lại hiệu năng cao với mức giá dễ tiếp cận hơn cho việc mở rộng quy mô. Cả hai mô hình đều có giá API rẻ hơn 50% so với thế hệ tiền nhiệm.

17 tài khoản độc lập 86 bài 2 bài viết 6 lab 286.126 tương tác
gpt-6
@AndrewCurran_ các chủ đề trên X ↗
@ArtificialAnlys các chủ đề trên X ↗
@Hesamation các chủ đề trên X ↗
@OpenAI các chủ đề trên X ↗
@OpenAIDevs các chủ đề trên X ↗
@OpenRouter các chủ đề trên X ↗
@PromptLLM các chủ đề trên X ↗
@TheRundownAI các chủ đề trên X ↗
13 — agents MỚI 8 TIẾNG NÓI

Mở rộng hệ sinh thái tích hợp plugin và giao thức MCP cho Claude

Claude expands plugin ecosystem and Model Context Protocol adoption

Nền tảng hỗ trợ phát triển plugin và giao thức ngữ cảnh mô hình (MCP) đang được mở rộng nhằm đơn giản hóa việc tích hợp công cụ và dữ liệu. Lượng sử dụng MCP ngày càng tăng trong hệ sinh thái của Claude giúp kết nối đa dạng các nguồn dữ liệu bên ngoài.

8 tài khoản độc lập 32 bài 1 bài viết 3 lab 40.902 tương tác
model context protocol
@ClaudeDevs các chủ đề trên X ↗
@LangChain các chủ đề trên X ↗
@alex_prompter các chủ đề trên X ↗
@bcherny các chủ đề trên X ↗
@c_valenzuelab các chủ đề trên X ↗
@dani_avila7 các chủ đề trên X ↗
@dotey các chủ đề trên X ↗
@ideabrowser các chủ đề trên X ↗
14 — architecture · ngày thứ 7 22 TIẾNG NÓI

Giới thiệu mô hình Claude Opus 5.5 với chi phí vận hành thấp hơn 40%

Claude Opus 5.5 introduced with 40% lower operating costs

Mô hình Claude Opus 5.5 chính thức ra mắt, đạt hiệu năng tương đương Claude Fable 5.1 trong phần lớn các tác vụ nhưng có chi phí vận hành thấp hơn 40% so với phiên bản Opus tiền nhiệm. Bản cập nhật này cũng mang lại cải tiến về tốc độ và hiệu quả sử dụng token.

22 tài khoản độc lập 72 bài 7 lab 515.193 tương tác
claude fabledeepswe
@AlexFinn các chủ đề trên X ↗
@AndrewCurran_ các chủ đề trên X ↗
@AnthropicAI các chủ đề trên X ↗
@AravSrinivas các chủ đề trên X ↗
@ArtificialAnlys các chủ đề trên X ↗
@CuiMao các chủ đề trên X ↗
@Hesamation các chủ đề trên X ↗
@MatthewBerman các chủ đề trên X ↗
15 — agents MỚI 4 TIẾNG NÓI

OpenAI chuẩn bị công bố dòng sản phẩm agent hoạt động liên tục

OpenAI prepares major announcements for always-on autonomous agents

Cộng đồng công nghệ đang chờ đợi loạt thông báo lớn từ các nhà phát triển về hệ thống agent hoạt động liên tục. Những cải tiến về năng suất và nhân sự mới được kỳ vọng sẽ mang lại bước ngoặt cho khả năng tự động hóa.

4 tài khoản độc lập 8 bài 1 lab 9.501 tương tác
@AndrewCurran_ các chủ đề trên X ↗
@Hesamation các chủ đề trên X ↗
@MatthewBerman các chủ đề trên X ↗
@OpenAI các chủ đề trên X ↗
@derrickcchoi các chủ đề trên X ↗
@firstadopter các chủ đề trên X ↗
@kimmonismus các chủ đề trên X ↗
@swyx các chủ đề trên X ↗
16 — multimodal MỚI 5 TIẾNG NÓI

Giới thiệu mô hình thế giới Agora-2 và PixVerse R2 hỗ trợ tương tác thời gian thực

Agora-2 and PixVerse R2 introduced as real-time interactive world models

Nền tảng công nghệ ra mắt các mô hình thế giới mới hỗ trợ mô phỏng môi trường và nhân vật theo thời gian thực. Các hệ thống này cho phép nhiều người dùng và tác nhân tương tác trực tiếp trong một không gian chia sẻ.

5 tài khoản độc lập 25 bài 1 bài viết 4 lab 42.716 tương tác
world model
@ClementDelangue các chủ đề trên X ↗
@SchmidhuberAI các chủ đề trên X ↗
@_akhaliq các chủ đề trên X ↗
@alex_prompter các chủ đề trên X ↗
@haider1 các chủ đề trên X ↗
@hardmaru các chủ đề trên X ↗
@iScienceLuvr các chủ đề trên X ↗
@rohanpaul_ai các chủ đề trên X ↗
17 — system_design MỚI 3 TIẾNG NÓI

Tối ưu hóa hiệu năng giúp tăng tốc độ ứng dụng Claude gấp ba lần

Performance optimization makes Claude applications three times faster

Nhà phát triển công bố các phương pháp và kỹ thuật tối ưu hóa giúp tăng tốc độ của ứng dụng Claude và giao diện web lên gấp ba lần trong hai tuần. Đội ngũ kỹ thuật đã chia sẻ chi tiết quy trình đo lường, gỡ lỗi và cải thiện hiệu năng hệ thống.

3 tài khoản độc lập 5 bài 2 bài viết 1 lab 50.040 tương tác
@ClaudeDevs các chủ đề trên X ↗
@amorriscode các chủ đề trên X ↗
@bcherny các chủ đề trên X ↗
@trq212 các chủ đề trên X ↗
@edwinarbus các chủ đề trên X ↗
18 — training · ngày thứ 3 4 TIẾNG NÓI

Opus 5.5 ra mắt với kỹ thuật huấn luyện chưng cất và học tăng cường từ mô hình giáo viên

Opus 5.5 released with distillation and reinforcement learning from a teacher model

Mô hình Opus 5.5 được đào tạo thông qua phương pháp học tự cải thiện và chưng cất từ một mô hình giáo viên nội bộ lớn hơn. Phương pháp hậu huấn luyện này tạo ra một mô hình nhỏ gọn hơn, chi phí thấp hơn nhưng đạt hiệu suất thông minh cao.

4 tài khoản độc lập 16 bài 1 bài viết 1 lab 21.405 tương tác
distillation
@AravSrinivas các chủ đề trên X ↗
@kimmonismus các chủ đề trên X ↗
@natolambert các chủ đề trên X ↗
@rasbt các chủ đề trên X ↗
@rohanpaul_ai các chủ đề trên X ↗
@teortaxesTex các chủ đề trên X ↗
@PatrickToulme các chủ đề trên X ↗
@baselabs các chủ đề trên X ↗
19 — agents MỚI 3 TIẾNG NÓI

Ra mắt Imp, cổng giao tiếp DSPy dành cho hệ sinh thái BEAM

Imp launches as a DSPy port for the BEAM ecosystem

Imp chính thức ra mắt như một bản chuyển đổi của DSPy sang hệ sinh thái BEAM, mang đến các tính năng lập trình ngôn ngữ tự cải thiện mang tính khai báo bao gồm chữ ký, trình tối ưu hóa và vòng lặp tác nhân.

3 tài khoản độc lập 16 bài 2 bài viết 1 lab 8.555 tương tác
dspy
@CompleteSkeptic các chủ đề trên X ↗
@lateinteraction các chủ đề trên X ↗
@typesafeai các chủ đề trên X ↗
@DSPyOSS các chủ đề trên X ↗
@MaximeRivest các chủ đề trên X ↗
@dbreunig các chủ đề trên X ↗
@deepfates các chủ đề trên X ↗
@isaacbmiller1 các chủ đề trên X ↗
20 — inference · ngày thứ 7 5 TIẾNG NÓI

OpenRouter tích hợp các mô hình ngôn ngữ mới gồm Space Bunny Alpha và GPT-6 Sol Luna

OpenRouter integrates new language models including Space Bunny Alpha and GPT-6 Sol Luna

Nền tảng OpenRouter tích hợp nhiều mô hình xử lý ngôn ngữ và đa phương thức mới, trong đó có Space Bunny Alpha hỗ trợ cửa sổ ngữ cảnh một triệu token và dòng mô hình GPT-6 từ OpenAI với mức giá dịch vụ mới công bố.

5 tài khoản độc lập 36 bài 1 bài viết 9.639 tương tác
openrouter
@CompleteSkeptic các chủ đề trên X ↗
@LangChain các chủ đề trên X ↗
@OpenRouter các chủ đề trên X ↗
@cline các chủ đề trên X ↗
@heyshrutimishra các chủ đề trên X ↗
@teortaxesTex các chủ đề trên X ↗
@alexatallah các chủ đề trên X ↗
@dasha_shunina các chủ đề trên X ↗
21 — inference MỚI 4 TIẾNG NÓI

Ollama ra mắt tính năng nạp tín dụng thanh toán linh hoạt cho mô hình đám mây

Ollama introduces pay-as-you-go cloud model usage credits

Ollama đã triển khai hệ thống tín dụng sử dụng cho phép người dùng thanh toán theo mức tiêu thụ thực tế đối với các mô hình đám mây, không bắt buộc phải mua gói thuê bao định kỳ. Cùng lúc đó, cộng đồng ghi nhận sự xuất hiện của các mô hình phân loại nhỏ gọn chạy hoàn toàn cục bộ trên phần cứng cá nhân thông qua nền tảng này.

4 tài khoản độc lập 16 bài 1 lab 4.911 tương tác
deepseek r1whisperollamareinforcement learning with verifiable rewardssoraveo
@alex_prompter các chủ đề trên X ↗
@gregisenberg các chủ đề trên X ↗
@nutlope các chủ đề trên X ↗
@ollama các chủ đề trên X ↗
@rohanpaul_ai các chủ đề trên X ↗
@1a3orn các chủ đề trên X ↗
@CrusoeAI các chủ đề trên X ↗
@Kore_wa_Kore các chủ đề trên X ↗
22 — evaluation · ngày thứ 4 3 TIẾNG NÓI

Giới nghiên cứu tranh luận về rủi ro an ninh của các mô hình trí tuệ nhân tạo nguồn mở

Researchers debate security risks associated with open-source AI models

Một cuộc thảo luận công khai đã diễn ra về mức độ an toàn của các hệ thống AI mã nguồn mở so với các mô hình độc quyền. Các bên tham gia phân tích liệu việc phát hành mã nguồn có làm gia tăng nguy cơ lạm dụng công nghệ cho các cuộc tấn công mạng hay đóng góp vào năng lực phòng thủ chung.

3 tài khoản độc lập 5 bài 1 lab 6.937 tương tác
@ClementDelangue các chủ đề trên X ↗
@firstadopter các chủ đề trên X ↗
@natolambert các chủ đề trên X ↗
@HillaryClinton các chủ đề trên X ↗
23 — agents · ngày thứ 4 4 TIẾNG NÓI

Google DeepMind công bố loạt bài luận về quản trị hệ thống nhân tạo và phân bổ lợi ích AGI

Google DeepMind publishes essay series on agent systems governance and AGI benefits

Google DeepMind đã phát hành các bài tiểu luận nghiên cứu về phương pháp kiểm soát hành vi lệch chuẩn trong các tập thể agent tự trị. Các tác giả cũng đề xuất khung đạo đức nhằm đảm bảo lợi ích từ công nghệ trí tuệ nhân tạo tổng quát được phân phối công bằng trên phạm vi toàn cầu.

4 tài khoản độc lập 11 bài 1 lab 4.699 tương tác
google deepmind
@ShaneLegg các chủ đề trên X ↗
@alex_prompter các chủ đề trên X ↗
@c_valenzuelab các chủ đề trên X ↗
@eptwts các chủ đề trên X ↗
@heyshrutimishra các chủ đề trên X ↗
@10ayaGoldsen các chủ đề trên X ↗
@Dr_Atoosa các chủ đề trên X ↗
@IasonGabriel các chủ đề trên X ↗
24 — system_design MỚI 3 TIẾNG NÓI

Cohere mở rộng dịch vụ Model Vault tại thị trường Canada

Cohere expands Model Vault data security service to the Canadian market

Cohere đã triển khai dịch vụ Model Vault tại Canada, mang đến giải pháp kiểm soát toàn diện với khối lượng công việc tự động mở rộng và cơ sở hạ tầng đơn thuê bao. Dịch vụ này hướng đến việc đảm bảo tính riêng tư dữ liệu và tối ưu hóa tổng chi phí sở hữu cho các tổ chức sở tại.

3 tài khoản độc lập 6 bài 1 bài viết 1 lab 6.185 tương tác
cohere
@cohere các chủ đề trên X ↗
@teortaxesTex các chủ đề trên X ↗
@trq212 các chủ đề trên X ↗
@donaldjewkes các chủ đề trên X ↗
25 — system_design MỚI 3 TIẾNG NÓI

LangChain tích hợp tính năng xử lý song song và công cụ tinh chỉnh LangSmith

LangChain integrates parallel processing and launches LangSmith fine-tuning tools

LangChain đã tích hợp cơ chế xử lý song song vào hệ thống quản lý agent của nền tảng. Đồng thời, dịch vụ tinh chỉnh LangSmith cũng ra mắt thông qua sự hợp tác với các đối tác cơ sở hạ tầng nhằm giải quyết bài toán chuyển hóa dữ liệu thô thành môi trường huấn luyện tối ưu.

3 tài khoản độc lập 25 bài 3.513 tương tác
langchain
@CompleteSkeptic các chủ đề trên X ↗
@LangChain các chủ đề trên X ↗
@hwchase17 các chủ đề trên X ↗
@FireworksAI_HQ các chủ đề trên X ↗
@GitMaxd các chủ đề trên X ↗
@GregKamradt các chủ đề trên X ↗
@JoshARosen các chủ đề trên X ↗
@KevinBFrank các chủ đề trên X ↗
26 — multimodal MỚI 5 TIẾNG NÓI

Alibaba Qwen ra mắt mô hình đa phương thức Qwen3.8-Omni-Flash cho tác vụ agent

Alibaba Qwen releases Qwen3.8-Omni-Flash multimodal model for long-horizon agents

Nhóm phát triển Qwen thuộc Alibaba đã giới thiệu mô hình đa phương thức bản địa Qwen3.8-Omni-Flash, được thiết kế chuyên biệt cho các tác vụ agent kéo dài trên văn bản, âm thanh và thị giác. Sự kiện diễn ra song song với việc cộng đồng mã nguồn mở chia sẻ các bộ công cụ và môi trường huấn luyện tăng cường cho agent.

5 tài khoản độc lập 11 bài 2.558 tương tác
agent skillsalibaba qwen
@NVIDIAAI các chủ đề trên X ↗
@aiedge_ các chủ đề trên X ↗
@dair_ai các chủ đề trên X ↗
@dani_avila7 các chủ đề trên X ↗
@teortaxesTex các chủ đề trên X ↗
@tom_doerr các chủ đề trên X ↗
@claudeskills101 các chủ đề trên X ↗
@tphuang các chủ đề trên X ↗

Đáng đọc kỹ

24 bài đọc

Paper và writeup, đọc từ abstract, xếp theo mức liên quan với người xây agent và backend.

01 — agents 19 upvote

Skill2Env: Capability-Oriented Environment Synthesis from Skills for General Agents

CÂU HỎI — Làm thế nào để tự động tổng hợp các môi trường thực thi và tác vụ phức tạp từ các kỹ năng có sẵn nhằm phục vụ huấn luyện tác nhân AI?

Sử dụng 1.5K quỹ đạo đạt điểm cao được tạo ra từ các môi trường Skill2Env cho SFT mang lại cải thiện nhất quán trên hàng loạt benchmark cho agent.

yangxw · 27 thg 9, 2026 đọc bản gốc ↗
04 — inference 54 upvote

Disaggregated Quantization: Specializing LLM Prefill and Decode

CÂU HỎI — Làm thế nào để chuyên biệt hóa định dạng lượng tử hóa cho từng pha prefill và decode của mô hình ngôn ngữ lớn nhằm cải thiện hiệu năng inference?

With released Qwen3.8-27B GGUF decoders, training an NVFP4 prefiller improves 1-bit accuracy by 32.5 points on MMLU-Pro and 35.3 on MMMU-Pro without modifying the decode checkpoint.

BlackSamorez · 22 thg 9, 2026 đọc bản gốc ↗
05 — agents 41 upvote

Self-Evolving Coding Agents: From Digital Programs to Physical-World Intelligence

CÂU HỎI — Làm thế nào để biểu diễn trạng thái và quá trình thực thi của tác nhân điều khiển dưới dạng mã nhằm cải thiện khả năng tổng quát hóa trong thế giới vật lý?

On RoboCasa365, HexaAnything improves Composite-Unseen and overall success over XR-1 VLA, and its Harness-trained HexaModel beats the base on every split, indicating code traces internalize physical execution.

HongchengGao · 28 thg 9, 2026 đọc bản gốc ↗
06 — training 21 upvote

Learning to Learn from Context: Synthetic Training from Perturbed Public Documents

CÂU HỎI — Làm thế nào để tổng hợp dữ liệu huấn luyện chất lượng cao từ các tài liệu công khai nhằm cải thiện khả năng học tập theo ngữ cảnh (context-dependent reasoning) của LLM mà không cần người gán nhãn?

SFT nâng Qwen3.6-35B-A3B student từ 13.7% lên 22.8% trên CL-bench.

YangXiao-nlp · 27 thg 9, 2026 đọc bản gốc ↗
07 — agents 16 upvote

TimeEvo: Failure-Driven Self-Evolution of a Time Series Agent

CÂU HỎI — Làm thế nào để khắc phục hiện tượng lệch công cụ giữa con người và tác nhân cũng như hiện tượng tổn hại âm thầm trong các tác nhân chuỗi thời gian?

Một thư viện gồm 21 công cụ do chuyên gia tuyển chọn giúp ích cho một số tác vụ nhưng gây hại cho các tác vụ khác, làm giảm độ chính xác của hiện bất thường dưới mọi mô hình nền tảng được thử nghiệm.

Muyiiiii · 23 thg 9, 2026 đọc bản gốc ↗
08 — agents 9 upvote

Program-Verified Self-Evolution for Vision-Language Models

CÂU HỎI — Làm thế nào để loại bỏ các nhãn sai do phương pháp majority vote hoặc model judge tạo ra trong quá trình self-evolution của mô hình thị giác-ngôn ngữ?

24% majority-vote labels và 18% model-judge labels được tạo ra trong quá trình self-evolution là sai.

ahmedheakl · 27 thg 9, 2026 đọc bản gốc ↗
09 — training 21 upvote

Post-Training Leaves Behavioral Shadows on Unrelated Decisions

CÂU HỎI — Làm thế nào để truyền tải năng lực mô hình thông qua văn bản không liên quan đến tác vụ mà không cần dùng target-task examples, teacher logits hay teacher parameters?

Trong thử nghiệm lập trình chính với Qwen2.5-1.5B, 5,664 nses mang lại mức tăng 5.34 pp trên HumanEval+ so với control được khớp nhiễu chính xác.

Lines · 24 thg 9, 2026 đọc bản gốc ↗
10 — training 16 upvote

AdaTutoRank: Learning to Rerank Document Sets via Adaptive Tutoring Optimization for RAG and Deep Research

CÂU HỎI — Làm thế nào để tối ưu hóa việc xếp hạng lại tập tài liệu cho hệ thống RAG và nghiên cứu sâu mà tránh được tình trạng phân bổ tín hiệu thưa thớt?

Across ten benchmarks spanning RAG, deep research, and setwise evaluation, AdaTutoRank attains the best overall performance while issuing fewer retrieval calls.

kailinjiang · 26 thg 9, 2026 đọc bản gốc ↗
11 — training 15 upvote

LastOPD: Taming Collapse in Latent On-Policy Distillation

CÂU HỎI — Làm thế nào để giải quyết hiện tượng sụp đổ trong quá trình chưng cất trực tuyến có sự giám sát tiềm ẩn?

Giám sát tiềm ẩn đơn lẻ nâng độ chính xác trên MATH-500 từ 25 lên 46 trong 10 bước nhưng việc huấn luyện tiếp theo làm giảm hiệu suất xuống 11 mà không thể phục hồi.

Muyiiiii · 23 thg 9, 2026 đọc bản gốc ↗
12 — evaluation 47 upvote

TraceDance: An Automated System for Building Agent Behavior Benchmarks from Real-World Agent Deployment Traces

CÂU HỎI — Làm thế nào để tự động xây dựng các bộ benchmark đánh giá hành vi tác nhân từ các trace triển khai thực tế?

Experiments in coding and general tool use draw on 252,557 sessions and produce 107 benchmarks with 4,125 instances, fulfilling 95.3% of build-target requests.

ZhishanQ · 27 thg 9, 2026 đọc bản gốc ↗
13 — training 36 upvote

Beyond Teacher Assignment: Domain-Normalized Multi-Teacher On-Policy Distillation

CÂU HỎI — Làm thế nào để cân bằng phản hồi từ nhiều mô hình chuyên gia trong quá trình chưng cất trực tuyến đa chuyên gia cho mô hình ngôn ngữ lớn?

On six public benchmarks, DN-MOPD improves the average score over MOPD at every size, across three random seeds and under two answer-length limits, and recovers most of the lost mathematics gain.

XINLI1997 · 28 thg 9, 2026 đọc bản gốc ↗
15 — training 17 upvote

Diffusion Reward Models

CÂU HỎI — Làm thế nào để mô hình phần thưởng xử lý bản chất đa phương thức của sở thích con người thay vì chỉ đưa ra ước lượng điểm đơn lẻ?

Bài báo giới thiệu DRM (Diffusion Reward Model), một mô hình phần thưởng xem việc tạo phần thưởng là bài toán ước lượng mật độ có điều kiện. Sử dụng một Diffusion Transformer nhẹ kết hợp với bộ mã hóa LLM đóng băng, DRM khử nhiễu Gaussian thành một vectơ phần thưởng, qua đó bảo toàn cấu trúc đa phương thức của dữ liệu sở thích mà không cần giả định tham số cố định. Thử nghiệm trên năm benchmark cho thấy DRM đạt hoặc vượt qua các baseline, duy trì sự cạnh tranh với các mô hình lớn hơn và mang lại hiệu suất chính sách tốt hơn trong các thí nghiệm RLHF hạ lưu.

hbx · 27 thg 9, 2026 đọc bản gốc ↗
16 — architecture 15 upvote

DepthBench: Measuring How Residual Connections Enable More Computational Depth

CÂU HỎI — Các kết nối tắt ảnh hưởng như thế nào đến khả năng chuyển đổi chiều sâu kiến trúc thành chiều sâu tính toán hiệu quả trong các mô hình Transformer?

Các biến thể chuẩn hóa Pre-LN tiêu chuẩn mang lại ít lợi ích và có thể làm giảm hiệu suất khi mô hình trở nên sâu hơn và hẹp hơn.

Shiweiliuiiiiiii · 26 thg 9, 2026 đọc bản gốc ↗
17 — architecture 12 upvote

Just MLPs: Efficient Visual State Reconstruction for Multimodal Language Models

CÂU HỎI — Liệu có thể giữ nguyên toàn bộ visual token trong MLLM mà vẫn giảm được chi phí tính toán khi Transformer xử lý lặp lại các biểu diễn hình ảnh hay không?

Khôi phục chỉ một vài hướng sau khi chặn attention giữa hình ảnh và văn bản giúp thu hồi phần lớn độ chính xác bị mất.

huaXiaKyrie · 28 thg 9, 2026 đọc bản gốc ↗
18 — training 8 upvote

Imprint Reader: From Weight-Update Readout to Behavioral Intervention

CÂU HỎI — Làm thế nào để mô hình ngôn ngữ dịch mã trực tiếp các dấu vết cập nhật trọng số thành mô tả ngôn ngữ tự nhiên để can thiệp hành vi?

Trên các bản cập nhật giữ lại, Reader đạt judge-based Pass@100 là 2% cho kiến thức và 16% cho hành vi.

quantumfr · 28 thg 9, 2026 đọc bản gốc ↗
20 — evaluation 19 upvote

Duplex-MPE: Benchmarking Multi-Party Interaction in Full-Duplex Dialogue

CÂU HỎI — Làm thế nào để đánh giá chính xác hành vi tham gia hội thoại, giữ im lặng và ngắt lời của trợ lý giọng nói trong môi trường đa người dùng dạng full-duplex?

MiniCPM-o 4.5 dẫn đầu trên 3 năng lực được chấm điểm trong số 5 hệ thống thoại open-weight được đánh giá.

ChengqianMa · 25 thg 9, 2026 đọc bản gốc ↗
21 — multimodal 12 upvote

REALM: A Coarse-to-Fine Generative Framework for Embodied Reactive Listening

CÂU HỎI — Làm thế nào để tạo ra chuyển động khuôn mặt phản hồi theo thời gian thực cho các hệ thống đàm thoại có thể hiện thân trong môi trường vật lý?

REALM cải thiện các mô hình cơ sở đã đánh giá trên nhiều chỉ số chất lượng chuyển động dựa trên ViCo và L2L.

Peizhen · 27 thg 9, 2026 đọc bản gốc ↗
22 — multimodal 55 upvote

YuE2: Unifying Symbolic and Audio Music Generation at Frontier Quality

CÂU HỎI — Làm thế nào để kết hợp mô hình tạo sinh biểu tượng và âm thanh nhằm đạt chất lượng âm nhạc vượt trội thông qua lập kế hoạch biểu tượng?

Experts prefer symbolic planning for overall quality and musicality, with 49.3% of overall preferences versus 34.6% without planning.

a43992899 · 27 thg 9, 2026 đọc bản gốc ↗
24 — multimodal 18 upvote

WorldPlay2: Extending Real-Time Interactive World Models in Control and Horizon

CÂU HỎI — Làm thế nào để duy trì tính nhất quán dài hạn và khả năng phản hồi thời gian thực trong các mô hình thế giới tương tác?

Bài báo giới thiệu WorldPlay2, một mô hình thế giới tương tác giải quyết thách thức quản lý các điều khiển không đồng nhất và chi phí ngữ cảnh cao trong quá trình huấn luyện. Hệ thống kết hợp giao diện điều khiển kết hợp nhân tử, bộ nhớ nén được chia sẻ giữa sinh viên tự hồi quy và giáo viên song hướng, cùng chiến lược Stable Forcing để khởi tạo và chạy lại toàn bộ quá trình. Kết quả là mô hình đạt được hiệu suất vượt trội và khả năng tổng quát hóa mạnh mẽ so với các phương pháp hiện tại.

aejion · 28 thg 9, 2026 đọc bản gốc ↗

Thực chiến

2026-09-29

Repo đang lên trên GitHub hôm nay, chấm theo đà trong ngày, thứ hạng, quy mô, độ tươi và sức khoẻ dự án.

↑