Radar AI và agent. Mỗi sáng một lần, và chỉ những gì nhiều nguồn độc lập cùng nói.
NGHE 145 TÀI KHOẢN
Tổng hợp trong ngàydo mô hình viết
01Anthropic ra mắt mô hình Sonnet 5.5Anthropic đã giới thiệu Claude Sonnet 5.5 với tốc độ nhanh hơn và chi phí thấp hơn, đồng thời tăng cường các biện pháp bảo vệ chống tấn công chưng cất.→ 11
Video trong ngày
cuộn số 9 · 1:04
NHÃNarchitecture · 23 tiếng nói
Google ra mắt Gemini 4 Argon với giới hạn đầu ra 1 triệu token
Google công bố mô hình Gemini 4 Argon, mang lại hiệu suất vượt trội trong các tác vụ kỹ thuật phần mềm và an ninh mạng thực tế. Mô hình sở hữu giới hạn đầu ra 1 triệu token và được triển khai ban đầu cho các nhà thử nghiệm tin cậy.
Thứ Hai, 5 tháng 10: điều nhiều nguồn độc lập cùng nói.
Google ra mắt Gemini 4 Argon với giới hạn đầu ra 1 triệu token.
Google công bố mô hình Gemini 4 Argon, mang lại hiệu suất vượt trội trong các tác vụ kỹ thuật phần mềm và an ninh mạng thực tế.
Các mô hình mới đạt thứ hạng cao trên các bảng xếp hạng AI.
Nhiều mô hình trí tuệ nhân tạo mới đạt kết quả cao trên các bảng xếp hạng kỹ thuật số và chỉ số anاب mạng.
ChatGPT mở rộng tính năng plugin và nâng cấp dung lượng cho phiên bản GPT-6.1 Sol.
ChatGPT triển khai hệ thống đề xuất plugin trong các cuộc trò chuyện và bổ sung năng lực máy chủ cho mô hình GPT-6.1 Sol nhằm đáp ứng lưu lượng truy cập lớn từ API và người dùng đăng ký.
OpenAI ra mắt dòng mô hình GPT-6 với GPT-6 Astra và GPT-6.1 Sol.
OpenAI đã giới thiệu dòng mô hình GPT-6, bao gồm phiên bản GPT-6 Astra chạy trên phần cứng NVIDIA và mô hình tiết kiệm chi phí GPT-6.1 Sol.
30 chủ đề hôm nay, ít nhất ba nguồn độc lập cho mỗi chủ đề.
Nguồn có trên consonance.fyi.
Đang được bàn
30 · chủ đề
Chủ đề có ít nhất ba tài khoản độc lập cùng nói trong bảy ngày qua.
Claude Code supports UI and behavior customization through mods and plugins
Claude Code cho phép người dùng cá nhân hóa giao diện và hành vi thông qua các bản mod dạng plugin TypeScript. Nền tảng cũng tích hợp sẵn plugin 'You should know' để quét và thông báo các thông tin quan trọng từ đầu ra của mô hình.
New models achieve top rankings across AI evaluation benchmarks
Nhiều mô hình trí tuệ nhân tạo mới đạt kết quả cao trên các bảng xếp hạng kỹ thuật số và chỉ số anاب mạng. Google ra mắt Gemini 4 Argon đạt hiệu suất tương đương GPT-6 Astra với chi phí thấp hơn, trong khi Grok 4.7 đứng đầu bảng xếp hạng AA Cyber Index và Claude Opus 5.5 cải thiện độ chính xác trên Drone-Bench.
ChatGPT expands plugin ecosystem and rolls out capacity upgrades for GPT-6.1 Sol
ChatGPT triển khai hệ thống đề xuất plugin trong các cuộc trò chuyện và bổ sung năng lực máy chủ cho mô hình GPT-6.1 Sol nhằm đáp ứng lưu lượng truy cập lớn từ API và người dùng đăng ký. Nền tảng cũng mở rộng tích hợp các công cụ tạo nội dung số.
Google launches Gemini 4 Argon with a 1 million token output limit
Google công bố mô hình Gemini 4 Argon, mang lại hiệu suất vượt trội trong các tác vụ kỹ thuật phần mềm và an ninh mạng thực tế. Mô hình sở hữu giới hạn đầu ra 1 triệu token và được triển khai ban đầu cho các nhà thử nghiệm tin cậy.
Muse ecosystem expands with open-source firmware and hardware tools
Dự án Muse giới thiệu Muse Gadgets, bao gồm firmware nguồn mở ESP32 và SDK Linux để phát triển thiết bị phần cứng tương thích với hệ thống Muse. Động thái này diễn ra song song với việc phát hành liên tục các mô hình hình ảnh, video và mã nguồn.
Gemini 4 Argon launches with lower task execution costs than competing models
Google phát hành Gemini 4 Argon với mức giá vận hành thấp hơn đáng kể trên mỗi tác vụ so với các mô hình đối thủ như Astra và Opus, đồng thời hỗ trợ xử lý các bài toán dài bước nhờ giới hạn đầu ra 1 triệu token.
OpenAI releases GPT-6 models including GPT-6 Astra and GPT-6.1 Sol
OpenAI đã giới thiệu dòng mô hình GPT-6, bao gồm phiên bản GPT-6 Astra chạy trên phần cứng NVIDIA và mô hình tiết kiệm chi phí GPT-6.1 Sol. Các mô hình này mang lại tốc độ vượt trội và khả năng xử lý đa phương thức mạnh mẽ cho người dùng trả phí và qua API.
ChatGPT adds native support for building and deploying MCP servers directly
ChatGPT đã bổ sung tính năng cho phép người dùng xây dựng và triển khai các máy chủ Model Context Protocol trực tiếp ngay trên nền tảng. Cải tiến này giúp mở rộng khả năng kết nối dữ liệu và tích hợp các tiện ích mở rộng một cách linh hoạt.
Devin integrates ChatGPT subscription billing and rolls out major price cuts
Công cụ lập trình tự động Devin đã cho phép người dùng sử dụng hạn mức từ gói ChatGPT Plus hoặc Pro trực tiếp trên nền tảng. Đồng thời, nền tảng này cũng cắt giảm đáng kể chi phí cho các gói dịch vụ trong khi vẫn cải thiện năng lực xử lý.
Anthropic launches dedicated developer portal and resource hub for Claude
Anthropic đã khai trương một trang web chuyên biệt dành cho các nhà phát triển xây dựng ứng dụng với Claude. Nền tảng mới này cung cấp các bài viết chuyên sâu về kỹ thuật, hướng dẫn sử dụng API và tài nguyên từ đội ngũ phát triển.
Anthropic introduces Claude Sonnet 5.5 with higher speed and lower cost
Anthropic đã giới thiệu Claude Sonnet 5.5, bản nâng cấp mang lại tốc độ xử lý nhanh hơn 30% và chi phí thấp hơn so với thế hệ tiền nhiệm. Mô hình này hiện cũng được sử dụng làm nền tảng cho gói miễn phí của dịch vụ.
GLM models expand availability across Cursor and Hugging Face ecosystems
Các mô hình GLM, bao gồm phiên bản 5.3 và 5.3 Flash, đã chính thức có mặt trên môi trường lập trình Cursor. Dòng mô hình mã nguồn mở trọng số mở này đạt điểm số cao trên bảng đánh giá CursorBench 4.0.
OpenRouter adds new models and reports high usage share for Claude Opus 5.5
OpenRouter đã tích hợp nhiều mô hình mới như d1 từ Liquid AI và bản xem trước Pareto 26.10 lên nền tảng. Trong khi đó, Claude Opus 5.5 nhanh chóng chiếm tỷ trọng chi tiêu và token cao nhất trong số các mô hình của Anthropic trên hệ thống.
OpenAI launches Dots, an always-on AI agent system
OpenAI đã ra mắt Dots, hệ thống trợ lý ảo thông minh chạy liên tục 24/7 được tích hợp với trình duyệt và hàng nghìn ứng dụng. Hệ thống này có khả năng tự động xử lý các tác vụ phức tạp như tự động hóa nhắn tin với bộ phận hỗ trợ khách hàng.
OpenAI launches Dots integrating ChatGPT memory and competing in the bot market
OpenAI vừa chính thức phát hành Dots, một sản phẩm cạnh tranh trực tiếp với các trợ lý bot trên thị trường. Điểm khác biệt lớn nhất của nền tảng này là khả năng truy cập toàn bộ bộ nhớ và các tương tác trước đó của người dùng trong hệ sinh thái ChatGPT, hoạt động liên tục 24/7.
Alibaba đã phát hành mô hình tạo ảnh mở Qwen-Image-2.1 với 7 tỷ tham số hình ảnh, vươn lên vị trí số một trên bảng xếp hạng các mô hình trọng số mở. Cùng lúc đó, các nhà phát triển cũng tích hợp các mô hình Qwen3.8 vào các quy trình làm việc đa bước và nền tảng ra quyết định.
Nvidia introduces the Open Agent Safety Platform for secure sandboxing
NVIDIA đã hợp tác với hơn 100 đối tác công nghiệp để ra mắt Nền tảng An toàn Trợ lý Ảo Mở, tích hợp hai công nghệ OpenShell và Sentry. Sáng kiến này nhằm cung cấp các ranh giới bảo mật và công cụ cách ly mạnh mẽ hơn cho các hệ thống tác tử trí tuệ nhân tạo hoạt động dài ngày.
OpenAI prepares to launch an always-on assistant named o or Aeon
Nhiều thông tin rò rỉ cho thấy OpenAI chuẩn bị công bố một trợ lý ảo hoạt động toàn thời gian mang tên o hoặc Aeon. Sự kiện này diễn ra sau khi đội ngũ kỹ thuật ghi nhận những bước nhảy vọt đáng kể về năng suất từ các công cụ nội bộ trước đó.
OpenAI adjusts usage limits and pricing structure for Pro subscriptions
OpenAI mở cửa trở lại các gói thuê bao Pro với mức giá 200 USD đồng thời thay đổi phương thức tính toán hạn mức sử dụng. Việc điều chỉnh này làm giảm một nửa lượng hạn mức tính theo mô hình cũ đối với người dùng đăng ký.
OpenAI hosts a live keynote event with an online livestream
OpenAI tổ chức một sự kiện hội nghị trực tiếp vào lúc 10 giờ sáng theo giờ Thái Bình Dương, đồng thời cung cấp đường dẫn phát trực tuyến toàn cầu cho người theo dõi từ xa.
OpenAI reports model extraction campaign linked to Moonshot AI developers
OpenAI ghi nhận một chiến dịch nhằm trích xuất các lý luận ẩn bên trong các mô hình của hãng. Theo thông tin từ OpenAI, một phần cốt lõi của hoạt động này xuất phát từ các cá nhân có liên quan đến công ty phát triển Moonshot AI.
4 tài khoản độc lập13 bài1 bài viết18.555 tương tác
New research explores video world models and physics reasoning
Cộng đồng nghiên cứu AI tiếp tục phát triển các mô hình thế giới video và cải thiện khả năng suy luận vật lý. Các công trình mới tích hợp cơ chế nhận thức không gian và điều khiển hành động nhằm khắc phục lỗi vật lý trong video do AI tạo ra.
DeepSeek pauses free V4.1-Flash promotion following high abuse
DeepSeek đã phải tạm dừng chương trình khuyến mãi miễn phí cho mô hình V4.1-Flash do lưu lượng truy cập lạm dụng tăng cao bất thường. Đội ngũ phát triển đang điều tra và tìm giải pháp khắc phục tình trạng này.
Summary of recent AI industry announcements and updates
Các nguồn tin trong cộng đồng đã tổng hợp lại toàn bộ các thông báo, sự kiện và bài viết nổi bật diễn ra trong ngành trí tuệ nhân tạo. Người dùng có thể theo dõi các liên kết tổng hợp để cập nhật thông tin chi tiết về các sản phẩm mới ra mắt.
Advances in reinforcement learning and updates to video generation benchmarks
Cộng đồng kỹ thuật đang chia sẻ các phương pháp tiếp cận học tăng cường với phần thưởng có thể kiểm chứng (RLVR) và tối ưu hóa chính sách nhóm tương đối (GRPO). Đồng thời, các bảng xếp hạng mô hình chuyển đổi hình ảnh thành video ghi nhận sự xuất hiện của nhiều hệ thống mới.
3 tài khoản độc lập7 bài3.216 tương tác
deepseek r1reinforcement learning with verifiable rewards
vLLM adds day-0 support for new open-weights models and scaling infrastructure
Hệ thống vLLM đã cập nhật hỗ trợ cho nhiều mô hình mở trọng số mới như IQuest-Q1 và triển khai các bộ định tuyến ngữ nghĩa cải tiến. Các nhóm phát triển đang tập trung tối ưu hóa việc quản lý bộ nhớ đệm KV và phối hợp tiền nạp trên quy mô lớn.
Google DeepMind publishes new surveys and research on AI agency and consciousness
Google DeepMind đã phát hành một báo cáo khảo sát chi tiết về các lý thuyết liên quan đến ý thức máy móc. Các nhà nghiên cứu cũng thảo luận về tác động của các tác nhân AI tự trị đối với lượng token tiêu thụ và tiềm năng ứng dụng trong khoa học.
LangChain releases mcp-adapters 2.0 and Deep Agents course
LangChain phát hành mcp-adapters phiên bản 2.0 với hỗ trợ giao thức MCP không trạng thái mới nhất cho các tác vụ TypeScript và các công cụ tương tác. Nền tảng này đồng thời cập nhật chương trình LangChain Academy với nội dung về Deep Agents và giới thiệu công cụ triển khai một dòng lệnh Managed Deep Agents.
CÂU HỎI — Làm thế nào để tổng hợp và mở rộng các quỹ đạo giải quyết tác vụ phức tạp từ nhiều harness khác nhau để huấn luyện LLM dưới một harness chung?
RSR sử dụng Qwen-3.8-27B để trích xuất và viết lại các quỹ đạo thành dữ liệu huấn luyện tổng quát.
CÂU HỎI — Làm thế nào để chọn lọc khung hình lịch sử hiệu quả cho việc sinh video dài dựa trên nhu cầu thông tin trong tương lai?
Bài báo đề xuất FrameMorrow, một bộ lựa chọn khung hình tiềm năng (prospective frame selector) dự đoán một tập nhỏ các prospective tokens để biểu diễn nhu cầu thông tin trong tương lai. Thay vì chỉ dựa vào nội dung hiện tại, FrameMorrow chọn các khung hình lịch sử rõ ràng dựa trên mức độ liên quan của chúng đối với các bước sinh tiếp theo. Công cụ này hoạt động theo cơ chế cắm-và-chạy (plug-and-play) trên nhiều mô hình tạo sinh khác nhau, bao gồm cả các mô hình nguồn đóng, với chi phí suy luận bổ sung rất nhỏ nhưng vẫn cải thiện tính nhất quán dài hạn và chất lượng hình ảnh.
CÂU HỎI — Các hệ thống AI và agent hiện tại có khả năng truy xuất các tài liệu nghiên cứu truyền cảm hứng cho dự án mới tốt bằng chuyên gia con người không?
Agentic search does no better than embedding retrieval with 0.42 vs. 0.48 Recall@20.
CÂU HỎI — Làm thế nào để đánh giá hiệu quả khả năng tìm kiếm thông tin đa ngôn ngữ và đa phương thức của các web-browsing agent trước các câu hỏi cực khó?
HyperBrowseComp comprises 423 manually authored and human-validated questions across 13 languages.
CÂU HỎI — Làm thế nào để cải thiện khả năng suy luận của các mô hình nhỏ tại thời điểm suy luận mà không cần huấn luyện lại bằng RL hay cập nhật tham số?
Parallel Power Tempering (PPT) áp dụng phương pháp lấy mẫu tăng cường lực thông qua song song hóa tempering để giải quyết bài toán khám phá - khai thác tại thời điểm suy luận.
CÂU HỎI — Làm thế nào để đánh giá độ đồng bộ khẩu hình và lời thoại (lip-sync) trong lồng tiếng khi chưa có sẵn tệp âm thanh?
Trên benchmark bảy ngôn ngữ, phương pháp này cải thiện mean AUC so với Qwen3.5 SFT baselines tương ứng là 59.4%, 50.2%, và 50.8% với các reasoner 2B, 4B, và 9B.
CÂU HỎI — Làm thế nào để loại bỏ cửa hậu (backdoor) trong LLM mà không làm thay đổi phân phối đầu ra của các prompt lành tính hay giảm hiệu năng mô hình?
NEEDLE là phương pháp loại bỏ cửa hậu có mục tiêu mà không cần huấn luyện lại.
CÂU HỎI — Làm thế nào để xây dựng tín hiệu phần thưởng đa chiều cho các mô hình ngôn ngữ pháp lý?
Bài báo giới thiệu LexReward, một khung thưởng dựa trên phân loại dành cho việc mô hình hóa phần thưởng pháp lý. Khung này đánh giá chất lượng phản hồi qua ba chiều: Phong cách (Style), Yếu tố (Element), và Chuỗi suy luận (Chain). Các tác giả phát triển các tiêu chuẩn đánh giá cho từng chiều để tạo dữ liệu ưu tiên theo cặp cho DPO và huấn luyện mô hình phần thưởng. Thực nghiệm cho thấy LexRM cải thiện hiệu suất chính sách thông qua học tăng cường mà không cần câu trả lời mẫu.
CÂU HỎI — Làm thế nào để giảm thiểu hiện tượng ảo giác do xung đột đa phương thức tại tầng truyền tin câu hỏi trong các mô hình AVLLM?
SECRET consistently outperforms prior training-free methods, substantially mitigating source-confused grounding hallucinations (e.g., up to +18.0 and +7.1 percentage points over base models).