Radar AI và agent. Mỗi sáng một lần, và chỉ những gì nhiều nguồn độc lập cùng nói.
Tổng hợp trong ngàydo mô hình viết
01Nền tảng lập trình tích hợp mô hình…Các nền tảng lập trình nhanh chóng cập nhật mô hình mới, khi cả Cursor và Devin đều tích hợp Claude Opus 5.5 bên cạnh việc Devin bổ sung GPT-6 Sol và Luna.→ 1019
02Trợ lý AI mở rộng tích hợp pluginCác trợ lý AI mở rộng ứng dụng thực tế thông qua công cụ ngoài, khi ChatGPT Voice tích hợp plugin, Muse liên kết thương mại điện tử và Anthropic hỗ trợ phát triển plugin Claude.→ 030410
03Tăng cường kiểm soát tác tử tự độngCác đơn vị AI đang siết chặt kiểm soát hệ thống tự hành khi Hugging Face rà soát quyền truy cập internet của agent sau sự cố, còn Google DeepMind nghiên cứu kiểm soát sai lệch trong mạng lưới agent.→ 0509
04MiMo-V2.6 dường như nhanh chóng được đón nhậnSau khi Xiaomi ra mắt MiMo-V2.6-Pro, dòng mô hình này dường như nhanh chóng nhận được hỗ trợ từ hệ sinh thái khi vLLM hỗ trợ ngày đầu và OpenRouter tích hợp vào nền tảng.→ 222325
Video trong ngày
cuộn số 2 · 0:47
NHÃNarchitecture · 19 tiếng nói
Anthropic ra mắt mô hình Claude Opus 5.5
Anthropic đã giới thiệu Claude Opus 5.5, mẫu mô hình mới trong dòng Claude 5.5 mang lại hiệu suất tương đương dòng Fable nhưng với chi phí vận hành thấp hơn 40%. Mô hình này cải thiện đáng kể hiệu quả sử dụng token và tốc độ xử lý tác vụ.
Investigation reveals ties between former Anthropic researcher and PR firm
Các nguồn tin cho biết cựu nghiên cứu viên của Anthropic có liên quan đến một công ty quan hệ công chúng khi khởi động chiến dịch cảnh báo rủi ro AI. Trong khi đó, phòng thí nghiệm sinh học phân tử của Anthropic đang sử dụng Claude để thúc đẩy nghiên cứu cơ bản.
Claude Code updates cloud sessions and usage limit management
Claude Code bổ sung tính năng tự động tìm điểm dừng an toàn khi người dùng đạt giới hạn năm giờ và chính thức đưa các phiên đám mây ra khỏi giai đoạn nghiên cứu. Nền tảng cũng cập nhật chính sách tính phí cho các yêu cầu bị bộ lọc chặn ở các danh mục có tỷ lệ sai sót thấp.
ChatGPT Voice integrates plugins and introduces new pricing tiers
Tính năng giọng nói của ChatGPT bổ sung hỗ trợ tích hợp các plugin bên ngoài như email, lịch và công cụ nhắn tin. Đồng thời, nền tảng chuẩn bị ra mắt các cấu trúc giá và gói cước mới nhằm đáp ứng nhu cầu sử dụng đa dạng của người dùng.
Muse app partners with commerce and travel platforms
Ứng dụng trợ lý AI Muse công bố hợp tác với các nền tảng thương mại điện tử và dịch vụ du lịch để tích hợp tính năng thanh toán trực tiếp và hỗ trợ người dùng lên kế hoạch chuyến đi. Tuy nhiên, ứng dụng cũng vấp phải những phản ứng trái chiều liên quan đến tính bảo mật dữ liệu cá nhân.
Expanded review of AI agent activities following security incident
Quá trình đánh giá sâu rộng về việc sử dụng internet của các tác tử AI trong quá trình huấn luyện và đánh giá đang diễn ra sau sự cố tại Hugging Face. Đồng thời, các mô hình phân tách giọng nói mới tiếp tục được ra mắt để xử lý nhiều người nói.
Codex resolves service outage and updates visual processing features
Nền tảng Codex vừa khắc phục xong sự cố kỹ thuật gây gián đoạn dịch vụ diện rộng. Đồng thời, các nhà phát triển đã sửa lỗi liên quan đến khả năng hiểu hình ảnh trong các phiên bản mô hình mới, giúp cải thiện hiệu suất xử lý các tác vụ trực quan.
Google launches new Gemini Flash audio model variants
Google giới thiệu các mô hình âm thanh mới thuộc dòng Gemini Flash phục vụ cho sản xuất sáng tạo và tổng hợp giọng nói quy mô lớn. Các mô hình này cung cấp hàng nghìn giọng nói sẵn sàng cho môi trường sản xuất, hỗ trợ đa ngôn ngữ và khả năng nhân bản giọng nói.
Microsoft releases major GitHub Copilot update featuring Autopilot
Microsoft đã công bố bản cập nhật lớn cho GitHub Copilot, giới thiệu tính năng Autopilot mới và mở rộng dòng mô hình GPT-6 với sự xuất hiện của hai phiên bản Sol và Luna. Ứng dụng Copilot mới cũng được tích hợp các chế độ Home, Code và Copilot.
Google releases essays on managing agent swarms and AGI distribution
Google DeepMind đã công bố ba bài tiểu luận mới tập trung vào việc kiểm soát hành vi sai trái trong các mạng lưới agent, điều phối hệ thống phức tạp và đảm bảo phân phối lợi ích AGI một cách công bằng. Các nghiên cứu này nhằm giải quyết thách thức điều phối mạng lưới AI quy mô lớn.
Anthropic đã giới thiệu Claude Opus 5.5, mẫu mô hình mới trong dòng Claude 5.5 mang lại hiệu suất tương đương dòng Fable nhưng với chi phí vận hành thấp hơn 40%. Mô hình này cải thiện đáng kể hiệu quả sử dụng token và tốc độ xử lý tác vụ.
xAI expands features and upgrades the Grok model family
xAI ghi nhận sự tăng trưởng mạnh mẽ của hệ thống Grok đồng thời công bố phiên bản Grok 4.7 với tốc độ xử lý nhanh, chi phí thấp và năng lực lập trình agent ấn tượng. Hệ thống này cũng được bổ sung các tính năng mới hỗ trợ quản lý tài chính.
8 tài khoản độc lập110 bài1 lab2.318.146 tương tác
OpenAI đã chính thức phát hành GPT-6 Sol và GPT-6 Luna, hai mẫu mô hình được phát triển dựa trên nền tảng công nghệ của GPT-6 Astra nhằm cung cấp giải pháp nhanh hơn và tiết kiệm hơn cho công việc chuyên môn, lập trình và căn chỉnh.
Labs release new models and scientific agent benchmark leaderboards
Cộng đồng AI đã ra mắt bảng xếp hạng Terminal-Bench-Science 0.1 cho các agent nghiên cứu khoa học, cùng với thông tin về các mô hình mới đang được huấn luyện tại DeepSeek. Ngoài ra, nhiều mô hình tối ưu chi phí như Gemini 3.8 Flash và các biến thể mã nguồn mở cũng được phát hành trên các nền tảng serverless.
OpenAI and xAI announce model lineups and benchmark improvements
Các mô hình mới như GPT-6 Sol và Luna chính thức ra mắt với mức giá API thấp hơn, trong khi các hệ thống từ xAI đạt thứ hạng cao trên các bảng chỉ số đánh giá trí tuệ nhân tạo và lập trình.
Sakana AI appoints chief scientific advisor and introduces real-time world models
Sakana AI bổ nhiệm chuyên gia làm Cố vấn Khoa học Trưởng để thúc đẩy nghiên cứu về học meta và mô hình thế giới. Đồng thời, các đơn vị công nghệ cũng giới thiệu Agora-2 và PixVerse R2, những mô hình thế giới hỗ trợ tương tác thời gian thực.
SpaceXAI releases Grok 4.7 powered by NVIDIA accelerated computing
SpaceXAI chính thức phát hành Grok 4.7, mẫu mô hình tiên tiến nhất cho công việc tri thức và lập trình. Quá trình phát triển và vận hành mô hình này nhận được sự hỗ trợ trực tiếp từ hạ tầng tính toán tăng tốc của NVIDIA.
Google launches the Googlebook laptop line and new Gemini features
Google đã giới thiệu dòng laptop Googlebook trang bị màn hình cảm ứng OLED 2.8K và thời lượng pin 14 giờ. Bên cạnh đó, hãng tích hợp mô hình Gemini Omni 1.1 Flash vào ứng dụng Google Vids và công bố các tính năng mới trên Chrome hỗ trợ học sinh.
Moonshot AI and Google partner to test AI chips in space
Google và các đối tác triển khai sứ mệnh vệ tinh thử nghiệm Project Suncatcher để đánh giá khả năng chịu đựng của các chip xử lý tensor trong môi trường khắc nghiệt ngoài không gian.
Devin crosses revenue milestone and rolls out model integrations
Nền tảng Devin đạt mốc một tỷ USD doanh thu định mức hàng năm và bổ sung hỗ trợ các mô hình mới như GPT-6 Sol, GPT-6 Luna và Claude Opus 5.5. Hệ thống cũng cập nhật tính năng Devin Cloud trong dòng lệnh cùng khả năng tích hợp Microsoft 365.
Launch of the Imp self-improving language model programming system and Jev routing
Hệ thống Imp, bản chuyển thể của DSPy dành cho hệ sinh thái BEAM, đã được phát hành nhằm hỗ trợ lập trình mô hình ngôn ngữ tự cải thiện mang tính khai báo. Bên cạnh đó, mô hình System One mang tên Jev xuất hiện dưới dạng bộ định tuyến đóng gói.
Discussions on Mistral AI's model strategy and the European AI landscape
Cộng đồng công nghệ thảo luận về định hướng chiến lược của Mistral AI khi hãng chuyển trọng tâm khỏi các mô hình biên. Các ý kiến cũng đề cập đến năng lực cạnh tranh của châu Âu và sự phát triển của các mô hình nhỏ dạng chuyên gia hỗn hợp (MoE).
OpenRouter integrates new models including Space Bunny Alpha, Jev, and Xiaomi MiMo-V2.6
Nền tảng OpenRouter đã bổ sung nhiều mô hình mới vào danh mục phục vụ người dùng, bao gồm mô hình đa phương thức Space Bunny Alpha, mô hình System One Jev, dòng sản phẩm Xiaomi MiMo-V2.6 với ba phiên bản và mô hình trọng lượng mở Kev 4B.
4 tài khoản độc lập36 bài1 bài viết12.274 tương tác
Xiaomi launches MiMo-V2.6-Pro, topping open weights benchmark indexes
Xiaomi ra mắt MiMo-V2.6-Pro, vươn lên vị trí dẫn đầu trong số các mô hình open weights trên Artificial Analysis Intelligence Index với mức giá 0,13 USD cho mỗi tác vụ. Mô hình này được huấn luyện qua quá trình học tăng cường trên cụm 10.000 GPU trong 5 ngày.
Debate intensifies over security risks and the role of open-source AI models
Cộng đồng công nghệ thảo luận về các rủi ro bảo mật liên quan đến mô hình mã nguồn mở và nguồn lực tính toán. Các ý kiến xoay quanh việc liệu các hệ thống mã nguồn mở có làm gia tăng các mối đe dọa an mạng hay đóng vai trò phòng thủ.
vLLM adds day-one support for the multimodal MiMo-V2.6 model family
Khung vận hành vLLM công bố hỗ trợ ngày đầu cho cả hai phiên bản MiMo-V2.6 Pro và Flash. Dòng mô hình Mixture-of-Experts này tích hợp văn bản, hình ảnh, video và âm thanh với kích thước lần lượt là 1,02T tổng tham số (42B hoạt động) và 309B (15B hoạt động), hỗ trợ ngữ cảnh 1M.
Cohere expands Model Vault private AI deployment services in Canada
Công ty Cohere triển khai dịch vụ Model Vault tại Canada, mang đến khả năng kiểm soát hoàn toàn các khối lượng công việc tự động co giãn, kiến trúc đơn thuê và tổng chi phí sở hữu thấp hơn cho các mô hình của hãng.
NVIDIA and developers release new frameworks for evolving AI agent skills
NVIDIA cùng các nhà phát triển công bố các phương pháp mới nhằm tiến hóa kỹ năng của AI agent, giúp giảm chi phí token từ 40% đến 70% so với các phương pháp hiện tại. Đồng thời, các công cụ và cấu hình mã nguồn mở cho hệ thống agent cũng được phát hành.
CÂU HỎI — Làm thế nào để xử lý các luồng dữ liệu mở rộng với số lượng phần tử biến đổi trong các đường ống chuẩn bị dữ liệu mô hình nền tảng mà vẫn duy trì được quan hệ phả hệ (lineage) trên GPU?
RayOrch achieves 15.14 times speedup when scaling MinerU from 4 to 64 GPUs and 7.82 times speedup when scaling a video pipeline from 8 to 64 GPUs.
CÂU HỎI — Làm thế nào để tích hợp các thông tin tiền huấn luyện quy mô lớn về động lực học hình ảnh, ngữ cảnh và hình học vào một mô hình tác động thế giới thống nhất cho robot thao tác?
The resulting corpus contains over 20K hours of processed training data, to our knowledge the largest open-source corpus of its kind.
CÂU HỎI — Làm thế nào để ngăn chặn hiện tượng suy giảm tính cá nhân hóa (personalization collapse) khi LLM được yêu cầu tuân theo các chỉ dẫn phong cách rõ ràng?
Chỉ dẫn phong cách rõ ràng có thể gây ra personalization collapse, làm suy yếu sở thích cá nhân hóa của user.
CÂU HỎI — Làm thế nào để giảm khoảng cách giữa khả năng tái tạo và khả năng sinh ảnh trong các representation autoencoders (RAEs) mà không cần chỉnh sửa encoder được huấn luyện trước?
Decoder replacement alone reduces unguided gFID by 27% with an unchanged RAEv2 DiT-XL generator.
CÂU HỎI — Làm thế nào để chuyển đổi các tương tác tay người từ video thành chính sách điều khiển thị giác-vận động zero-shot trên robot thực tế một cách khả thi về mặt động lực học?
MMO cải thiện contact F1 cao hơn ít nhất 8 điểm so với 5 baseline trên mọi loại bàn tay robot.
CÂU HỎI — Làm thế nào để đánh giá chiến lược của các mô hình ngôn ngữ lớn thông qua các trò chơi cạnh tranh đối kháng liên tục phát triển?
Tác giả giới thiệu Kaggle Game Arena, một nền tảng mở nhằm đánh giá các mô hình ngôn ngữ lớn (LLM) thông qua các trận đấu đối đầu trực tiếp trong môi trường trò chơi có cấu trúc để tránh tình trạng bão hòa hiệu suất. Báo cáo kỹ thuật này mô tả cơ sở hạ tầng phía sau Game Arena cùng với ba môi trường trò chơi thí điểm gồm Cờ vua, Poker và Ma sói, bao trùm các bối cảnh thông tin hoàn hảo, thông tin không hoàn hảo và nhiều người chơi. Nền tảng này giúp nghiên cứu một cách có hệ thống khả năng lập kế hoạch chiến lược, thích ứng và độ bền bỉ của mô hình trong điều kiện bất định dựa trên đánh giá quy mô lớn có căn cứ thực tế.
CÂU HỎI — Làm thế nào để tạo ra các nhãn khoảng cách nhận thức điểm cho việc đánh giá chất lượng ảnh tham chiếu mà không cần bất kỳ sự can thiệp chú thích nào từ con người?
Bài báo đề xuất một đường ống tự động tạo nhãn khoảng cách nhận thức điểm giữa các cặp ảnh dựa trên động lực học sinh ra của các mô hình diffusion mà không cần chú thích thủ công từ con người. Ý tưởng cốt lõi tận dụng việc cấu trúc thô của ảnh xuất hiện ở các bước thời gian đầu và chi tiết tinh tế xuất hiện ở các bước sau. Khoảnh khắc rẽ nhánh trong quá trình sinh ảnh (FoMo) được dùng làm nhãn khoảng cách có căn cứ tham chiếu để giám sát việc huấn luyện một hệ thống đánh giá chất lượng ảnh. Các thử nghiệm xác nhận phương pháp này vượt qua các tập dữ liệu có con người chú thích trên nhiều tiêu chuẩn đánh giá.