Claude Code officially launches Cloud sessions out of research preview
Claude Code đã chính thức đưa các phiên bản Cloud sessions ra khỏi giai đoạn thử nghiệm nghiên cứu, cho phép duy trì hoạt động ngay cả khi máy tính đã đóng. Nền tảng này cung cấp các khoản tín dụng dùng thử một lần là 100 USD cho gói Pro và 250 USD cho gói Max.
OpenAI rolls out GPT-6 Sol and Luna models to paid users
OpenAI đã triển khai hai mẫu GPT-6 Sol và Luna cho các gói ChatGPT Work, Codex, Plus, Pro, Business, Enterprise và Edu. Cả hai mô hình này cũng được cung cấp thông qua API.
Google introduces Gemini 3.8 Flash TTS and Flash-Lite TTS audio generation models
Google đã giới thiệu Gemini 3.8 Flash TTS và Gemini 3.8 Flash-Lite TTS, các mô hình tạo âm thanh biểu cảm mới hỗ trợ 100 ngôn ngữ. Các mô hình này cung cấp hơn 2.000 giọng nói sẵn sàng cho sản xuất cùng các tính năng thiết kế và sao chép giọng nói mới.
ChatGPT Voice gains support for plugins and expands tiers
ChatGPT Voice đã được cập nhật để hỗ trợ các plugin như email, lịch và Slack. Tính năng này hoạt động cùng với các mô hình GPT-6 Astra, Sol và Luna trên nền tảng ChatGPT Work cho cả web và di động.
Hugging Face releases Nemotron 3 Diarization speech tracking model
Hugging Face đã phát hành mô hình Nemotron 3 Diarization với 100 triệu tham số, có khả năng theo dõi tối đa tám người nói ngay cả khi giọng nói chồng chéo lên nhau. Đồng thời, tổ chức này cũng đang tiến hành rà soát toàn diện về việc các tác nhân AI truy cập Internet trong quá trình huấn luyện và đánh giá.
Tesseract creative suite launches with direct integration for Astra AI agents
Ứng dụng After Effects và Premiere đã được xây dựng lại dưới tên Tesseract để tích hợp trực tiếp với các tác nhân AI Astra và Sol. Nền tảng này cung cấp quyền truy cập trực tiếp vào công cụ sáng tạo để xử lý các tác vụ đồ họa và dựng hình.
Microsoft integrates GPT-6 models and Autopilot into GitHub Copilot
Microsoft đã phát hành bản cập nhật lớn cho GitHub Copilot, bổ sung tính năng Autopilot chủ động cùng hai mô hình GPT-6 Sol và GPT-6 Luna. Các mô hình mới được thiết kế để hỗ trợ lập trình tương tác, tác tử và tối ưu chi phí.
Anthropic releases the Claude Opus 5.5 language model
Anthropic đã giới thiệu Claude Opus 5.5, mẫu đầu tiên trong dòng Claude 5.5. Mô hình này mang lại hiệu suất tương đương dòng Fable 5.1 nhưng có chi phí vận hành thấp hơn 40% so với phiên bản Opus 5 trước đó.
Muse unveils Muse Charm hardware device and expands agent ecosystem
Tác tử cá nhân Muse công bố hợp tác với Shopify, Expedia và PayPal để tích hợp tính năng mua sắm và đặt phòng. Nền tảng này cũng giới thiệu Muse Charm, một thiết bị phần cứng gắn chìa khóa dự kiến giao hàng vào tháng 12.
SpaceXAI launches Grok 4.7 model with coding capabilities and low cost
SpaceXAI đã phát hành Grok 4.7, đạt 46 điểm trên Chỉ số Trí tuệ Artificial Analysis và vượt qua GPT-5.6 Sol trong bảng xếp hạng Coding Agent Index. Mô hình này định vị SpaceXAI ở vị trí thứ ba trong số các phòng thí nghiệm AI.
Sakana AI introduces Agora-2 world model and appoints Jürgen Schmidhuber
Sakana AI công bố Agora-2, mô hình thế giới đa tác tử hỗ trợ tối đa 20 con người và tác tử tương tác trong môi trường thời gian thực. Công ty cũng đón nhận Jürgen Schmidhuber làm Giám đốc Cố vấn Khoa học.
Grok 4.7 xHigh Reaches Competitive Scores on Benchmarks
Grok 4.7 xHigh đạt 58% trên bảng xếp hạng AA-Briefcase của Artificial Analysis, chỉ kém một điểm so với Claude Fable 5.1 Max ở vị trí dẫn đầu. Trong khi đó, mô hình Pixel Canary vừa ra mắt ghi nhận hiệu năng ngang bằng GPT-6 Astra trong các tác vụ phát triển web và di động.
Apple and Developers Release New Open-Source Models
Apple đã phát hành trên Hugging Face một mô hình tinh chỉnh dựa trên Qwen3.5-9B giúp chuyển đổi tài liệu dài thành hình ảnh trang nhỏ để tiết kiệm token. Bên cạnh đó, nhiều nhà phát triển cũng giới thiệu các biến thể như tev1-4B-experimental và PrismML Bonsai 2 27B nhằm tối ưu hóa bộ nhớ và hiệu năng chạy cục bộ.
Research on Self-Evolving Ontologies Boosts Agent Performance
Một nghiên cứu mới chứng minh việc áp dụng tầng ontology cho các tác nhân AI giúp cải thiện đáng kể hiệu năng. Cụ thể, GPT-5.5 đạt mức tăng 26,7 điểm trên DDR-Bench khi được tích hợp các ontology tự tiến hóa.
DeepSeek Training a 2T Model with Hardware Expansion Plans
DeepSeek đang tiến hành huấn luyện một mô hình 2 nghìn tỷ tham số và lên kế hoạch cho một mô hình 8 nghìn tỷ tham số trong tương lai. Công ty cũng dự kiến nhận các lô hàng chip huấn luyện mới của Huawei vào cuối năm 2026 hoặc đầu năm 2027.
Google đã chính thức ra mắt dòng máy tính xách tay mới mang tên Googlebook, mở rộng danh mục phần cứng bên cạnh các dòng Pixelbook và Chromebook hiện có nhằm đáp ứng nhu cầu làm việc đa dạng của người dùng.
OpenRouter launches new models and integrations for high-speed decision making
OpenRouter bổ sung các mô hình mới như Space Bunny Alpha, Jev của Typesafe AI với tốc độ vượt trội và dòng Xiaomi MiMo-V2.6 hỗ trợ ngữ cảnh 1 triệu token. Các mô hình này mang lại khả năng xử lý đa phương thức gồm văn bản, hình ảnh, video và âm thanh.
3 tài khoản độc lập37 bài1 bài viết14.451 tương tác
Xiaomi releases MiMo-V2.6-Pro achieving top open weights performance
Xiaomi ra mắt MiMo-V2.6-Pro, vươn lên dẫn đầu nhóm mô hình mã nguồn mở trên Artificial Analysis Intelligence Index với chi phí 0,13 USD cho mỗi nhiệm vụ. Mô hình sử dụng kiến trúc Grouped Query Attention cổ điển và đạt hiệu năng cao trong các bài kiểm tra.
System One models drive new custom agent harnesses and optimization tools
Sự xuất hiện của các mô hình System One như Jev và Contrastive Language Model (CLM) thúc đẩy việc phát triển các harness tùy chỉnh cho tác vụ AI. Các công cụ như ReAnchor tích hợp phương pháp DSPy để tối ưu hóa hiệu suất xác thực và tốc độ xử lý.
Google DeepMind publishes new essays on agent swarms and AGI orchestration
Google DeepMind công bố ba bài luận tập trung vào việc kiểm soát hành vi bất thường trong các đàn tác phòng thí nghiệm, cách phối hợp mạng lưới phức tạp giữa AI và con người, cùng chiến lược phân bổ công bằng lợi ích từ AGI.
vLLM and SGLang add day-zero support for new Xiaomi and GLM models
vLLM triển khai hỗ trợ ngày đầu cho dòng mô hình Xiaomi MiMo-V2.6 gồm bản Pro với 1,02 nghìn tỷ tổng tham số và bản Flash với 309 tỷ tham số. Đồng thời, hệ thống đạt tốc độ giải mã 469 token/giây trên phần cứng AMD bằng thiết lập phân rã.
New methods improve agent skill evolution and reinforcement learning environments
Cộng đồng nghiên cứu giới thiệu các phương pháp mới giúp cải tiến kỹ năng tác nhân AI bằng cách xếp hạng ứng viên thông qua mô hình ngôn ngữ, tiết kiệm từ 40% đến 70% chi phí token. Các công trình như Skill2Env từ NVIDIA cũng chuyển hóa kỹ năng thành môi trường học tăng cường.
Alibaba outlines data center expansion plans as Multilingual TTS Arena launches
Alibaba đặt mục tiêu đạt công suất trung tâm dữ liệu toàn cầu 20 gigawatt vào năm 2032 cùng kế hoạch phát triển dòng mô hình Qwen quy mô từ 5 đến 10 nghìn tỷ tham số và chip AI thế hệ mới. Trong khi đó, bảng xếp hạng Multilingual TTS Arena ra mắt để đánh giá các mô hình chuyển đổi văn bản thành giọng nói trên 9 ngôn ngữ.
CÂU HỎI — Liệu một AI research agent có thể tự cải thiện hiệu suất nghiên cứu của chính nó thông qua việc tự động tối ưu hóa code nguồn của bản thân qua các vòng lặp?
AIDE^2 thực hiện đợt chạy tự động trong 8 ngày để tối ưu hóa code nghiên cứu của chính nó.
CÂU HỎI — Các tác nhân hiện đại thực sự tuân theo ngôn ngữ hay chỉ tận dụng cấu trúc khung cảnh có độ entropy thấp?
Evaluation of nine VLA and WAM policies shows that strong L0 performance, where attained, does not reliably transfer to L1--L3 under our fine-tuning setup.
CÂU HỎI — Kiến trúc Mixture-of-Experts của Hunyuan-A13B tối ưu hóa hiệu năng inference và độ phức tạp tính toán như thế nào?
It contains 80 billion total parameters but activates only 13 billion during inference, balancing model capability, computational efficiency, and deployment cost.
CÂU HỎI — Làm thế nào để cải thiện khả năng lập kế hoạch điện ảnh ở cấp độ shot trong các text-to-video generator thông qua mô hình prompt enhancement?
WanPE là một prompt enhancement model có quy mô 397B-parameter huấn luyện trên 1,05M video.
CÂU HỎI — Liệu các video generation model có sẵn năng lực object permanence, và việc train chúng bằng dataset dựa trên cognitive science có cải thiện được tính vật lý này không?
WROP bao gồm 150 task thiết kế thủ công chia thành sáu danh mục nhận thức.
CÂU HỎI — Các định luật và ràng buộc vật lý được tích hợp vào các thuật toán học máy cho robot như thế nào?
We adopt a unified taxonomy that classifies existing approaches according to their physics embedding: physics-guided inputs, data, and representations; physics-encoded model architectures; and physics-informed training loss functions.
CÂU HỎI — Làm thế nào để xây dựng một tập dữ liệu quy mô lớn với chú thích độ trung thực cao nhằm cải thiện phân đoạn ngữ nghĩa RGB-D?
RGBD20K offers 20,000 RGB-D image pairs, providing a substantially larger training resource that benefits the development of more powerful deep models.