vLLM · người xây sản phẩm · vllm ☆ THEO DÕI 31 chủ đề trong 14 ngày — inference, architecture, evaluation. trên X ↗
PHIẾU SỐ 2026-10-05 vLLM tích hợp hỗ trợ các mô hình mở mới và tối ưu hóa suy luận inference · 3 tiếng nói
PHIẾU SỐ 2026-10-04 Cohere ra mắt dòng mô hình Embed 5 và vLLM phát hành Semantic Router Decision 2.0 inference · 3 tiếng nói
PHIẾU SỐ 2026-09-30 Phát hành các mô hình và công cụ AI mới cho phân khúc nhẹ inference · 9 tiếng nói
PHIẾU SỐ 2026-09-28 Các phòng thí nghiệm công bố mô hình mới và chuẩn đánh giá agent khoa học evaluation · 10 tiếng nóivLLM hỗ trợ ngày đầu cho dòng mô hình đa phương thức MiMo-V2.6 inference · 4 tiếng nói
PHIẾU SỐ 2026-09-27 Grok 4.7 xHigh đạt 58% trên benchmark AA-Briefcase của Artificial Analysis evaluation · 7 tiếng nóiApple phát hành mô hình dựa trên Qwen3.5-9B tinh chỉnh xử lý văn bản architecture · 7 tiếng nóivLLM hỗ trợ ngày đầu cho Xiaomi MiMo-V2.6 và DiffusionGemma-Jev inference · 4 tiếng nói
PHIẾU SỐ 2026-09-26 Grok 4.7 xHigh đạt điểm số cạnh tranh trên các bảng xếp hạng evaluation · 7 tiếng nóiApple và các bên phát hành nhiều mô hình nguồn mở mới inference · 7 tiếng nóivLLM và SGLang bổ sung hỗ trợ ngày đầu cho các mô hình Xiaomi MiMo và GLM-5.3 inference · 3 tiếng nói
PHIẾU SỐ 2026-09-25 DeepSeek V4.1 Flash ra mắt cùng kế hoạch đào tạo mô hình 2T architecture · 9 tiếng nóiQwen ra mắt mô hình thông dịch thời gian thực Qwen3.8-LiveTranslate multimodal · 7 tiếng nói
PHIẾU SỐ 2026-09-24 Phát hành Ternary Bonsai 2 27B và mô hình dịch thuật thời gian thực Qwen3.8 inference · 8 tiếng nóiGrok 4.7 xHigh cạnh tranh đỉnh bảng và tiến triển mới của Kimi K3 evaluation · 7 tiếng nóiDeepSeek phát triển mô hình lớn và thông tin lộ trình huấn luyện phần cứng architecture · 6 tiếng nóiChạy mô hình trọng số mở cục bộ trên thiết bị phần cứng hạn chế inference · 4 tiếng nóiTối ưu hóa hệ thống suy luận và tăng tốc độ xử lý cho mô hình ngôn ngữ lớn inference · 3 tiếng nói
PHIẾU SỐ 2026-09-23 DeepSeek ra mắt V4.1-Flash và kế hoạch đào tạo các mô hình lớn mới inference · 8 tiếng nóiCộng đồng thảo luận các mô hình hỗn hợp chuyên gia và hạ tầng phục vụ architecture · 5 tiếng nóiCộng đồng AI tối ưu hóa mô hình nhỏ và hỗ trợ phần cứng cục bộ inference · 4 tiếng nóiXiaomi ra mắt mô hình MiMo-V2.6 với hỗ trợ vLLM ngay từ ngày đầu inference · 3 tiếng nói
PHIẾU SỐ 2026-09-22 Cộng đồng kỳ vọng Kimi K3 và hệ sinh thái mô hình MoE architecture · 7 tiếng nóiPrismML ra mắt Ternary Bonsai 2 27B nén từ Qwen3.8 27B inference · 6 tiếng nóiXiaomi ra mắt MiMo-V2.6 tích hợp đa phương thức với vLLM inference · 3 tiếng nói
PHIẾU SỐ 2026-09-21 Kimi chuẩn bị phát hành mô hình Kimi K3.1 architecture · 6 tiếng nóiHợp tác đưa TPU vào vLLM và các bản phát hành mô hình Ternary inference · 5 tiếng nói
PHIẾU SỐ 2026-09-20 vLLM tích hợp hỗ trợ TPU và cải thiện hiệu suất phục vụ mô hình inference · 3 tiếng nói
PHIẾU SỐ 2026-09-19 Cộng đồng thảo luận về các mô hình AI mã nguồn mở như GLM và Kimi ai · 9 tiếng nóiGoogle Cloud hợp tác đưa TPU vào vLLM và các bản phát hành mã nguồn mở system_design · 3 tiếng nói