Các phòng thí nghiệm công bố mô hình mới và chuẩn đánh giá agent khoa học
Labs release new models and scientific agent benchmark leaderboards
Cộng đồng AI đã ra mắt bảng xếp hạng Terminal-Bench-Science 0.1 cho các agent nghiên cứu khoa học, cùng với thông tin về các mô hình mới đang được huấn luyện tại DeepSeek. Ngoài ra, nhiều mô hình tối ưu chi phí như Gemini 3.8 Flash và các biến thể mã nguồn mở cũng được phát hành trên các nền tảng serverless.
10 tài khoản độc lập
70 bài
1 bài viết
3 lab
34.495 tương tác
qwen3deepseek v4deepseekglmkv cachedeepseek v4 flashmixture of expertsqwen3.8
@AlexFinn
@ArtificialAnlys
@ClementDelangue
@EMostaque
@Hesamation
@OpenRouter
@PrismML
@alex_prompter
https://z.ai/ z.ai