vLLM tích hợp hỗ trợ TPU và cải thiện hiệu suất phục vụ mô hình
vllm integrates TPU support and boosts model serving performance
3 tài khoản độc lập
20 bài
6 bài viết
3.623 tương tác
vllm
@GithubProjects
@dani_avila7
@rohanpaul_ai
@vllm_project
@NetEaseYouDaoAI
@aiDotEngineer
@fraserpricee
@inferact
netease-youdao/Confucius4-R2T2 · Hugging Face huggingface.co
netease-youdao/Confucius4-R2T2 huggingface.co