推荐链接

 

 
 
  求知 文章 文库 Lib 视频 iPerson 课程 认证 咨询 工具 讲座 Model Center 汽车系统工程   模型库  
会员   
求知
 
      说问题,求答案

 
类别:AI    
 
vLLM内核解析        
 
zhgx 发布于 2026-8-6  浏览 68  
 

随着大语言模型(LLM)参数规模迈向千亿甚至万亿级别,如何高效、低延迟地将其部署上线,成为AI系统领域最核心的挑战之一。vLLM作为当前最炙手可热的高性能推理框架,通过一系列颠覆性的系统设计,在吞吐量和内存管理上实现了数量级的提升。

解答
我要解答 推荐链接 添加附件
一文拆透 vLLM:大模型高吞吐推理到底是怎么跑起来的?      2026-8-12  lpt   浏览 37 
大模型推理框架vLLM原理详解!      2026-8-6  lpt   浏览 56 
vLLM:让大语言模型推理更高效的新一代引擎 —— 原理详解与面试题解析      2026-8-6  lpt   浏览 44 
课程:AI智能体开发技术实践      2026-8-31  lpt   浏览 4 
 
 
公开课计划

知识图谱、本体论、RAG与大模型 8-22[在线]
企业架构方法与实践 8-27[深圳]
FDE(前沿部署工程师)实践指南 9-8[北京]
AI智能体开发技术实践 9-17[厦门]
UAF架构体系与实践 9-22[北京]
MBSE(基于模型的系统工程)9-29[北京]
更多 ...
能力培养&认证 更多...

成功案例 更多...