推荐链接

 

 
 
  求知 文章 文库 Lib 视频 iPerson 课程 认证 咨询 工具 讲座 Model Center 汽车系统工程   模型库  
会员   
求知
 
      说问题,求答案

 
类别:AI    
 
LLM智能体(Agent)评测        
 
zhgx 发布于 2026-7-27  浏览 156  
 1次

 LLM智能体(Agent)评测的核心维度,包括工具调用(正确性与效率)、自主工作流(任务完成度)和推理能力

解答
我要解答 推荐链接 添加附件
AI Agent评测基准大揭秘:智能体的“体检标准”      2026-8-6  lpt   浏览 10 
智能体(AI Agent)评测体系研究      2026-8-6  lpt   浏览 12 
大模型评测工具OpenCompass使用方法总结      2026-8-6  lpt   浏览 10 
AI Agent评测基准大揭秘:智能体的“体检标准”      2026-8-4  lpt   浏览 15 
Agent辅助测试进行接口测试      2026-8-3  lpt   浏览 20 
如何有效测试AI Agents       2026-7-29  lpt   浏览 94  1次 
LangSmith 集成实战:从追踪到评估的完整指南      2026-7-28  lpt   浏览 94  1次 
LLM 智能体评测:工具使用、任务完成度、自主推理能力等多维度考察      2026-7-27  lpt   浏览 106  1次 
软件测试高阶 | 从自动化到智能化测试      2026-7-30  lpt   浏览 19  1次 
课程:大模型与智能体赋能测试质量&效能提升      2026-7-30  lpt   浏览 20  1次 
 
 
公开课计划

知识图谱、本体论、RAG与大模型 8-22[在线]
企业架构方法与实践 8-27[深圳]
FDE(前沿部署工程师)实践指南 9-8[北京]
AI智能体开发技术实践 9-17[厦门]
UAF架构体系与实践 9-22[北京]
MBSE(基于模型的系统工程)9-29[北京]
更多 ...
能力培养&认证 更多...

成功案例 更多...