推荐链接

 

 
 
  求知 文章 文库 Lib 视频 iPerson 课程 认证 咨询 工具 讲座 Model Center 汽车系统工程   模型库  
会员   
求知
 
      说问题,求答案

 
类别:AI    
 
LLM智能体(Agent)评测        
 
zhgx 发布于 2026-7-27  浏览 436  
 1次

 LLM智能体(Agent)评测的核心维度,包括工具调用(正确性与效率)、自主工作流(任务完成度)和推理能力

解答
我要解答 推荐链接 添加附件
AI Agent评测基准大揭秘:智能体的“体检标准”      2026-8-6  lpt   浏览 144 
智能体(AI Agent)评测体系研究      2026-8-6  lpt   浏览 136 
大模型评测工具OpenCompass使用方法总结      2026-8-6  lpt   浏览 100 
EvalScope模型压力测试实战 - 指南      2026-8-6  lpt   浏览 27 
AI Agent评测基准大揭秘:智能体的“体检标准”      2026-8-4  lpt   浏览 72 
Agent辅助测试进行接口测试      2026-8-3  lpt   浏览 78 
如何有效测试AI Agents       2026-7-29  lpt   浏览 202  1次 
LangSmith 集成实战:从追踪到评估的完整指南      2026-7-28  lpt   浏览 194  1次 
LLM 智能体评测:工具使用、任务完成度、自主推理能力等多维度考察      2026-7-27  lpt   浏览 216  1次 
软件测试高阶 | 从自动化到智能化测试      2026-7-30  lpt   浏览 58  1次 
课程:大模型与智能体赋能测试质量&效能提升      2026-7-30  lpt   浏览 75  1次 
 
 
公开课计划

AI智能体开发实践 9-17厦门/10-22在线
OCSMP 认证培训 9-23[在线]
企业架构方法与实践 9-15[深圳]
UAF架构体系与实践 9-22[北京]
AI系统的测试方法与工具 9-17[北京]
AI时代的软件架构师培养 9-19[上海]
AI时代的需求分析师培养 10-20[北京]
更多 ...
能力培养&认证 更多...

成功案例 更多...