推荐链接
 
 

 

LLM智能体(Agent)评测   AI 
 
zhgx 发布于 2026-7-27  浏览 506    1次

 LLM智能体(Agent)评测的核心维度,包括工具调用(正确性与效率)、自主工作流(任务完成度)和推理能力

AI Agent评测基准大揭秘:智能体的“体检标准” 
2026-8-6  lpt   浏览 180  1次 
智能体(AI Agent)评测体系研究 
2026-8-6  lpt   浏览 168  1次 
大模型评测工具OpenCompass使用方法总结 
2026-8-6  lpt   浏览 129  1次 
EvalScope模型压力测试实战 - 指南 
2026-8-6  lpt   浏览 37  1次 
AI Agent评测基准大揭秘:智能体的“体检标准” 
2026-8-4  lpt   浏览 81  1次 
Agent辅助测试进行接口测试 
2026-8-3  lpt   浏览 82  1次 
如何有效测试AI Agents  
2026-7-29  lpt   浏览 213  2次 
LangSmith 集成实战:从追踪到评估的完整指南 
2026-7-28  lpt   浏览 205  2次 
LLM 智能体评测:工具使用、任务完成度、自主推理能力等多维度考察 
2026-7-27  lpt   浏览 231  2次 
课程:AI 赋能—智能系统测试方法与工具 
2026-9-18  lpt   浏览 6  1次 
软件测试高阶 | 从自动化到智能化测试 
2026-7-30  lpt   浏览 65  1次 
课程:大模型与智能体赋能测试质量&效能提升 
2026-7-30  lpt   浏览 84  1次 
我要解答 推荐链接 添加附件
 
基于大模型的Agent技术实践
10月22-23日 在线