推荐链接
求知
文章
文库
Lib
视频
iPerson
课程
认证
咨询
工具
讲座
Model Center
汽车系统工程
模型库
会员
求知
说问题,求答案
类别:
AI
LLM智能体(Agent)评测
zhgx
发布于 2026-7-27
浏览
156
1次
LLM智能体(Agent)评测的核心维度,包括工具调用(正确性与效率)、自主工作流(任务完成度)和推理能力
解答
我要解答
自编
推荐链接
添加附件
AI Agent评测基准大揭秘:智能体的“体检标准”
2026-8-6 lpt 浏览 10
智能体(AI Agent)评测体系研究
2026-8-6 lpt 浏览 12
大模型评测工具OpenCompass使用方法总结
2026-8-6 lpt 浏览 10
AI Agent评测基准大揭秘:智能体的“体检标准”
2026-8-4 lpt 浏览 15
Agent辅助测试进行接口测试
2026-8-3 lpt 浏览 20
如何有效测试AI Agents
2026-7-29 lpt 浏览 94
1次
LangSmith 集成实战:从追踪到评估的完整指南
2026-7-28 lpt 浏览 94
1次
LLM 智能体评测:工具使用、任务完成度、自主推理能力等多维度考察
2026-7-27 lpt 浏览 106
1次
软件测试高阶 | 从自动化到智能化测试
2026-7-30 lpt 浏览 19
1次
课程:大模型与智能体赋能测试质量&效能提升
2026-7-30 lpt 浏览 20
1次
公开课计划
知识图谱、本体论、RAG与大模型 8-22[在线]
企业架构方法与实践 8-27[深圳]
FDE(前沿部署工程师)实践指南 9-8[北京]
AI智能体开发技术实践 9-17[厦门]
UAF架构体系与实践 9-22[北京]
MBSE(基于模型的系统工程)9-29[北京]
更多
...
能力培养&认证
更多
...
成功案例
更多
...