标签:大语言模型评估
包含标签「大语言模型评估」的全部资源
共 3 个结果
大语言模型工具使用评估框架
MCP-Bench是一个通过模型上下文协议(MCP)评估大语言模型在工具使用场景能力的端到端基准测试框架。
本地部署
大语言模型评估
工具使用基准
02025-10-08 00:00:00
大语言模型工具使用评估框架
MCP-Bench是一个用于评估大型语言模型在工具使用场景中能力的综合框架,通过模型上下文协议(MCP)实现端到端的评估流程。
本地部署
大语言模型评估
工具使用评估
02025-12-17 00:00:00
大语言模型工具使用评估框架
MCP-Bench是一个通过模型上下文协议(MCP)评估大语言模型在工具使用场景能力的端到端基准测试框架,适用于AI代理开发和能力评估。
本地部署
大语言模型评估
工具使用基准
02025-09-01 00:00:00
