Artificial Analysis 开源 AA-AgentPerf-Local,测试本地 AI 智能体推理速度
AA-AgentPerf-Local 可在笔记本和工作站上重放真实智能体任务,帮助用户比较本地模型的推理配置。默认负载包含 8 项任务、168 次模型调用,上下文增长至约 56K tokens;初始结果覆盖四类硬件。默认测试跳过工具执行,以单独衡量推理速度。
公开测试代码、数据和配置,并用固定的智能体任务比较不同本地硬件,便于读者复现和评估部署选择。
Artificial Analysis 开源 AA-AgentPerf-Local,测试本地 AI 智能体推理速度
AA-AgentPerf-Local 可在笔记本和工作站上重放真实智能体任务,帮助用户比较本地模型的推理配置。默认负载包含 8 项任务、168 次模型调用,上下文增长至约 56K tokens;初始结果覆盖四类硬件。默认测试跳过工具执行,以单独衡量推理速度。
公开测试代码、数据和配置,并用固定的智能体任务比较不同本地硬件,便于读者复现和评估部署选择。
材料 9e2311288c0e491b81fb85ec7d5fa84d;建议 695075b6c91244bbaaa5d8dd035167a2;系统证据核验通过,非人工审稿。
前往原始出处阅读