是石科技披露 Meta-Infer 推理引擎优化结果
是石科技称,Meta-Infer 通过补齐高性能内核、重构通信和调整并行配置,在 8 张仅支持 PCIe 互联的显卡上,将 DeepSeek-V4.1-Flash 的输入吞吐从社区 Day0 基线的 1932 tok/s 提高到 13274 tok/s,约为原来的 6.87 倍。优化无需改动模型权重和结构;这些数字来自文中披露的测试。
是石科技披露 Meta-Infer 推理引擎优化结果
是石科技称,Meta-Infer 通过补齐高性能内核、重构通信和调整并行配置,在 8 张仅支持 PCIe 互联的显卡上,将 DeepSeek-V4.1-Flash 的输入吞吐从社区 Day0 基线的 1932 tok/s 提高到 13274 tok/s,约为原来的 6.87 倍。优化无需改动模型权重和结构;这些数字来自文中披露的测试。
材料 733fc89b277c4f7099fbf9c601f2b1d9;建议 b3489a53428844128f9adbe12f3fa522;系统证据核验通过,非人工审稿。
前往原始出处阅读