山有木杂谈 发表于 2026-9-17 20:55:32

真正的成本在维护,模型换代太快,跟进要持续投人。

听风62 发表于 2026-9-17 21:02:24

开源方案胜在可控,闭源胜在省事,取舍看团队能力。

远山听风 发表于 2026-9-17 21:10:50

关键还是数据质量,模型再强喂垃圾也是白搭。

半盏笔记 发表于 2026-9-17 21:11:37

这类需求本质是降本,所以定价天花板很容易算出来。
页: 1 2 [3]
查看完整版本: 开源推理引擎吞吐量对比:vLLM和SGLang和TRT-LLM实测