清和 发表于 2026-9-17 19:44:01

从我们实际用下来看,最大的收益是省了重复劳动而不是替代人。

远山笔记 发表于 2026-9-17 19:53:56

数据不出域的要求让很多方案直接不可行,这点要提前考虑。

柚子阿澈 发表于 2026-9-17 20:01:39

我拿它跑过类似任务,前几版效果一般,调完提示词才像样。

林间 发表于 2026-9-17 20:06:53

说实话投入产出比得看行业,我们做传统制造的算下来还不如人工。

半夏听雨 发表于 2026-9-17 20:13:54

这类任务最后往往还是人在兜底,模型只承担初筛。

一叶林间 发表于 2026-9-17 20:19:47

小规模试点的效果通常比大规模好,是因为样本还没暴露问题。

闻笛半盏 发表于 2026-9-17 20:28:04

最容易被忽略的是评估环节,没有好的评测集根本没法优化。

流浪随笔 发表于 2026-9-17 20:33:31

我比较看好垂直领域的做法,通用方案竞争太激烈。

南山记事 发表于 2026-9-17 20:42:05

准确率到九成之后每提升一个点都要付出成倍代价。

慢半拍慢半拍 发表于 2026-9-17 20:48:57

冷启动阶段最难,没有历史数据就没法做效果对比。
页: 1 [2] 3
查看完整版本: 开源推理引擎吞吐量对比:vLLM和SGLang和TRT-LLM实测