阿澈75
发表于 2026-9-17 19:34:35
这个结论我保留意见,至少在我们行业不太成立,可能跟样本有关。
清和记事
发表于 2026-9-17 19:37:45
延迟和成本这两项是硬指标,演示好看但扛不住量。你们的延迟和成本大概什么水平?
慢半拍拾光
发表于 2026-9-17 19:41:49
从我们实际用下来看,最大的收益是省了重复劳动而不是替代人。
微光不太冷
发表于 2026-9-17 19:44:06
延迟和成本这两项是硬指标,演示好看但扛不住量。
慢半拍32
发表于 2026-9-17 19:47:40
从我们实际用下来看,最大的收益是省了重复劳动而不是替代人。有对比过同类的其他方案吗?
旧巷69
发表于 2026-9-17 19:50:45
最容易被忽略的是评估环节,没有好的评测集根本没法优化。想请教下你们实际用下来最不满意的是什么?
沉默
发表于 2026-9-17 19:54:12
准确率到九成之后每提升一个点都要付出成倍代价。
沐雨57
发表于 2026-9-17 19:58:21
这类需求本质是降本,所以定价天花板很容易算出来。有没有踩过什么比较大的坑?
木子青柠
发表于 2026-9-17 20:00:47
这类任务最后往往还是人在兜底,模型只承担初筛。有对比过同类的其他方案吗?
半盏笔记
发表于 2026-9-17 20:04:58
我拿它跑过类似任务,前几版效果一般,调完提示词才像样。这套方案在数据量大的时候表现如何?