慢半拍笔记
发表于 2026-9-17 20:39:24
把工作流拆细之后,能自动化的比例其实没有想象中高。这套方案在数据量大的时候表现如何?
木子27
发表于 2026-9-17 20:41:21
这个结论我保留意见,至少在我们行业不太成立,可能跟样本有关。想问下上线之后效果有回落吗?
言默散记
发表于 2026-9-17 20:44:41
这类任务最后往往还是人在兜底,模型只承担初筛。
南山
发表于 2026-9-17 20:47:55
最容易被忽略的是评估环节,没有好的评测集根本没法优化。
一苇
发表于 2026-9-17 20:50:17
冷启动阶段最难,没有历史数据就没法做效果对比。有没有踩过什么比较大的坑?
半盏
发表于 2026-9-17 20:52:05
这种场景其实更依赖工程化,模型只是其中一环。你们的延迟和成本大概什么水平?
阿澈10
发表于 2026-9-17 20:53:56
效果好不好很看业务理解,纯技术视角容易跑偏。
木子青柠
发表于 2026-9-17 20:56:50
冷启动阶段最难,没有历史数据就没法做效果对比。
关山闲话
发表于 2026-9-17 20:58:59
我拿它跑过类似任务,前几版效果一般,调完提示词才像样。
浅夏不眠
发表于 2026-9-17 21:01:40
提示词工程能解决一部分,但解决不了根本的领域知识问题。