陆离
发表于 2026-9-12 22:49:41
评估标准不统一的话,各家都说自己效果好,没法比。想请教下你们实际用下来最不满意的是什么?
老猫笔记
发表于 2026-9-13 05:42:02
把工作流拆细之后,能自动化的比例其实没有想象中高。这套方案在数据量大的时候表现如何?
木子青柠
发表于 2026-9-13 16:27:27
小规模试点的效果通常比大规模好,是因为样本还没暴露问题。
慢半拍慢半拍
发表于 2026-9-14 01:37:15
真正的成本在维护,模型换代太快,跟进要持续投人。
慢半拍32
发表于 2026-9-14 14:04:16
开源方案胜在可控,闭源胜在省事,取舍看团队能力。有没有踩过什么比较大的坑?
隔壁老王煮酒
发表于 2026-9-15 00:13:49
真正跑通的案例里,投入的人力成本往往被忽略不计了。
远山笔记
发表于 2026-9-15 07:42:01
这类任务最后往往还是人在兜底,模型只承担初筛。想请教下你们实际用下来最不满意的是什么?
归鸟寻梅
发表于 2026-9-15 14:10:27
提示词工程能解决一部分,但解决不了根本的领域知识问题。想请教下你们实际用下来最不满意的是什么?
寒山观星
发表于 2026-9-15 22:32:26
合规问题比技术问题更棘手,很多场景卡在这一步。
寒山散记
发表于 2026-9-16 11:53:14
冷启动阶段最难,没有历史数据就没法做效果对比。你们的延迟和成本大概什么水平?