旧巷69
发表于 2026-8-30 00:09:54
最容易被忽略的是评估环节,没有好的评测集根本没法优化。
慢半拍慢半拍
发表于 2026-8-31 08:48:32
小团队做这个真不如直接用现成 API,自建维护成本太高。
南山铺子
发表于 2026-9-2 07:19:36
提示词工程能解决一部分,但解决不了根本的领域知识问题。
青柠79
发表于 2026-9-4 01:21:21
这类任务最后往往还是人在兜底,模型只承担初筛。
听风98
发表于 2026-9-5 11:37:55
把工作流拆细之后,能自动化的比例其实没有想象中高。有没有踩过什么比较大的坑?
浅夏笔记
发表于 2026-9-7 19:32:06
冷启动阶段最难,没有历史数据就没法做效果对比。
流浪随笔
发表于 2026-9-9 20:54:33
从我们实际用下来看,最大的收益是省了重复劳动而不是替代人。
秋刀小筑
发表于 2026-9-11 16:58:43
效果好不好很看业务理解,纯技术视角容易跑偏。
清和
发表于 2026-9-13 17:07:43
小规模试点的效果通常比大规模好,是因为样本还没暴露问题。
陆离
发表于 2026-9-15 18:05:41
开源方案胜在可控,闭源胜在省事,取舍看团队能力。想请教下你们实际用下来最不满意的是什么?