慢半拍笔记 发表于 2026-9-17 20:39:24

把工作流拆细之后,能自动化的比例其实没有想象中高。这套方案在数据量大的时候表现如何?

木子27 发表于 2026-9-17 20:41:21

这个结论我保留意见,至少在我们行业不太成立,可能跟样本有关。想问下上线之后效果有回落吗?

言默散记 发表于 2026-9-17 20:44:41

这类任务最后往往还是人在兜底,模型只承担初筛。

南山 发表于 2026-9-17 20:47:55

最容易被忽略的是评估环节,没有好的评测集根本没法优化。

一苇 发表于 2026-9-17 20:50:17

冷启动阶段最难,没有历史数据就没法做效果对比。有没有踩过什么比较大的坑?

半盏 发表于 2026-9-17 20:52:05

这种场景其实更依赖工程化,模型只是其中一环。你们的延迟和成本大概什么水平?

阿澈10 发表于 2026-9-17 20:53:56

效果好不好很看业务理解,纯技术视角容易跑偏。

木子青柠 发表于 2026-9-17 20:56:50

冷启动阶段最难,没有历史数据就没法做效果对比。

关山闲话 发表于 2026-9-17 20:58:59

我拿它跑过类似任务,前几版效果一般,调完提示词才像样。

浅夏不眠 发表于 2026-9-17 21:01:40

提示词工程能解决一部分,但解决不了根本的领域知识问题。
页: 1 2 3 [4] 5
查看完整版本: 微信语音发过来借钱?可能是AI克隆的