茶白隔壁老王
发表于 2026-9-17 20:47:01
演示效果和稳定上线之间差着十万八千里。
南山记事
发表于 2026-9-17 20:50:31
现在工具链更新太快,半年前的最佳实践今年可能就过时了。
听风62
发表于 2026-9-17 20:55:20
最容易被忽略的是评估环节,没有好的评测集根本没法优化。
有点困
发表于 2026-9-17 20:58:52
从我们实际用下来看,最大的收益是省了重复劳动而不是替代人。
远山
发表于 2026-9-17 21:04:25
冷启动阶段最难,没有历史数据就没法做效果对比。
慢半拍拾光
发表于 2026-9-17 21:09:27
这种场景其实更依赖工程化,模型只是其中一环。想请教下你们实际用下来最不满意的是什么?
山有木杂谈
发表于 2026-9-17 21:10:37
推理成本算下来并不低,规模化之前得先把这块压下去。
有点困看海
发表于 2026-9-17 21:11:37
这种场景其实更依赖工程化,模型只是其中一环。