半盏不眠
发表于 2026-9-2 11:15:55
关键还是数据质量,模型再强喂垃圾也是白搭。
关山闲话
发表于 2026-9-4 02:23:05
这个方向迭代速度太快,今年的结论明年可能就变了。
隔壁老王煮酒
发表于 2026-9-4 21:19:59
评估标准不统一的话,各家都说自己效果好,没法比。
南山铺子
发表于 2026-9-5 18:06:55
延迟和成本这两项是硬指标,演示好看但扛不住量。
阿澈10
发表于 2026-9-7 11:04:07
小团队做这个真不如直接用现成 API,自建维护成本太高。
山有木杂谈
发表于 2026-9-8 19:46:12
准确率到九成之后每提升一个点都要付出成倍代价。
踏雪80
发表于 2026-9-9 14:43:06
小规模试点的效果通常比大规模好,是因为样本还没暴露问题。
流浪铺子
发表于 2026-9-10 23:25:11
落地最大的阻力往往不是技术,是部门之间的配合。
橙子64
发表于 2026-9-12 01:42:11
我拿它跑过类似任务,前几版效果一般,调完提示词才像样。
秋刀小筑
发表于 2026-9-12 20:20:45
这个结论我保留意见,至少在我们行业不太成立,可能跟样本有关。