明确表示「这一步不用生成式AI」的作品,反而拿到了更高的评价。
VitaSort按紧急度重排门诊队列,却不把这个判断交给生成式模型,而是采用确定性的NEWS2评分,优先保证行为可预期。Toddle AI在33个关键点的姿态估计之后套用确定性的步态分析,并且明确声明这是研究原型而非诊断工具。DocSync有把握就提MR,没把握就转成Issue交回给人。OpenMRS的问诊系统则把「临床人员先核对再采用」写进了流程前提。
这些作品设计的都不是「AI用到什么程度」,而是「在哪里停下」。黑客松的评价容易滑向自动化程度,而反方向的判断反倒突出,说明评委在脑中模拟的是真实运行。在医疗、人事这类出错代价高昂的领域,没定好停在哪里的作品,根本没法投入使用。
可以怎么做:找出作品里你最不想出错的那一处,只把那一处换成确定性逻辑或人工确认。然后在演示中明确说明这个取舍。「这一步我们没交给AI」这句话,不会被当成技术上的退让,而会被当成你理解这个领域的证据。