下一章 上一章 目录 设置
16、一场不会失败的验收 林照野打开 ...
-
林照野打开了研究版。
湿叶放到相机下,镜头先被水珠晃出一片白光。叶穗用纸巾吸干表面,重新拍摄。模型运行两秒,灰色框出现:
【无法判断,请人工复核。】
詹炜的表情没有变化。他朝徐专家笑道:“这是我们的可信拒识机制。”
徐专家盯着屏幕:“为什么刚才宣传片里每片都能识别?”
柏颂说:“宣传片是标准测试,现场是开放环境。系统针对分布外样本会主动转交专家。”
“那项目书里写真实复杂田间准确率九十八点一,属于哪一种?”
“内部标准数据集结果。”
“标准数据集为什么代表真实复杂田间?”
柏颂看向詹炜。
詹炜接过话:“九十八点一体现模型在已覆盖类别上的能力。开放环境还有长尾问题,正是项目未来三年重点攻关内容。”
“你们申请书前期基础写得像已经攻完了。”
“材料篇幅有限,重点突出主要进展。”
徐专家没有继续追。他把灰框页面拍照,又让叶穗拿出两片现场叶。一片健康,一片有虫咬。模型对健康叶输出健康,置信度八十三;虫咬叶输出不确定。
“这比乱报好。”他说,“保留这个版本。”
詹炜立即点头:“我们一直坚持可信路线。”
林照野看见柏颂低头在接待手册上划掉了展示版流程。
考察转入数据检查。专家组没有去驾驶舱,而是坐进小会议室,要求查看数据构成、标注规范和训练测试划分。
柏颂打开准备好的统计页:
总图像数十万零八百六十四;
覆盖作物十三类;
病害类别四十七;
标注准确率百分之九十九点二;
自主及合作采集比例百分之六十八。
徐专家问“自主及合作”各多少。
“平台以联合方式建设,暂未分开统计。”
“公开数据多少?”
“公开数据主要用于预训练。”
“具体多少?”
柏颂翻到下一页,展示数据增强流程。
徐专家没有跟着翻:“我问公开数据多少。”
叶穗坐在后排,电脑里有准确清单。柏颂没有叫她回答。
詹炜说:“原始公开数据约一万八千,经过清洗和增强进入基础库。自主及合作田间数据持续增加。”
“独立原图一共有多少?”
会议室安静下来。
“三万一千左右。”林照野回答。
柏颂立刻补充:“这是按极严格近似去重口径,图像库实际规模超过十万。”
“同一张图旋转十次算十张?”
“增强图参与训练,具有计算价值。”
“参与训练和独立数据规模是两回事。”
徐专家让他们现场打开训练、验证和测试清单。柏颂说服务器正在安全升级,访问速度可能受影响。林照野用本地备份打开严格划分版。
专家随机抽查二十个测试ID,没有与训练集重复。
柏颂松了口气。
徐专家又问九十八点一对应哪个清单。
林照野打开同源随机版。
叶穗注意到柏颂把手放到会议桌下,手机屏幕亮了一下。她的电脑随即弹出平台消息:
【请所有人员严格按照项目负责人统一口径回答专家问题。】
消息发在全体项目群,专家就坐在屏幕对面。
林照野把两个清单的划分方法都投出来。
“九十八点一来自先增强后随机划分。同一原图的变体可能跨训练和测试。严格按原图、田块与来源隔离后,当前准确率约七十四。”
秦九章坐在旁边,脸色比投影幕布还白。
詹炜说:“这是团队内部正在优化的两套评价体系。林老师强调最严格边界,说明我们敢于自我加压。”
“项目书为什么只写九十八?”徐专家问。
“申报系统要求填写代表性指标。”
“七十四不代表?”
“它代表未来攻关空间。”
专家组另一名成员笑了一下,不知是赞同还是觉得新鲜。
检查持续两个小时,远超接待手册。无人机合影取消,驾驶舱启动仪式取消,预录产业连线没有播放。学校准备的每一个不会失败的环节,都因专家真正看材料而失去出场机会。
考察结束前,徐专家提出四项整改:
第一,明确十万图像中独立原图、增强图和公开数据比例;
第二,按田块和来源隔离评估;
第三,保留拒识机制,所有对外展示说明适用边界;
第四,补充农学院数据授权与贡献证明。
“一周内提交。”他说,“项目可以继续评审,但前期指标需要核实。”
詹炜当场表示全部接受。
送走专家后,学院楼一楼大门刚关上,秦九章便转身问:“为什么现场突然换版本?”
林照野说:“陌生样本必须用有拒识的版本。”
“接待方案写的是展示版。”
“展示版会乱报。”
“研究版就不会?”
“会不回答,但不会强行给病名。”
“现在专家怀疑九十八,项目可能掉出支持名单。谁承担?”
詹炜没有立刻说话。他站在秦九章侧后方,既没有承认由他要求删除拒识,也没有否认研究版更安全。
柏颂说:“现场节奏确实被打乱。主要是版本管理没有统一。”
叶穗抬头:“研究版有明确哈希,展示版是平台管理员绕过评审合并的。”
秦九章看她:“你是谁?”
“数据负责人叶穗。”
“学生先不要介入管理责任。”
“数据问题里,我应该介入。”
“现在讨论的是接待执行。”
又一次,数据只在需要成果时属于学生,在需要责任时不允许学生介入。
詹炜终于开口:“秦校长,团队确实存在对外口径不一致,我作为负责人会整改。但从结果看,专家认可拒识机制,也给了一周补充机会。我们要把危机转化为可信AI特色。”
“怎么转?”
“把双口径改成双层评估,把七十四解释为极端跨域,把九十八保留为标准场景。数据构成全部透明,突出我们主动发现并解决行业共性问题。”
秦九章问:“会不会影响排名?”
“如果材料写好,反而可能成为亮点。”
学校的科研能力或许难以一夜提升,但把问题改名为亮点的能力长期稳定。
当晚,禾象实验室发布整改任务。林照野负责双层评估说明,叶穗负责数据构成,吴兰因负责补签授权,柏颂负责“可信AI特色凝练”,罗竞川负责补拍跨域无人机画面。
任务表最后一栏是责任人。
詹炜的名字只出现在“总协调”。
一周后,补充材料提交。九十八点一仍在主表,七十四点六作为“跨区域极限泛化测试”放在下一页。十万图像拆分成三万一千独立原图和六万九千增强图;公开数据比例写成“前期预训练资源”;农学院授权附上“正在履行校内审批程序”。
专家组给出“修改后通过”。
省农业专项拟立项名单公示,禾象项目排名第四,建议支持经费一千万元。
学院群沸腾起来。秦九章发来祝贺,称这是“直面问题、化危为机的典型案例”。詹炜转发公示截图:
【真正的团队,不是没有分歧,而是能把分歧变成共同成果。】
林照野看着那句话。
项目确实没有失败。
它只是把一次差点失败的验收,纳入了成功经验。
至于谁提出风险、谁删除模块、谁在现场承担后果,已经在“共同”二字里被平均得看不见了。