晋江文学城
下一章 上一章  目录  设置

16、一场不会失败的验收 林照野打开 ...

  •   林照野打开了研究版。

      湿叶放到相机下,镜头先被水珠晃出一片白光。叶穗用纸巾吸干表面,重新拍摄。模型运行两秒,灰色框出现:

      【无法判断,请人工复核。】

      詹炜的表情没有变化。他朝徐专家笑道:“这是我们的可信拒识机制。”

      徐专家盯着屏幕:“为什么刚才宣传片里每片都能识别?”

      柏颂说:“宣传片是标准测试,现场是开放环境。系统针对分布外样本会主动转交专家。”

      “那项目书里写真实复杂田间准确率九十八点一,属于哪一种?”

      “内部标准数据集结果。”

      “标准数据集为什么代表真实复杂田间?”

      柏颂看向詹炜。

      詹炜接过话:“九十八点一体现模型在已覆盖类别上的能力。开放环境还有长尾问题,正是项目未来三年重点攻关内容。”

      “你们申请书前期基础写得像已经攻完了。”

      “材料篇幅有限,重点突出主要进展。”

      徐专家没有继续追。他把灰框页面拍照,又让叶穗拿出两片现场叶。一片健康,一片有虫咬。模型对健康叶输出健康,置信度八十三;虫咬叶输出不确定。

      “这比乱报好。”他说,“保留这个版本。”

      詹炜立即点头:“我们一直坚持可信路线。”

      林照野看见柏颂低头在接待手册上划掉了展示版流程。

      考察转入数据检查。专家组没有去驾驶舱,而是坐进小会议室,要求查看数据构成、标注规范和训练测试划分。

      柏颂打开准备好的统计页:

      总图像数十万零八百六十四;

      覆盖作物十三类;

      病害类别四十七;

      标注准确率百分之九十九点二;

      自主及合作采集比例百分之六十八。

      徐专家问“自主及合作”各多少。

      “平台以联合方式建设,暂未分开统计。”

      “公开数据多少?”

      “公开数据主要用于预训练。”

      “具体多少?”

      柏颂翻到下一页,展示数据增强流程。

      徐专家没有跟着翻:“我问公开数据多少。”

      叶穗坐在后排,电脑里有准确清单。柏颂没有叫她回答。

      詹炜说:“原始公开数据约一万八千,经过清洗和增强进入基础库。自主及合作田间数据持续增加。”

      “独立原图一共有多少?”

      会议室安静下来。

      “三万一千左右。”林照野回答。

      柏颂立刻补充:“这是按极严格近似去重口径,图像库实际规模超过十万。”

      “同一张图旋转十次算十张?”

      “增强图参与训练,具有计算价值。”

      “参与训练和独立数据规模是两回事。”

      徐专家让他们现场打开训练、验证和测试清单。柏颂说服务器正在安全升级,访问速度可能受影响。林照野用本地备份打开严格划分版。

      专家随机抽查二十个测试ID,没有与训练集重复。

      柏颂松了口气。

      徐专家又问九十八点一对应哪个清单。

      林照野打开同源随机版。

      叶穗注意到柏颂把手放到会议桌下,手机屏幕亮了一下。她的电脑随即弹出平台消息:

      【请所有人员严格按照项目负责人统一口径回答专家问题。】

      消息发在全体项目群,专家就坐在屏幕对面。

      林照野把两个清单的划分方法都投出来。

      “九十八点一来自先增强后随机划分。同一原图的变体可能跨训练和测试。严格按原图、田块与来源隔离后,当前准确率约七十四。”

      秦九章坐在旁边,脸色比投影幕布还白。

      詹炜说:“这是团队内部正在优化的两套评价体系。林老师强调最严格边界,说明我们敢于自我加压。”

      “项目书为什么只写九十八?”徐专家问。

      “申报系统要求填写代表性指标。”

      “七十四不代表?”

      “它代表未来攻关空间。”

      专家组另一名成员笑了一下,不知是赞同还是觉得新鲜。

      检查持续两个小时,远超接待手册。无人机合影取消,驾驶舱启动仪式取消,预录产业连线没有播放。学校准备的每一个不会失败的环节,都因专家真正看材料而失去出场机会。

      考察结束前,徐专家提出四项整改:

      第一,明确十万图像中独立原图、增强图和公开数据比例;

      第二,按田块和来源隔离评估;

      第三,保留拒识机制,所有对外展示说明适用边界;

      第四,补充农学院数据授权与贡献证明。

      “一周内提交。”他说,“项目可以继续评审,但前期指标需要核实。”

      詹炜当场表示全部接受。

      送走专家后,学院楼一楼大门刚关上,秦九章便转身问:“为什么现场突然换版本?”

      林照野说:“陌生样本必须用有拒识的版本。”

      “接待方案写的是展示版。”

      “展示版会乱报。”

      “研究版就不会?”

      “会不回答,但不会强行给病名。”

      “现在专家怀疑九十八,项目可能掉出支持名单。谁承担?”

      詹炜没有立刻说话。他站在秦九章侧后方,既没有承认由他要求删除拒识,也没有否认研究版更安全。

      柏颂说:“现场节奏确实被打乱。主要是版本管理没有统一。”

      叶穗抬头:“研究版有明确哈希,展示版是平台管理员绕过评审合并的。”

      秦九章看她:“你是谁?”

      “数据负责人叶穗。”

      “学生先不要介入管理责任。”

      “数据问题里,我应该介入。”

      “现在讨论的是接待执行。”

      又一次,数据只在需要成果时属于学生,在需要责任时不允许学生介入。

      詹炜终于开口:“秦校长,团队确实存在对外口径不一致,我作为负责人会整改。但从结果看,专家认可拒识机制,也给了一周补充机会。我们要把危机转化为可信AI特色。”

      “怎么转?”

      “把双口径改成双层评估,把七十四解释为极端跨域,把九十八保留为标准场景。数据构成全部透明,突出我们主动发现并解决行业共性问题。”

      秦九章问:“会不会影响排名?”

      “如果材料写好,反而可能成为亮点。”

      学校的科研能力或许难以一夜提升,但把问题改名为亮点的能力长期稳定。

      当晚,禾象实验室发布整改任务。林照野负责双层评估说明,叶穗负责数据构成,吴兰因负责补签授权,柏颂负责“可信AI特色凝练”,罗竞川负责补拍跨域无人机画面。

      任务表最后一栏是责任人。

      詹炜的名字只出现在“总协调”。

      一周后,补充材料提交。九十八点一仍在主表,七十四点六作为“跨区域极限泛化测试”放在下一页。十万图像拆分成三万一千独立原图和六万九千增强图;公开数据比例写成“前期预训练资源”;农学院授权附上“正在履行校内审批程序”。

      专家组给出“修改后通过”。

      省农业专项拟立项名单公示,禾象项目排名第四,建议支持经费一千万元。

      学院群沸腾起来。秦九章发来祝贺,称这是“直面问题、化危为机的典型案例”。詹炜转发公示截图:

      【真正的团队,不是没有分歧,而是能把分歧变成共同成果。】

      林照野看着那句话。

      项目确实没有失败。

      它只是把一次差点失败的验收,纳入了成功经验。

      至于谁提出风险、谁删除模块、谁在现场承担后果,已经在“共同”二字里被平均得看不见了。

  • 昵称:
  • 评分: 2分|鲜花一捧 1分|一朵小花 0分|交流灌水 0分|别字捉虫 -1分|一块小砖 -2分|砖头一堆
  • 内容:
  •             注:1.评论时输入br/即可换行分段。
  •                 2.发布负分评论消耗的月石并不会给作者。
  •             查看评论规则>>