首页 / 要闻

要闻

多模态大模型开始读图纸和工单

笔记本电脑与代码界面

文档、截图和 CAD 出图被放进同一条上下文,工位上的问答不再只是纯文本,但安全步骤仍不能让模型单独签字。

制造和现场运维团队开始把图纸、工单截图和说明书一并喂给多模态模型。问答从“搜关键字”变成“对着图问这一步漏了什么”。准确率仍不稳定,但已经能把明显的缺件和版本不一致先筛出来。

这不是演示视频里的“看一眼就懂”。一线真正省下的,是第一轮分拣:哪张图过期了、哪个标注和实物对不上、哪条工单缺了安全步骤。后面的判断,仍然要老师傅点头。把演示当成已经可签字,是这一轮最容易写出的假新闻。

图纸进上下文

过去要靠文档工程师把图译成文字,才能检索。现在模型直接看标注和尺寸线。好处是快,风险是它会把相似的零件号读串,或把旧版修订云线当成现行方案。因此多数团队只允许模型提出“可能不一致”的列表,不允许它直接改图。

CAD 导出的像素图还丢失了图层信息。有的团队开始同时上传矢量快照和一份精简的 BOM,让模型在图和表之间交叉验证。纯看图,幻觉会明显更高。交叉验证也不是万能:BOM 本身若滞后,模型会非常自信地站在错误的一边。

版本管理因此被重新抬上桌面。图、表、工艺卡必须能回答“这是哪一版”。模型没有这个元数据,就只会在像素里找形状。形状像,不等于可施工。

工单怎么写

一线把手机拍的故障照片贴进对话。模型给出可能原因和备件编号,再由老师傅确认。流程没有取消人,只是把第一轮分拣提前了。照片质量、光线、遮挡,会显著影响召回;所以现场规范里多了一条:拍铭牌、拍整体、拍缺陷,三张一组。

工单文本本身也要改。以前写“设备异常”,现在被要求写工况、最近更换的零件、报警代码。模型再强,也补不上一句空的描述。有的班组开始用语音转写,再让模型整理成结构化字段。转写错误会进入上下文,必须允许老师傅一键改字段,而不是只能改模型的散文。

还不能放手的地方

安全相关的步骤仍要求人工复核。团队说,他们接受模型读图,不接受模型单独签字。电气隔离、承压部件、高空作业,这些清单必须由有资质的人勾选。模型可以提醒“清单缺了第 4 项”,不能宣布“可以开工”。

责任链条也要预先写清。一旦误判导致停机或事故,追问的是流程设计,而不是“模型当时怎么说”。把模型放进工位,等于把软件缺陷变成了现场缺陷,治理标准必须上提一档。保险和合规部门开始问:日志能不能证明是谁点了确认。

下一季度看误报率

演示视频不再够用。要看的是误报率、漏报率和人工接管次数。如果老师傅每天要否决一半建议,这个功能就是噪音。如果它只在明显缺件时响一次,并且几乎总是对的,它才会留下。

留下之后也不该扩张太快。从“提醒缺件”到“自动下备件单”,中间隔着库存、替代料和审批。每跨一步,都要把人的签字位置再画一遍。