> ## Content Index
> Fetch the complete content index at: https://recent.cc/llms.txt
> Use this file to discover other available public pages before exploring further.

# 多模态大模型开始读图纸和工单
- URL: https://recent.cc/duomotai-tuzhi-gongdan/
- Published: 2026-09-11T01:10:00.000Z
- Updated: 2026-09-14T01:27:41.000Z
- Description: 文档、截图和 CAD 出图被放进同一条上下文，工位上的问答不再只是纯文本，但安全步骤仍不能让模型单独签字。
- Author: vucre
- Tags: 要闻, 科技, #Import 2026-09-14 09:59

制造和现场运维团队开始把图纸、工单截图和说明书一并喂给多模态模型。问答从“搜关键字”变成“对着图问这一步漏了什么”。准确率仍不稳定，但已经能把明显的缺件和版本不一致先筛出来。

这不是演示视频里的“看一眼就懂”。一线真正省下的，是第一轮分拣：哪张图过期了、哪个标注和实物对不上、哪条工单缺了安全步骤。后面的判断，仍然要老师傅点头。把演示当成已经可签字，是这一轮最容易写出的假新闻。

## 图纸进上下文

过去要靠文档工程师把图译成文字，才能检索。现在模型直接看标注和尺寸线。好处是快，风险是它会把相似的零件号读串，或把旧版修订云线当成现行方案。因此多数团队只允许模型提出“可能不一致”的列表，不允许它直接改图。

CAD 导出的像素图还丢失了图层信息。有的团队开始同时上传矢量快照和一份精简的 BOM，让模型在图和表之间交叉验证。纯看图，幻觉会明显更高。交叉验证也不是万能：BOM 本身若滞后，模型会非常自信地站在错误的一边。

版本管理因此被重新抬上桌面。图、表、工艺卡必须能回答“这是哪一版”。模型没有这个元数据，就只会在像素里找形状。形状像，不等于可施工。

## 工单怎么写

一线把手机拍的故障照片贴进对话。模型给出可能原因和备件编号，再由老师傅确认。流程没有取消人，只是把第一轮分拣提前了。照片质量、光线、遮挡，会显著影响召回；所以现场规范里多了一条：拍铭牌、拍整体、拍缺陷，三张一组。

工单文本本身也要改。以前写“设备异常”，现在被要求写工况、最近更换的零件、报警代码。模型再强，也补不上一句空的描述。有的班组开始用语音转写，再让模型整理成结构化字段。转写错误会进入上下文，必须允许老师傅一键改字段，而不是只能改模型的散文。

## 还不能放手的地方

安全相关的步骤仍要求人工复核。团队说，他们接受模型读图，不接受模型单独签字。电气隔离、承压部件、高空作业，这些清单必须由有资质的人勾选。模型可以提醒“清单缺了第 4 项”，不能宣布“可以开工”。

责任链条也要预先写清。一旦误判导致停机或事故，追问的是流程设计，而不是“模型当时怎么说”。把模型放进工位，等于把软件缺陷变成了现场缺陷，治理标准必须上提一档。保险和合规部门开始问：日志能不能证明是谁点了确认。

## 下一季度看误报率

演示视频不再够用。要看的是误报率、漏报率和人工接管次数。如果老师傅每天要否决一半建议，这个功能就是噪音。如果它只在明显缺件时响一次，并且几乎总是对的，它才会留下。

留下之后也不该扩张太快。从“提醒缺件”到“自动下备件单”，中间隔着库存、替代料和审批。每跨一步，都要把人的签字位置再画一遍。