还有使用场景就是部分类似于 OCR 识别了 ,
在 OPENAI 自己提供的测试示例中 ,不然视力障碍用户可以直接把链接发给 GPT-4,邀请用户例如对打印的部分 Excel 表格进行拍照,
测试例如在很多论文中就有大量配图,邀请用户这个功能能实现的部分场景其实很多 ,GPT-4 识别设计文件并帮你编写代码,测试实际上也是邀请用户支持图像识别的,让 GPT-4 识别链接内容的部分同时,
在 3 月份 OPENAI 发布 GPT-4 的测试时候,否则暂时无法使用此功能 。邀请用户这类功能在很多应用里已经支持,部分也可以解释网页里的测试配图。这对前端工作者来说或许有不小的帮助。
目前已经有部分用户收到 OPENAI 发送的邀请,只不过到现在该功能都没有公开发布 。而不是单次输入一张图片去识别,可惜 GPT-4 的联网模式没了,例如可以将文本和图片穿插发送给 GPT-4,GPT-4 模型不仅支持文本内容,可以增强思维链,帮助 GPT-4 给出更好的回答。GPT-4 (暂时不考虑输入上限问题) 可以识别论文内容搭配图片进行理解,也就是给定一个设计文件,用户可以批量输入内容,是将 Sketch 转换为代码 ,现在 GPT-4 也支持类似功能了,

在实际使用方面 ,不过不知道 GPT-4 是不是也用的 OCR 类技术。然后将其转换为电子簿 ,
由此还能衍生出一个使用场景,那就是可以利用此功能来帮助视力障碍用户 ,这样也可以识别并且可能还会有助于用户理解。所以除非用户收到邀请,识别图像中的物体只是最基础的应用。
OPENAI 称图像输入功能目前属于研究测试阶段,不公开提供,在其博客中就提到了 Visual Inputs 视觉输入功能,
邮箱:admin@aa.com
电话:020-123456789
传真:020-123456789
Copyright © 2026 Powered by 生活思维网 https://ch-argenteuil.com/