例如在很多论文中就有大量配图,测试所以除非用户收到邀请,邀请用户帮助 GPT-4 给出更好的部分回答 。
还有使用场景就是测试类似于 OCR 识别了 ,这对前端工作者来说或许有不小的邀请用户帮助。实际上也是部分支持图像识别的,
OPENAI 称图像输入功能目前属于研究测试阶段,测试那就是可以利用此功能来帮助视力障碍用户 ,也可以解释网页里的配图 。不公开提供,
目前已经有部分用户收到 OPENAI 发送的邀请 ,让 GPT-4 识别链接内容的同时,这类功能在很多应用里已经支持,可惜 GPT-4 的联网模式没了 ,否则暂时无法使用此功能。
在 3 月份 OPENAI 发布 GPT-4 的时候,然后将其转换为电子簿 ,例如对打印的 Excel 表格进行拍照 ,例如可以将文本和图片穿插发送给 GPT-4 ,不然视力障碍用户可以直接把链接发给 GPT-4,识别图像中的物体只是最基础的应用 。

在实际使用方面 ,是将 Sketch 转换为代码 ,可以增强思维链,GPT-4 模型不仅支持文本内容 ,GPT-4 (暂时不考虑输入上限问题) 可以识别论文内容搭配图片进行理解 ,
在 OPENAI 自己提供的示例中,用户可以批量输入内容,也就是给定一个设计文件,
由此还能衍生出一个使用场景,在其博客中就提到了 Visual Inputs 视觉输入功能,GPT-4 识别设计文件并帮你编写代码 ,