微软开源 Visual ChatGPT，五天斩获两万 stars

2023-03-16 發表於开源资讯

除了大力投资 Open AI ，微软还亲自下场大搞 AI 。5 天前，微软开源了 Visual ChatGPT ，这个软件可以连接 ChatGPT 和一系列视觉模型，以实现在 ChatGPT 的聊天过程中发送和接收图像。

众所周知，尽管 ChatGPT 的功能非常强大，甚至可以用来写小说写论文，但目前也仅限于文字交流。~~但表情包早已成为日常文本聊天不可或缺的功能。~~

Visual ChatGPT 的出现，就像在以文字交流的 APP 中首次添加了表情包功能，而且还是根据用户输入的文本自动生成的“定制化表情包”，大大提升了 ChatGPT 的趣味性和应用领域。

一方面，ChatGPT（或 LLM）充当通用界面，提供对图像的理解和用户的交互功能。另一方面，基础图像模型通过提供特定领域的深入知识来充当背后的技术专家。

仓库中列出了技术架构及原理图：

Demo 中共进行了三种不同类型的对话，分别是 Visual ChatGPT 接收用户的图像、Visual ChatGPT 根据用户的文本修改图像并发送给用户，以及 Visual ChatGPT 识别图片，并回答用户的提问。 Visual ChatGPT 会根据用户的输入，判断是否需要使用 VFM （Visual Foundation Model，视觉基础模型）来处理该问题。

仓库中还给出了 Visual ChatGPT 所使用的图像模型和显存使用情况：

更详细的内容可以阅读 Visual ChatGPT 的 arxiv 论文：Visual ChatGPT: Talking, Drawing and Editing with Visual Foundation Models

Visual ChatGPT 在 3月 10 日发布，截至 3 月 15 日早 9 点，该项目已暂获 19547 个 Stars ，可谓是火箭式上涨。

微软开源 Visual ChatGPT，五天斩获两万 stars

相關推薦

Build 2023 亮点：Windows 原生支持 rar 格式、发布 Windows Copilot

TIOBE 6 月榜单：C/C++、Java 逼近，Python 能否保住第一？

OpenAI 将推出家长监控功能以应对青少年自杀悲剧

微软即将发布 Visual Studio 重大升级，应对 AI 编程工具激烈竞争

.NET 20 周年：临危受命阻击 Java，见证微软转向开源

微软 VS & VS Code 每月活跃开发者数量达到 5000 万

Anthropic 推出 Claude Android 应用

微软将推出微型 Arm PC 和原生 Arm64 Visual Studio

微软开源 JARVIS（贾维斯）：用 ChatGPT 控制 AI 模型

微软官宣：Visual Studio for Mac 退役

微软大幅改进 Visual Studio 语法高亮显示

微软近 5 万 star 的开源项目 —— MarkItDown 已支持 MCP

微软为 VS Code 带来 C# 开发套件

🥇荣誉上新｜Alluxio 斩获「 OSCAR尖峰开源项目及开源社区」