DeepSeek 识图模式上线:App 和网页端全面开放,偏偏认不出自家老板梁文锋

小北 2026-06-19 09:03:58 1 次浏览

6月18日,DeepSeek 识图模式正式上线 App 和网页端,多模态能力终于补全。然而,上线首日就迎来一个略显尴尬的测试结果:DeepSeek 竟然无法正确识别自己的创始人梁文锋——它把梁文锋的照片识别为董宇辉、张雪峰,甚至一度认成了雷军。相比之下,同场的雷军本人却被精准认出,形成了有趣的对比。

识图功能全面开放,支持 App 和网页端

DeepSeek 识图模式的推出,标志着 DeepSeek 在多模态能力上迈出了重要一步。从今日起,用户可以在 DeepSeek 的移动端 App 和网页端直接上传图片,由大模型进行理解、分析和问答。这是继文本生成能力之后,DeepSeek 在 AI 产品矩阵上的又一次功能补全。

多模态识图能力是大模型竞争的重要赛道。OpenAI 的 GPT-4V、Google 的 Gemini Vision、以及国内的通义千问、文心一言等多款主流大模型均已支持图像理解能力。DeepSeek 此番上线识图模式,意味着这家以开源大模型见长的公司,正式加入多模态能力的市场竞争。

偏偏认不出自家老板:一场有趣的"盲测"

就在上线当天,多家媒体对 DeepSeek 识图模式进行了测试,测试结果颇为戏剧性。

以梁文锋目前网络上传播最广的一张照片为例,DeepSeek 反复识别均未能给出正确答案,而是给出了董宇辉、张雪峰等答案,甚至有一次给出了"雷军"的答案。而雷军本人的照片,DeepSeek 却能精准识别,且识别结果高度一致。

有趣的是,据此前网传消息,雷军的照片曾一度被提示"可能违反使用规范"而无法发送给 DeepSeek,但 IT之家实测后发现,目前 DeepSeek 可以正常上传并识别雷军照片,且识别准确度较高。

为什么 DeepSeek 认不出梁文锋?

对于这一现象,业界给出了几种解释。

最主流的解释是梁文锋本人行事极为低调,网络公开照片和信息极少。与雷军、张雪峰、董宇辉这些高频出现在公众视野中的企业家相比,梁文锋极少接受采访、鲜少公开露面,AI 模型很难从有限的公开数据中提取出足够稳定的识别特征。

另一种解释则指向模型本身的能力边界——即便梁文锋的照片足够多,模型也可能在"熟面孔"识别上存在偏差,而"董宇辉""张雪峰""雷军"这些在媒体中反复出现的面孔,反而在训练数据中拥有更丰富的标注样本。

当然,也有人调侃:DeepSeek 没有针对自家老板进行任何特殊优化——这种"不偏心"的处理方式,某种程度上倒是体现了模型的公平性。

多模态竞争进入新阶段

DeepSeek 识图模式的上线,让多模态 AI 赛道的竞争进一步升温。

从技术层面看,多模态能力的难点不仅在于图像识别本身,更在于将视觉信息与语言理解能力深度融合——模型不仅要知道"图中有什么",更要理解"图中发生了什么"以及"用户想问什么"。这也是 GPT-4V、Claude Vision 等产品拉开差距的关键所在。

从商业层面看,识图能力的开放意味着 DeepSeek 的产品化路径更加清晰。从早期的纯文本对话工具,到如今的图文双模态交互,DeepSeek 正在向"全能型 AI 助手"的角色进化。

写在最后

DeepSeek 认不出自家老板,这件事本身或许只是一次测试中的偶然偏差,但它折射出的问题却值得思考:当 AI 越来越深入地融入我们的日常生活,它的识别能力、认知边界和"知识盲区",将在一次次类似的测试中逐渐暴露。

对于 DeepSeek 而言,这或许是一个甜蜜的烦恼——毕竟,能让全网讨论"AI 认不出梁文锋"这件事本身,就已经是一种成功的市场营销了。