该功能于6月18日全量开放,覆盖网页与移动端,但在测试中暴露对创始人识别困难及传闻中的特定人物照片拦截问题
2026年6月18日,深度求索(DeepSeek)宣布其图像理解功能在官方网站及移动应用程序中正式向所有用户开放。该功能自当年4月底启动灰度测试阶段后完成全量部署,标志着该公司产品首次原生集成视觉分析能力。多模态研究员陈小康确认了此次更新,指出系统在处理常规物体、标志性建筑及数学题目图像时表现出稳定的解析性能与较快的响应速度,且在解答数学题时可自主执行验算步骤。
在实际测试过程中,该功能在人物识别环节显现出特定局限性。针对DeepSeek创始人梁文锋的公开照片,模型多次未能正确辨认,将其错误标记为董宇辉、张雪峰等其他公众人物,分析认为这与梁文锋一贯保持低调形象导致网络公开图像素材稀缺有关,模型难以基于现有数据构建稳定的特征向量。关于网络流传的“雷军照片无法上传”现象,实际测试显示用户上传相关图片并未受阻,系统能够正常接收并准确识别出雷军的形象,未触发违规拦截提示。
根据官方披露的技术路线图,DeepSeek计划于本月推出V4.1版本,旨在实现文本、图像与音频的全模态能力整合,并同步配套企业级开发工具链。在资本运作方面,该公司于6月16日完成首轮约510亿元人民币融资,投后估值接近4000亿元,这笔资金预计将为后续多模态模型的迭代升级提供算力支持与资源保障。此次功能的上线使该模型在基础视觉理解领域达到可用水平,但在处理特定低曝光度人物识别场景时仍需通过数据增强或针对性训练进行优化,以缩小与通用型大模型在人物认知领域的差距。