一位开发者在 V2EX 社区分享了名为 `deepseek-mcp-image` 的开源项目,旨在通过 MCP(Model Context Protocol)协议为 DeepSeek 模型赋予视觉识别能力。据作者介绍,商汤科技近期更新了官网的 Token 计划,开放了对 `deepseek-v4-flash` 和 `GLM5.2` 模型的免费 API 访问权限。基于这一资源优势,该项目构建了一个符合 MCP 标准的服务端,利用商汤提供的免费视觉模型接口作为后端,成功将视觉理解能力引入 DeepSeek。这使得原本以文本推理见长的 DeepSeek 能够处理图像内容,极大地丰富了其在多模态场景下的应用潜力。项目已托管于 GitHub 并开源,展示了如何通过协议适配低成本地调用第三方能力来增强大模型的功能,为构建具备视觉感知的 AI Agent 提供了新的参考路径。
事件分析
核心观点:MCP 协议正成为连接大模型能力的胶水,低成本集成垂直模型能力将是 AI Agent 开发的新常态。
原文链接:V2EX 分享发现


评论前必须登录!
立即登录 注册