首页
学习
活动
专区
圈层
工具
发布
社区首页 >专栏 >终于等来了Deepseek的视觉模型!实测一把,有点东西!

终于等来了Deepseek的视觉模型!实测一把,有点东西!

作者头像
卡卡罗特AI
发布2026-09-10 09:46:30
发布2026-09-10 09:46:30
240
举报

就在刚刚,Deepseek 发布了视觉模型, 模型编号是deepseek-v4-flash-vision-exp。

据官方评测,这个模型不仅增加了视觉能力,Agent 推理能力也显著提高!性能甚至逼近Claude 的Opus-4.8!

看来,Deepseek 一直被人诟病的问题终于解决了。

那去哪里能用上 Deepseek 的视觉模型呢?

你可以在 Deepseek 的开发平台上获取这个模型的编号。

可以看到,新视觉模型的价格和最新的 Flash 模型是一样的,也分为高峰时段和低峰时段。

高峰时段的价格是低峰时段的两倍。

当然,你也可以在 Deepseek Harness 上体验这款视觉模型。

如果你之前全局安装过 dsh 命令,可以使用下面这个命令更新一下:

npm install -g @deepseek-ai/dsh@latest

将 Deepseek Harness 更新到最新版本。

当然你也可以在 Claude Code 中配置 Deepseek 的模型,最简单的还是使用 CC Switch 来配置。

需要先在「获取模型列表」这里获取一下,然后在下拉列表里配置。

然后在claude Code中切换到对应的模型就行了。

有了视觉能力能干嘛呢?

有了视觉模型,相当于有了眼睛。

不仅可以识别图片的文字,还能理解图片的信息。

比如你可以丢一张 UI 设计图、网站的截图给它,让它帮你复刻出对应的样式布局。

比如你可以把一张代码的报错截图发给它,然后让它修复。

比如你可以让它读懂一个视频,它可能会根据视频截取对应的帧画面,然后去理解这个视频的内容。

emmm,视觉理解能力,总之想象力非常大!

现在主流的模型基本都有视觉能力,比如 Kimi K3,而 Deepseek 迟迟没有推出视觉模型,一直被诟病。

下篇文章,我再给大家测试一下这个视觉能力到底如何。

我让他复刻这个热榜网站的样式和布局。

然后我在Deepseek Harness中试下。

大概用了3分接近4分钟。完成了。

复刻的效果如下,大家觉得怎么样呢?

整体感觉大方面没有毛病,布局确实1:1实现了。就是中间这个列表的样式稍微有点不一样。

还有这个logo没对上,那也不怪它,这要生图模型才能做得到。或者根据对应网站的链接,然后获取对应的logo 图片才行。

不过deepseek-v4-flash-vision-exp还是一个实验版,期待正式版上线不会辜负大家的期望吧!🤔

Agent 能力还在测试中,等我~

我是卡卡罗特,持续分享对你有用的 AI 信息~

本文参与 腾讯云自媒体同步曝光计划,分享自微信公众号。
原始发表:2026-08-21,如有侵权请联系 cloudcommunity@tencent.com 删除
目录
  • 有了视觉能力能干嘛呢?
问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档