铭鸿体育资讯网

DeepSeek终于能"看"了!新模型视觉碾压Opus 4.8 如果你们还在用

DeepSeek终于能"看"了!新模型视觉碾压Opus 4.8

如果你们还在用DeepSeek纯聊天、发不了图、看不了图,那今天这条消息得留意了——DeepSeek正式发布多模态模型V4-Flash-Vision-Exp,也就是说,它终于长出了"眼睛"。以后你喂它一张截图、一张表格、一张发票照片,它都能看懂,还帮你分析。

正文:

一、这双"眼睛"有多厉害?

先说结论:在视觉领域,它把Anthropic的旗舰Opus 4.8都超了。DeepSeek用了四套不同的视觉基准去考它,其中ALE测试要求模型边操作应用、边写代码、边读媒体文件,属于"手脚并用"的高难度场景;ZeroBench更是出了100道专为"难倒"前沿大模型而设计的图像分析题。结果V4-Flash-Vision-Exp在这两项上双双反超Opus 4.8。文本能力也没拖后腿,七项文本基准里,除了专门测"找软件漏洞"的Cybergym,其余全部优于前身V4-Flash。

二、价格还是老价格,这才是重点

这模型最打动人的地方不在参数,而在性价比。它是从V4-Flash升级来的——2840亿参数的混合专家模型,由多个130亿参数的"小脑瓜"组成,你提问时只激活最合适的那个,不用整机全开,算力自然省。再加上HCA和CSA两项KV缓存压缩技术,处理百万Token的提示词,算力消耗能砍掉73%。翻译成人话就是:又快又便宜,现在还是按Flash的价卖。

三、我的观点:免费版可以期待,但别急着冲

DeepSeek一向有"先付费试点、后开源"的习惯,V4-Flash就是今年4月先出、后来逐步放开的。所以这次大概率也会走同一条路——等等党可以蹲一个免费版本。但也得提醒一句:多模态模型的"看",和人类的"看"不是一回事,它在复杂场景下依然会犯错,用在医疗影像、合同审核这类场景时,人还得把关。

你觉得国产模型"能看图"之后,普通人最该用它做的一件事是什么?是帮爸妈读体检报告,还是识别网购图片避坑?说说你的用法。

大模型开源是在开源什么?AI智能 人工智能 DeepSeek