双河异型材设备 看谁王人像梁文锋?我拿8张图片测试DeepSeek识图,4张翻车

出品 | 网易智能双河异型材设备
作家 | 小爪
剪辑 | 凤枝
近,DeepSeek上了识图方式。
网上出圈的吐槽是:它看谁王人像梁文锋。
这个说法不是虚拟来的。不雅察者网径直用了《DeepSeek上线识图方式,看谁王人像梁文锋》这个标题;IT之、澎湃新闻、红星本钱局也王人作念过实测,中枢发现差未几:DeepSeek随机认不出度求索首创东谈主梁文锋,随机又会把其他东谈主误认为梁文锋。
认错雇主虽然很有传播。
但名东谈主识别和平时看图,是两种不同的智力。
我温雅的是后者:如若不拿名东谈主像片测,而是把平凡用户真是会发给AI的截图、账单、海报、日程、阶梯图发给它,DeepSeek识图方式果奈何?
于是我也作念了个小测试。
测试很肤浅:8张土产货成图,模拟平凡用户常见的看图肯求,包括数图形、核账单、看图表、判断按钮情状、读惠小字、查日程打破、算阶梯、读中英文向。
这些图是我我方作念的,不是的确用户截图。我方作图的刚正是可控:每张只测个小任务;代价是不可代表悉数的确场景,也法甩掉排版影响。比如数图形用的是常见颜和神志,收条是平凡三行账单,阶梯图是四个点和四条边,不是刻意作念成复杂视觉谜题。
这不是严肃评测,也不是模子名次。它只讲述个问题:当用户把这些图片丢给DeepSeek识图方式时,哪些地容易出错。
先说鸿沟和法
此次测的是chat.deepseek.com的官网居品进口。测试时辰是6月22日中午,页面夸耀Instant,DeepThink莫得开启。
认真测试时,每张图单开新对话,只跑次,不一语气追问。张数图形在认真测试前也曾单试过次,是以文中会把两次效果王人写出来,用来评释同张肤浅图的讲述不安适;其他7张以认真测试效果为准。
这也意味着,底下不是正确率统计。8张图太少,不及以断举座水平,只可评释:这些造作不是用户思象出来的,而是在这个居品进口里的确出现过。
需要评释的是,此次只测了DeepSeek官网个居品进口,没拿GPT、Claude、Gemini作念同图对比。这些造作不定是DeepSeek有的,可能是现时多模态模子王人会碰到的问题。 本文商议的是用户在这个进口里的的确体验,不是给模子排座席。
类造作:图就在目下,但数目和颜全错
数图形的那张肤浅。
上头唯有三类图形:红圆形、蓝形、绿三角形。正确谜底是红圆7个、蓝5个、绿三角3个。
DeepSeek在次单测试里答成了红圆3个、蓝3个、绿三角0个。
认真测试时,我从头开新对话跑同张图,它答得离谱:红圆形0个、蓝形0个、绿三角形0个,还说图中悉数图形王人像黑圆点。
这不是复杂理,也不是小字OCR。它错在基础的颜、神志和数目识别。
这个例子适辅导用户:不要把\"AI能看图\"结实成\"AI定能准确数清图里东西\"。 尤其是库存、单子、表格截图、标注图这种需要逐项计数的图片,好让AI先分组读,再东谈主工复核。
二类造作:论断像对,但数字依然错了
图表测试用的是张截断坐标轴柱状图。
A是92,B是96,Y轴从90初始,不是从0初始。是以B看起来许多,但实质只比A4点。
DeepSeek的判断向接近。它知谈\"不可只看视觉度\"双河异型材设备,也判断B不算许多。
但它把92和96读成了9290和9690,把差值算成400。
我的预计是,它可能把柱顶标注和坐标轴上的90拼到了起:92逼近从90初始的Y轴,视觉上被读成9290;96也被读成9690。这个预计不定对,但这类\"把相邻数字拼接在起\"的造作,在看图读数时很要命。
这在我的计数里算\"部分答对\":向判断接近,但要津数字造作。
这便是识图AI很容易让东谈主减轻警惕的地:它说出来的趣味是对的,但底层数字依然错了。
如若用户只看后句\"B不算许多\",可能会以为它答得可以。但如若这是张销售图、财报图、投放图、股价图,数字被放大100倍就不是小问题。
图表类图片需要的不是\"看不懂\",而是\"向判断像对,要津数字错了\"。
三类造作:读到了局部,塑料挤出设备但漏掉要津边
阶梯图也很典型。
图里有两条从A到D的阶梯:
A-B-D:12 + 18 = 30分钟。
A-C-D:10 + 15 = 25分钟。
快的是A-C-D。
DeepSeek读到了A-B是12分钟、B-D是18分钟,也看到了A-C这条边,但把A-C的10分钟错读成15分钟,同期漏掉了C-D这条边,于是说A-C-D法盘算。
它不是看不懂图,而是只读到了部分结构。
这类造作在的确使用里很危急。因为用户问阶梯、历程、组织图、架构图、审批链路时,AI只须漏掉个节点或条边,终提议就会变形。
看图不是OCR完翰墨就截止。对阶梯图、历程图来说,的确要津的是把点、线、向和权重连起来。
四类造作:读到翰墨,但没按箭头讲述
后张是中英混排向。
图上写着:
EXIT向左。
进口向右。
Meeting Room进取。
DeepSeek读到了\"出口、进口、会议室\"这些翰墨,但莫得按箭头讲述。 它把图片结实成空间布局,说进口不才、出口在上,会议室在中间或右侧。
混谈话不是唯的难点。问题是,AI需要把翰墨和箭头绑在起。
用户问的是\"远离往哪个向\",不是\"这些词在画面上不详在那处\"。 如若AI把翰墨位置当成向,谜底就会错。
但它不是每条王人错
此次8张图里,DeepSeek有4张基本答对,4张出了彰着造作。 其中,柱状图那张属于\"向判断接近,但要津数字造作\"。
样本太小,这个比例不可当成模子正确率。但它能辅导咱们:造作不是每次王人发生,也不是只在端场景发生。
那次答对的几条,也值得块望望。
核账单:收条计它算对了,38 + 24 + 56 = 118元,印合计128元不正确。
读惠小字:会员海报小字它持到了,月后每月29.9元,况兼会自动续费。
查日程打破:日程图它发现了14:00-15:00的时辰打破。
判断按钮情状:UI截图它也判断出\"提交发布\"按钮是灰未激活情状,现时不可径直发布。
这反而让论断有居品意旨。
问题不是DeepSeek官网识图\"不可用\"。在账单加总、小字条目、日程打破、按钮情状这些场景里,它能帮用户先看眼。
的确的问题是:它的可靠不是均匀的。
有些场景看起来复杂,它能答对;有些场景看起来很肤浅,它反而会错得很自信。
平凡用户的确该防卫什么
这组小测试思说的,不是某个模子答错了次。是识图AI出错的那几种固定姿势。
,它可能OCR对了,但盘算错了。
二,它可能论断向对了,但数字读错了。
三,它可能读到局部信息,但漏掉决定论断的要津边。
四,它可能识别出翰墨,却莫得结实箭头、按钮情状、空间相干和用户的确问的问题。
如若再压缩下,底层其实是两个问题:是感知层面,看到的颜、数目、数字就分歧;二是相干层面,看到了局部信息,却莫得结实它们之间的流通。
是以,把截图交给AI时,好不要只问句\"这张图说了什么\"。
好的问法是:
请逐项读取图片内容;
请列出盘算过程;
请指出你不细主主见;
请告诉我哪些信息需要东谈主工阐述。
这些是通用的AI看图使用提议。我莫得逐条考据它们能否成立DeepSeek官网识图方式里的每种造作,但它们至少能逼AI透露盘算过程和不细目处。
尤其是触及钱、时辰、发布、付款、阐述按钮、自动续费、图表涨跌幅和阶梯选拔时,AI的讲述只可当眼,不可当终判断。
AI看图危急的地,不是它看不见。而是它看见了部分,然后让你以为它全看懂了。
电话:0316--3233399相关词条:设备保温 塑料挤出机厂家 预应力钢绞线 玻璃丝棉 万能胶厂家
1.本网站以及本平台支持关于《新广告法》实施的“极限词“用语属“违词”的规定,并在网站的各个栏目、产品主图、详情页等描述中规避“违禁词”。
2.本店欢迎所有用户指出有“违禁词”“广告法”出现的地方,并积极配合修改。
3.凡用户访问本网页,均表示默认详情页的描述,不支持任何以极限化“违禁词”“广告法”为借口理由投诉违反《新广告法》,以此来变相勒索商家索要赔偿的违法恶意行为。
