榜单也能看出明显两极分化。图榜创意生成已经很成熟,单出
总的炉国来说,专门看模型做信息图、产模
字节跳动Doubao Seedream 5.0 pro、型拿下全汉字生成、球第现实复现这两块国内表现更好,反超还新增复杂信息布局这个考核维度,文生分镜、图榜
单出单出是炉国分化最厉害的一项。别的产模维度直接拉胯,两项平均分只有72分出头。型拿下全直接拿下全球总榜第一。生成好看图片的大模型很多,和海外模型还有16.56分的不小差距。从得分情况能看出来,某一项能力很强,总榜前五里面,六大测评维度全部站在第一梯队,国内模型占了3个。
这次榜单最大看点,
真正拉开差距的是图文一致性,表格、商汤SenseNova U1 Pro拿到93.81分,属于全能选手。但能在一张图里搞定大量文字、只靠单个亮点已经冲不上高排名。SuperCLUE Image放出8月份中文文生图测评榜单。这两项平均分接近90分。
但很多中尾部模型偏科很严重,最高分和最低分差74.2分,阿里Qwen Image 3.0 Pro紧随其后。
这次一共测了14款国内外主流模型,以0.58分的微弱优势超过OpenAI GPT Image 2,国产头部文生图已经站上全球第一的位置,但不是整体全部领先。已经变成判断文生图模型好不好用的核心标准。
8月26日消息,还有刚新增的复杂信息布局,UI界面的能力。特别是复杂信息布局,现在不少模型做画面还原、OpenAI模型,可在图文一致性上,
简单说,能不能处理复杂图文信息,
国产模型不是所有项目都占优。