评测组小编
-
Fable 5.5突袭上线!全网首测,真超级智能来了
新智元报道 Fable 5.5,曝光了! 今早,一大批开发者意外发现,Claude网页端悄悄灰度到了Anthropic下一代旗舰Fable 5.5。 界面明明还标着「Fable 5…
-
实测Qwen3.8-Omni-Flash:全模态Agent有了“白菜价
千问把全模态Agent的使用成本,直接砍掉了90%! Qwen称,其最新推出的全模态模型Qwen3.8-Omni-Flash,不光在WildClawBench-MM等30项评测里火…
-
实测最新版「豆包手机」助手:所有手机里的AI都该变成它这样
豆包手机助手消费者版今天正式发布。 搭配了它的手机长这个样子: 搭配了豆包手机助手消费者版的努比亚 NaviX Ultra 将在 9 月 16 日发布 和预览版相比,官方对这个助手…
-
DeepSeek V4.1 Flash 测评
短的结论:最是一年春好处 基本情况: DeepSeek 与众不同的是,他们热衷,并且擅长通过底层创新来提效,在这样持续不懈努力之下,即便会走一些弯路,但最终都会做出突破性的成绩。这…
-
豆包工作这波更新,我给满分!一大波实测来了
新智元报道 AI圈现在卷得最凶的地方,是你的电脑桌面。 OpenAI不断强化桌面端应用,试图用Codex和ChatGPT for Work接管打工人的工作流。 Anthropic更…
-
DeepSeek V4.1 Flash实测,花3亿token,14组任务,居然比上代贵
家人们,DeepSeek V4.1 Flash开启内测了。 内测问卷里有道题,把我看乐了。官方直接问,这个模型能不能全面替换线上的DeepSeek V4 Pro。 上次我测完V4 …
-
实测完GPT6,AGI还没来,但我真瘫坐在地上
GPT-6 Astra 今天全量开放了。Plus 和 Business 用户也都能用上了。 看完 X 上那些演示,很难不想自己上手爽蹬一把。 糖豆人式的闯关游戏、铺满楼房和道路的模…
-
实测GPT-6:AGI真来了!OpenAI缔造者都摸不到天花板
新智元报道 今夜将载入人类科技史! Astra发布之时,OpenAI联合创始人兼总裁Greg Brockman宣言: 我想,历史会证明就是这个模型了。各位,欢迎来到AGI时代。 伴…
-
首批GPT-6内测结果好离谱啊。。。
石破天惊的GPT-6终于来了,只是使用资格还在分批开放。 好在,一批抢先上手的内测玩家,已经替大家把它狠狠折腾了一遍!! 知名开发者Pietro Schirano上来就给Astra…
-
全网实测开玩Fable 5.1,听说写作说话和真人没区别?
Anthropic前脚刚发布了Fable 5.1,后脚第三方权威跑分和个人第一手实测已经出炉了! Anthropic研究员就展示了用Fable 5.1写代码,直接生成设计视频: 看…
-
实测OpenClaw 2.0:“龙虾”史上最大更新,网友:爱过,我选Hermes
今天中午,沉寂许久的OpenClaw带着全新2.0版本杀回开源圈。 为什么是“杀回”?因为它真的红极一时,又迅速无人问津,有人直言,从Hermes出来以后,就再也没用过龙虾了。 细…
-
智谱 GLM-5.3-Flash 测评
短的结论:江山代有才人出 基本情况: 曾经的低价战神 DeepSeek 在涨价之后,同档位模型就再也没有明显的性价比之选。随后的 GLM-5.3 提质不提价,综合下来竟成了性价比先…