评测组小编
-
实测最新版「豆包手机」助手:所有手机里的AI都该变成它这样
豆包手机助手消费者版今天正式发布。 搭配了它的手机长这个样子: 搭配了豆包手机助手消费者版的努比亚 NaviX Ultra 将在 9 月 16 日发布 和预览版相比,官方对这个助手…
-
DeepSeek V4.1 Flash 测评
短的结论:最是一年春好处 基本情况: DeepSeek 与众不同的是,他们热衷,并且擅长通过底层创新来提效,在这样持续不懈努力之下,即便会走一些弯路,但最终都会做出突破性的成绩。这…
-
豆包工作这波更新,我给满分!一大波实测来了
新智元报道 AI圈现在卷得最凶的地方,是你的电脑桌面。 OpenAI不断强化桌面端应用,试图用Codex和ChatGPT for Work接管打工人的工作流。 Anthropic更…
-
DeepSeek V4.1 Flash实测,花3亿token,14组任务,居然比上代贵
家人们,DeepSeek V4.1 Flash开启内测了。 内测问卷里有道题,把我看乐了。官方直接问,这个模型能不能全面替换线上的DeepSeek V4 Pro。 上次我测完V4 …
-
实测完GPT6,AGI还没来,但我真瘫坐在地上
GPT-6 Astra 今天全量开放了。Plus 和 Business 用户也都能用上了。 看完 X 上那些演示,很难不想自己上手爽蹬一把。 糖豆人式的闯关游戏、铺满楼房和道路的模…
-
实测GPT-6:AGI真来了!OpenAI缔造者都摸不到天花板
新智元报道 今夜将载入人类科技史! Astra发布之时,OpenAI联合创始人兼总裁Greg Brockman宣言: 我想,历史会证明就是这个模型了。各位,欢迎来到AGI时代。 伴…
-
首批GPT-6内测结果好离谱啊。。。
石破天惊的GPT-6终于来了,只是使用资格还在分批开放。 好在,一批抢先上手的内测玩家,已经替大家把它狠狠折腾了一遍!! 知名开发者Pietro Schirano上来就给Astra…
-
全网实测开玩Fable 5.1,听说写作说话和真人没区别?
Anthropic前脚刚发布了Fable 5.1,后脚第三方权威跑分和个人第一手实测已经出炉了! Anthropic研究员就展示了用Fable 5.1写代码,直接生成设计视频: 看…
-
实测OpenClaw 2.0:“龙虾”史上最大更新,网友:爱过,我选Hermes
今天中午,沉寂许久的OpenClaw带着全新2.0版本杀回开源圈。 为什么是“杀回”?因为它真的红极一时,又迅速无人问津,有人直言,从Hermes出来以后,就再也没用过龙虾了。 细…
-
智谱 GLM-5.3-Flash 测评
短的结论:江山代有才人出 基本情况: 曾经的低价战神 DeepSeek 在涨价之后,同档位模型就再也没有明显的性价比之选。随后的 GLM-5.3 提质不提价,综合下来竟成了性价比先…
-
深度体验豆包工作48小时,我发现通用Agent搞不定的企业场景,它有了新解法
AI办公赛道早已人头攒动,从通用大模型产品到各类垂直Agent,都在争抢“帮人上班”这件事。但字节跳动这次入场的打法有点不同,它将豆包在C端积累的自然交互能力与多模态生成优势,与飞…
-
深度实测「豆包工作」+飞书:目前最接近企业Agent终局的答案
深度实测后,我们最直白的结论是: 它与飞书的深度打通,给出了目前Agent进入组织的一份最佳答案。 当主流办公Agent都会处理文件、调用工具、生成网页,基础能力越来越接近时,真正…