AI工具大测评:你常用的AI究竟排在哪里?
AI工具的排名大战已经愈演愈烈。
谁才是AI写作的王者?
谁又是AI绘画的高手?
哪款AI做PPT最靠谱?
学生党该装哪些AI?
上班族究竟该留哪几个?
甚至已经有人开始给各种AI工具制作“综合榜单”。
这件事让我感到有些恍惚。
AI才火了几年,怎么就已经像手机、耳机和咖啡一样,需要一张排行榜来告诉我们:
“你该选谁。”
于是我也想排一次。
不过这次不参考融资,不看参数,也不会拿一个看似很科学的数字告诉你:
A工具93分,B工具91分,所以A赢了。
这种排名其实毫无意义。
我更关心的是:
如果这些AI只能保留几个,我真正会留下谁?
如果只能留一个,我会选择ChatGPT。
不是因为它在所有事情上都稳操胜券。
而是因为你很难预知,今天究竟会遇到什么问题。
可能上午要起草一封邮件。
下午突然要分析一份文档。
晚上又想探究一个完全陌生的领域。
深夜甚至可能只是想问:
“为什么有些东西明明越来越便捷,人却越来越疲惫?”
你不必提前决定:
“今天是写作,所以打开写作AI。”
“今天是调研,所以打开调研AI。”
“今天是配图,所以打开生图AI。”
你只需把问题抛给它。
它更像一个AI超级入口。
从公开数据来看,这种“超级入口”地位也相当突出:AICPB按2026年6月App月活统计,ChatGPT全球月活逼近10亿,远超第二名豆包的3.24亿。citeturn0search0
所以这一票,我投给ChatGPT。
ChatGPT像一个超级入口。
Claude给我的感觉,则更像一个坐在旁边陪你协作的伙伴。
尤其是面对一项较长、较复杂的任务时。
不是:
“帮我写一段。”
而是:
“这是我的素材,这是我目前的思路,这是我不太满意的地方,我们一起把它打磨到可用。”
这种时候,一个AI究竟有多强,不仅取决于它第一句话有多出彩。
还取决于:
你们能否把一件事持续推进下去。
所以如果今天让我坐下来认真写一篇文章,或者处理一项复杂任务,我会把Claude放在身边。它未必适合所有人。但对于需要长期协作的人来说,它会非常有存在感。
豆包有一个很独特的优势。
它不像某些AI那样,要求你先弄懂什么是Prompt、Agent、工作流,然后才能开始使用。
你打开它。
说句话。
问个问题。
让它写点东西。
让它帮你查点资料。
事情就这么启动了。
2026年6月,AICPB的国内App榜里,豆包月活约3.24亿,位居国内AI应用前列。
而QuestMobile披露的2026年上半年数据里,豆包在国内AI原生App中同样处于非常靠前的位置。
这件事其实意义重大。
因为AI真正融入普通人的生活后,用户未必想知道:
“你是什么模型?”
他只想知道:
“我能不能直接上手?”
豆包在这件事上做得很巧妙。
所以如果这个奖叫:
“最易成为日常工具的AI”
我会颁给豆包。
搜索和聊天,其实是两码事。
你问:
“什么是强化学习?”
和你问:
“帮我梳理一下2025年以来AI Agent创业公司的演变。”
完全不是一个量级。
后者真正需要的不是一句漂亮回答。
而是:
检索、筛选、核实、持续追踪。
这也是AI搜索日益重要的原因。
如今ChatGPT、Gemini等产品也在不断向搜索和研究方向延伸。
所以Perplexity真正有趣之处,不只是“回答问题”。
而是它让AI开始有点像:
替你启动资料搜集的人。
当然,这个位置的竞争已经日趋白热化。
所以它未必能永远守住这里。
但至少目前,它仍然值得列入这张榜单。
这个奖我甚至不愿叫“生图能力第一”。
因为这种说法太乏味了。
我更想叫:
“最适合用来探索审美的AI。”
AI生图如今已经进入了一个很奇妙的阶段。
几年前:
AI竟然能画出来了!
现在:
为什么这个构图这么平庸?
这其实是一次巨大的跨越。
我们开始不再满足于:
“能不能生成。”
而开始探讨:
“有没有审美。”
Midjourney的优势一直在这里。
它让生图越来越像一种视觉冒险。
你不是只让AI替你画一张图。
而是在:
尝试构图。
尝试材质。
尝试光线。
尝试风格。
尝试各种你自己甚至未曾设想的可能。
所以如果你问:
“哪个AI让我最想继续探索?”
我会想到Midjourney。
如果说Midjourney让我想到“审美”。
即梦让我想到的则是:
内容生态。
AICPB的2026年6月国内App榜中,即梦AI月活约8736万,位列国内AI应用前列。
它背后的意义,不只是“又一个生图工具”。
因为它和抖音内容生态之间存在天然纽带。
于是:
AI图片。
AI视频。
短片。
创作。
传播。
这些元素开始被串联起来。
这时候你再看即梦,会发现它角逐的其实不只是:
“谁能生成一张更好看的图?”
而是:
“谁能成为中文内容创作者开启创作前,会打开的那个入口?”
这就完全是另一场较量了。
Lovart是我比较想单独列出的一个。
因为它折射出AI产品正在发生的一种转变。
以前AI设计工具解决的是:
“帮我生成一张图。”
现在越来越像:
“这件事你能不能替我搞定?”
找参考。
理解需求。
生成素材。
设计。
做网页。
做动效。
分层。
导出。
如果你把AI仅理解成一个“生成器”,Lovart会显得有些另类。
但如果你把它理解为:
一个试图嵌入完整设计工作流的Agent。
很多东西就豁然开朗了。
所以它不一定适合所有人。
但对于设计师而言,这类产品值得持续关注。
Gemini真正有趣之处,并不止于模型本身。
而是Google。
搜索。
地图。
文档。
邮箱。
图片。
视频。
各类信息服务。
这些资源本来就已经存在。
AI现在做的,是尝试把它们重新串联。
所以Gemini真正值得观察的问题不是:
“它和ChatGPT谁更聪明?”
这种比较其实会越来越无趣。
而是:
当一个AI背后依托一个庞大的信息生态,它最终能把这些资源串联到什么程度?
这或许才是Google真正精彩的牌局。
DeepSeek很特别。
因为它让许多原本不关心模型的人开始认真讨论:
原来AI之间真的会有差距。
但今天再看DeepSeek,问题已经发生变化。
以前大家问:
模型强不强?
现在大家越来越会问:
好不好用?
能不能完成任务?
有没有工作流?
能不能融入日常生活?
这意味着:
模型之战正在逐渐演变为产品之战。
从2026年6月的App榜来看,DeepSeek依然拥有超过1.39亿月活。
所以它依然是这份榜单里无法忽视的存在。
但它接下来真正需要证明的,可能已不止是模型能力。
而是:
一个模型如何蜕变为一个长期产品。
千问是另一个很值得关注的产品。
因为阿里本身就拥有电商、云、办公等大量业务。
所以千问真正值得观察的,也许不是:
“它回答问题表现如何?”
而是:
当一个庞大的商业生态开始拥有自己的AI入口后,会催生什么?
这也是当下AI竞争越来越精彩的地方。
过去大家比模型。
后来比产品。
现在开始比:
你身后究竟有什么。
2026年6月的AI应用榜里,千问全球月活约2.51亿,在国内App榜也位居前列。
它已不再是一个单纯的模型名称了。
这份榜单似乎有些单薄。
因为你仔细看:
ChatGPT适合做超级入口。
Claude适合长任务。
豆包适合日常使用。
Perplexity适合搜索。
Midjourney适合视觉探索。
即梦适合中文内容。
Lovart适合设计工作流。
Gemini背后是Google生态。
DeepSeek有模型能力。
千问背后是阿里生态。
那究竟谁第一?
如果我把Midjourney放在ChatGPT后面,是不是有失偏颇?
如果把豆包放在Claude前面,又该依据什么标准?
如果一个人根本不绘图,那么Midjourney排得再高,对他也没有价值。
这时候我才意识到:
AI工具可能根本不需要一张总排行榜。
手机可以比较:
屏幕。
续航。
芯片。
相机。
价格。
但AI越来越不像一个功能固定的产品。
它更像一组能力。
今天你需要写文章。
明天需要做PPT。
后天需要查资料。
周末突然想做一张海报。
你每一次打开AI,实际上都在抛出不同的问题。
所以真正合理的排行榜可能不是:
ChatGPT第一。
Claude第二。
Gemini第三。
而是:
写东西,我选谁?
查资料,我选谁?
做图,我选谁?
做视频,我选谁?
学习,我选谁?
认真干活,我选谁?
因为AI太多了。
多到普通用户已经不想再逐一了解它们。
于是我们开始把一个新问题交给别人:
“你替我挑。”
这件事其实非常耐人寻味。
因为过去互联网带给我们的是:
信息越来越丰富。
后来搜索引擎替我们找信息。
推荐算法替我们选内容。
如今AI越来越多以后:
连工具也开始需要被筛选。
于是排行榜应运而生。
它真正提供的可能不是“排名”。
而是:选择。
真正有价值的问题应该是:
“我今天要做的这件事,应该交给谁?”
这也是AI时代一个很奇妙的变化。
以前我们需要学习:
如何使用一个软件。
现在我们可能需要学习:
什么时候该用哪个软件。
这意味着,未来一个真正高明的AI用户,未必是装了最多软件的人。
而可能是:
他知道什么时候不用AI。
知道什么时候用ChatGPT。
知道什么时候换Claude。
知道什么时候打开生图工具。
知道什么时候应该自己检索原始资料。
甚至知道:
什么时候不该轻信AI给出的答案。
我不会让所有AI争一个总榜。
我会把它们放进不同的抽屉。
因为到了今天,
AI真正的竞争,或许已不是“谁最强”。
而是:
谁能在你需要它的那一刻,成为那个恰到好处的工具。