AI产品测评-这里有最详细的人工智能工具测评解析

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
告别版本号!豆包首款无限进步模型:Seed-Evolving实测

告别版本号!豆包首款无限进步模型:Seed-Evolving实测

告别版本号!豆包首款无限进步模型:Seed-Evolving实测

大家好,我是袋鼠帝。 前几天,火山的朋友提前跟我同步了一个消息,说豆包Seed模型又更新了。

来自主题: AI产品测评
10065 点击    2026-07-17 11:05
豆包、WorkBuddy、QoderWork怎么选?我用8个真实办公任务把三家桌面Agent测明白了

豆包、WorkBuddy、QoderWork怎么选?我用8个真实办公任务把三家桌面Agent测明白了

豆包、WorkBuddy、QoderWork怎么选?我用8个真实办公任务把三家桌面Agent测明白了

过去半年,国产大厂扎堆发布一种新东西:桌面Agent。如果你最近在刷相关讨论,会发现 WorkBuddy、豆包专业版、QoderWork 这三个名字出现得特别频繁。如果一个普通办公用户今天就想选一款桌面 Agent,到底该先试谁?

来自主题: AI产品测评
11950 点击    2026-07-14 12:22
用Grok 4.5 连写了 7 个小项目,发现它最大的优势不是代码

用Grok 4.5 连写了 7 个小项目,发现它最大的优势不是代码

用Grok 4.5 连写了 7 个小项目,发现它最大的优势不是代码

7 月 8 日,xAI 发布了 Grok 4.5。马斯克给的定位很直白,「Opus 级别,但更快,更便宜」。

来自主题: AI产品测评
10924 点击    2026-07-14 11:08
实测完这个国产 AI 生图,我发现了下一个刷屏玩法

实测完这个国产 AI 生图,我发现了下一个刷屏玩法

实测完这个国产 AI 生图,我发现了下一个刷屏玩法

AI 生图最难的地方,早就从「生成一张好看的图」变成了「把那张差一点的图改对」。

来自主题: AI产品测评
9340 点击    2026-07-13 15:30
一个人+一个Agent,我把开店要的图全跑通了,方法全公开

一个人+一个Agent,我把开店要的图全跑通了,方法全公开

一个人+一个Agent,我把开店要的图全跑通了,方法全公开

大家好,我是冷逸。 前段时间,我设计了一家民宿「冷同学的院子」,视觉还算有点意思,不少朋友跑来问设计上的事。也有人问我:要是自己网上开店,有没有那种“够简单、说一句就能出设计”的电商工具?

来自主题: AI产品测评
7312 点击    2026-07-13 09:43
深度测评:Trae、WorkBuddy、ZCode,谁才是打工人真命天子?

深度测评:Trae、WorkBuddy、ZCode,谁才是打工人真命天子?

深度测评:Trae、WorkBuddy、ZCode,谁才是打工人真命天子?

我自己花时间,把三款主流国产桌面 Agent 从头到尾测了一遍:Trae、WorkBuddy、ZCode。用三个最日常的工作任务——做 PPT、分析表格、写小游戏,看看它们到底能不能帮普通打工人干活。这篇文章就是完整的实测记录,希望对你选工具有点帮助。

来自主题: AI产品测评
11143 点击    2026-07-12 10:08
实测 ChatGPT Work vs Claude Cowork,OpenAI 这次真追上来了

实测 ChatGPT Work vs Claude Cowork,OpenAI 这次真追上来了

实测 ChatGPT Work vs Claude Cowork,OpenAI 这次真追上来了

7 月 9 日,OpenAI 一口气发了三样东西,新模型 GPT-5.6,一个把 Chat、Work、Codex 装进同一个壳的新桌面应用,以及本文的主角 ChatGPT Work。官方的说法是,ChatGPT 从此不再只是回答问题,而是把活真正干完,交出来的不是聊天记录,是表格、文档、PPT,甚至一个能直接分享的网站。

来自主题: AI产品测评
9013 点击    2026-07-11 11:17
再测LongCat 2.0长任务,这次我让他在codex里面做了个游戏

再测LongCat 2.0长任务,这次我让他在codex里面做了个游戏

再测LongCat 2.0长任务,这次我让他在codex里面做了个游戏

上个月也就是昨天,我写了一篇LongCat 2.0的实测,用四个任务测了一下它的编程能力,当时我的评价是「有些地方惊艳,有些地方还差点意思」。

来自主题: AI产品测评
8546 点击    2026-07-02 10:36
智谱与Anthropic是母凭子贵

智谱与Anthropic是母凭子贵

智谱与Anthropic是母凭子贵

Anthropic增加绿卡认证后,最开心是智谱,直接原地化身战狼,高呼「前沿智能属于所有人」,提前把专注Coding的GLM5.2发了。

来自主题: AI产品测评
9451 点击    2026-06-24 16:36
Codex兼容国产开源模型!实测DeepSeek接入:门槛还是太高

Codex兼容国产开源模型!实测DeepSeek接入:门槛还是太高

Codex兼容国产开源模型!实测DeepSeek接入:门槛还是太高

6月17日,X 上 OpenAI Codex 团队负责人 Tibo(@thsottiaux)发了一条推文,提醒大家 Codex App、CLI 和 SDK 现在可以接任何开源模型,不只限于 OpenAI 自己的模型。

来自主题: AI产品测评
9202 点击    2026-06-24 10:53
Seed 2.1 Pro 测评,终于能胜任 Agent 工作了

Seed 2.1 Pro 测评,终于能胜任 Agent 工作了

Seed 2.1 Pro 测评,终于能胜任 Agent 工作了

今天 Seed 2.1 Pro 正式发布,我提前用它做了一些测试。

来自主题: AI产品测评
8144 点击    2026-06-24 10:30
实测豆包音频生成模型:语音模型的Seedance2.0时刻来了!

实测豆包音频生成模型:语音模型的Seedance2.0时刻来了!

实测豆包音频生成模型:语音模型的Seedance2.0时刻来了!

火山引擎今天上线了全新的语音模型—— 豆包音频生成模型 1.0(Seed-Audio 1.0)。

来自主题: AI产品测评
9545 点击    2026-06-24 10:29
实测 GLM-5.2 :Claude 5 关停后,它真能稳稳接住这波用户

实测 GLM-5.2 :Claude 5 关停后,它真能稳稳接住这波用户

实测 GLM-5.2 :Claude 5 关停后,它真能稳稳接住这波用户

前几天 Fable 5 对海外用户关停的时候,智谱突然宣布向 GLM Coding Plan 全量用户开放了 GLM-5.2,并表示「前沿智能不应只属于少数人,也不应被少数规则随手收回。」

来自主题: AI产品测评
7796 点击    2026-06-17 14:28
字节最便宜视频模型Seedance 2.0 Mini来了!1.6毛/秒,比Fast快,实测让黄仁勋和豆包一起踢球

字节最便宜视频模型Seedance 2.0 Mini来了!1.6毛/秒,比Fast快,实测让黄仁勋和豆包一起踢球

字节最便宜视频模型Seedance 2.0 Mini来了!1.6毛/秒,比Fast快,实测让黄仁勋和豆包一起踢球

昨晚,字节新模型Seedance 2.0 Mini深夜来袭,该模型主打性价比,侧重于提供更低的价格以及更快的生成速度。Seedance 2.0 Mini虽然定价更低,但保留了核心能力参考生成,用户可以通过融合提示词与最多12个多种模态的参考素材(包括6张图片、3段音频、3段视频)来锁定人物一致性、精细化控制运动轨迹、卡准剧情节奏。

来自主题: AI产品测评
10337 点击    2026-06-16 14:41
最近的流量焦虑,被这两个开源Skill解决了。

最近的流量焦虑,被这两个开源Skill解决了。

最近的流量焦虑,被这两个开源Skill解决了。

大家好,我是袋鼠帝 前两天一个朋友问我,怎么边工作,边把自媒体持续做下去,还能做得好。

来自主题: AI产品测评
6979 点击    2026-06-16 14:17
实测 OiiOii 2.0:让AI视频创作者少折腾一点

实测 OiiOii 2.0:让AI视频创作者少折腾一点

实测 OiiOii 2.0:让AI视频创作者少折腾一点

Agent + 无限画布带来的想象力。

来自主题: AI产品测评
9679 点击    2026-06-16 13:58
实测GLM-5.2,国产Coding模型的又一座新高峰。

实测GLM-5.2,国产Coding模型的又一座新高峰。

实测GLM-5.2,国产Coding模型的又一座新高峰。

最近整个世界的魔幻程度,真的让人唏嘘。 今天早上,Anthropic收到了美国商务部的一封信。 信的内容很简单,以国家安全为由,要求Anthropic立刻暂停所有外国公民对Fable 5和Mythos

来自主题: AI产品测评
10104 点击    2026-06-13 22:54
实测小米最快1T大模型:吞吐量每秒1000+ Tokens,Vibe Coding七秒交付

实测小米最快1T大模型:吞吐量每秒1000+ Tokens,Vibe Coding七秒交付

实测小米最快1T大模型:吞吐量每秒1000+ Tokens,Vibe Coding七秒交付

全球大模型的军备竞赛,正在“智商”之外开辟新的战场—— 推理速度。

来自主题: AI产品测评
7890 点击    2026-06-11 09:58
实测Claude史上最强模型Fable 5,普通人慎用

实测Claude史上最强模型Fable 5,普通人慎用

实测Claude史上最强模型Fable 5,普通人慎用

对普通人最坏的消息要来了。

来自主题: AI产品测评
11472 点击    2026-06-10 10:32
实测CodeX 3大更新,OpenAI"准超级应用”"杀死比赛?

实测CodeX 3大更新,OpenAI"准超级应用”"杀死比赛?

实测CodeX 3大更新,OpenAI"准超级应用”"杀死比赛?

在ChatGPT拥有10亿用户后,AI问答这一定位,显然已经难以撑起其下一阶段的增长。另一方面,Codex每周活跃用户已超500万。很多人囿于名字,以为这是Coding产品。。。。限制了其在编程圈外的增长。

来自主题: AI产品测评
12130 点击    2026-06-05 09:26