AI资讯新闻榜单内容搜索-Udio

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: Udio
谷歌深夜偷袭OpenAI!白菜价打赢Pro

谷歌深夜偷袭OpenAI!白菜价打赢Pro

谷歌深夜偷袭OpenAI!白菜价打赢Pro

谷歌推出Nano Banana 2.1,出图价为Nano Banana 2的一半,支持蒙版局部编辑、最高4K直出和最多14张参考图,并在Arena多图编辑榜排名第4,陆续登陆Gemini App、搜索AI模式、AI Studio等平台。

来自主题: AI资讯
9485 点击    2026-10-07 15:22
Utopai Studios,全球最大AI影视公司的“皮克斯野心”

Utopai Studios,全球最大AI影视公司的“皮克斯野心”

Utopai Studios,全球最大AI影视公司的“皮克斯野心”

Utopai Studios正以Utopai X和PAI将模型生成、素材管理及专业协作纳入同一电影制作流程,并规划三部2027年院线片,同时拓展DeNA合作与体育IP开发。

来自主题: AI资讯
9004 点击    2026-10-07 15:19
一家影视公司为什么能做出全球第二的视频模型?答案藏在「生产系统」里

一家影视公司为什么能做出全球第二的视频模型?答案藏在「生产系统」里

一家影视公司为什么能做出全球第二的视频模型?答案藏在「生产系统」里

Utopai Studios打造的Utopai X在Artificial Analysis Video Arena盲评中以1150 Elo位列全球第二,其核心竞争力是将模型深度集成PAI制作系统,并通过真实影视项目、专家反馈与系统迭代形成持续进化的数据飞轮。

来自主题: AI资讯
8083 点击    2026-10-06 14:39
Manus表明AI应用只剩三件事

Manus表明AI应用只剩三件事

Manus表明AI应用只剩三件事

Manus发布2.0版本全家桶产品,包含新agent架构Cascade、面向工作创作的Manus Studio及个人智能体Cue,表明AI应用几乎只剩Coding/办公、视频/游戏与个人智能体三件事,并宣布组建团队开发面向国内市场的产品。

来自主题: AI资讯
8533 点击    2026-09-30 11:54
口语转录,一步到位!全国产算力语音识别模型,听得懂上下文了

口语转录,一步到位!全国产算力语音识别模型,听得懂上下文了

口语转录,一步到位!全国产算力语音识别模型,听得懂上下文了

科大讯飞推出基于全国产算力训练的语音识别大模型Spark-ASR-2.0,依托语音基座大模型Spark-Audio-1.0-Preview,在方言免切换识别、嘈杂环境、上下文纠错和口语规范化等方面均有提升,整体推理成本较Spark-ASR-1.0仅增10%,已上线讯飞输入法并通过讯飞开放平台提供API服务。

来自主题: AI资讯
10097 点击    2026-09-25 10:14
Microduck 爆火之后,我们和它背后的制造团队聊了聊 AI 时代的硬件创业

Microduck 爆火之后,我们和它背后的制造团队聊了聊 AI 时代的硬件创业

Microduck 爆火之后,我们和它背后的制造团队聊了聊 AI 时代的硬件创业

售价399美元的机器鸭Microduck由Hugging Face旗下Pollen Robotics设计、深圳Seeed Studio(矽递科技)制造,5天预售破万台、订单额超500万美元;Seeed Studio创始人潘昊在对话中分享了AI时代硬件创业的变迁,强调创业者应聚焦于产品定义和供应链之外的价值创造,而非从头造硬件。

来自主题: AI资讯
9373 点击    2026-09-20 15:08
谷歌连发两款实时语音模型:Gemini 3.8 Live 要攻克语音 Agent 的沉默时刻

谷歌连发两款实时语音模型:Gemini 3.8 Live 要攻克语音 Agent 的沉默时刻

谷歌连发两款实时语音模型:Gemini 3.8 Live 要攻克语音 Agent 的沉默时刻

谷歌发布 Gemini 3.8 Live 与 Gemini 3.8 Live Extended Thinking 两款实时语音模型,后者支持后台异步推理与工具调用以解决语音 Agent 在任务执行中的沉默问题,两款模型已在 Gemini API 和 Google AI Studio 向开发者开放。

来自主题: AI资讯
9248 点击    2026-09-16 11:43
刚刚,中国语音AI连拿多项全球第一!

刚刚,中国语音AI连拿多项全球第一!

刚刚,中国语音AI连拿多项全球第一!

地铁急刹,金属尖叫,广播响起「请乘客注意扶稳」,人群骚动、孩子哭声、对讲机杂音一层层涌上来···

来自主题: AI资讯
8536 点击    2026-09-16 10:09
Fish Audio:上海00后闷声干翻ElevenLabs

Fish Audio:上海00后闷声干翻ElevenLabs

Fish Audio:上海00后闷声干翻ElevenLabs

Fish Audio(上海奇塔灵动科技)由00后廖世嘉带领22人团队,凭借开源语音模型Fish Speech在TTS Arena盲听榜连续7个月第一,年化收入达2100万美元,2026年7月获今日资本领投5200万美元种子轮。

来自主题: AI资讯
8600 点击    2026-09-12 10:00