AI资讯新闻榜单内容搜索-8

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 8
AI几年内或超越所有人类!Claude核心研究员预测

AI几年内或超越所有人类!Claude核心研究员预测

AI几年内或超越所有人类!Claude核心研究员预测

Anthropic强化学习技术负责人Sholto Douglas预测,能力等于甚至超过所有人类的AGI可能在未来几年内出现,2028年AI年度资本开支或达4万亿美元,而研究员Nick Marwell对AI无需人类搭档后的后果表示紧张。

来自主题: AI资讯
10228 点击    2026-10-07 15:17
800亿!曝DeepSeek新融资,即将IPO

800亿!曝DeepSeek新融资,即将IPO

800亿!曝DeepSeek新融资,即将IPO

据彭博社报道,DeepSeek即将敲定至少800亿元人民币的新一轮融资,腾讯和宁德时代承诺出资金额居前,该轮融资拟为2027年初IPO铺路,但最终条款仍未确定。

来自主题: AI资讯
10406 点击    2026-10-06 16:54
OpenAI「疯狂28天」首日,这都发了些啥啊…

OpenAI「疯狂28天」首日,这都发了些啥啊…

OpenAI「疯狂28天」首日,这都发了些啥啊…

OpenAI开启Codex“疯狂28天”计划,首日宣称将GPT-6 Astra和GPT-6.1 Sol默认推理速度提升约50%至50TPS,但用户实测低于预期,叠加ChatGPT测试广告、欧盟文本隐形水印及订阅调整引发质疑。

来自主题: AI资讯
8617 点击    2026-10-06 15:57
黎曼猜想临界线零点比例下界达67.35%:清华团队开源模型VeriLoop E2叩开可验证智能之门

黎曼猜想临界线零点比例下界达67.35%:清华团队开源模型VeriLoop E2叩开可验证智能之门

黎曼猜想临界线零点比例下界达67.35%:清华团队开源模型VeriLoop E2叩开可验证智能之门

清华团队开源以Qwen 3.8-27B为基础模型的VeriLoop E2,通过VGR外部证据门控实现可验证状态提交,并取得黎曼猜想临界线零点比例下界67.350003708785593%的严格有限维证书,但上游形式化桥接尚未完成。

来自主题: AI技术研报
8898 点击    2026-10-06 15:56
Jev被请下王座,StartLux中国开源决策模型冲上第一

Jev被请下王座,StartLux中国开源决策模型冲上第一

Jev被请下王座,StartLux中国开源决策模型冲上第一

StartLux发布完全开源的StartLux-Decision,其27B版本在Decision Index 0.2.1的38项基准中有31项超过Jev 1.13,并以63.88分升至公开榜首。

来自主题: AI资讯
8767 点击    2026-10-06 14:39
Karpathy的新玩法!40年前的航空规范,救了爱说废话的AI

Karpathy的新玩法!40年前的航空规范,救了爱说废话的AI

Karpathy的新玩法!40年前的航空规范,救了爱说废话的AI

Karpathy建议让LLM采用约80%的ASD-STE100规范,并生成图示、HTML交互页面或定制讲解视频,将输出转化为更清晰易懂的软件产物。

来自主题: AI资讯
8416 点击    2026-10-06 14:37
点头、抢话、会脸红,一半人分辨不出这是位「AI 小姐姐」

点头、抢话、会脸红,一半人分辨不出这是位「AI 小姐姐」

点头、抢话、会脸红,一半人分辨不出这是位「AI 小姐姐」

Tavus发布全双工视频到视频交互模型Griffin,可实时生成720p数字人并理解停顿、表情与动作,在一分钟测试中让54名参与者近48%误以为在与人交谈,但该结果未独立验证且模型尚未公开。

来自主题: AI资讯
8471 点击    2026-10-06 14:36
哈佛教授90天横扫18个学科,Claude神助攻!连开36篇论文

哈佛教授90天横扫18个学科,Claude神助攻!连开36篇论文

哈佛教授90天横扫18个学科,Claude神助攻!连开36篇论文

哈佛物理学家Matthew Schwartz用Claude和开源工具BootLoops处理可验证的科研任务,90天产出横跨18个学科的36篇论文初稿,并主张由人挑题、追问和验收,让AI发挥辅助而非替代科学家的作用。

来自主题: AI资讯
10393 点击    2026-10-05 23:31
看懂不等于做对:VA-Bench测出大模型空间智能的执行断层

看懂不等于做对:VA-Bench测出大模型空间智能的执行断层

看懂不等于做对:VA-Bench测出大模型空间智能的执行断层

VA-Bench测试12个主要多模态模型发现,Qwen3.8-max、Opus-5和GPT-5.6-sol虽在目标识别与定位上达100%、操作语义理解达99.6%—100%,完整任务成功率却仅为53.93%、52.86%和51.55%,暴露大模型从空间理解到执行与修正的断层。

来自主题: AI技术研报
9263 点击    2026-10-05 23:29
放养AI练棋,Claude暴涨250分!GPT-6越练越菜

放养AI练棋,Claude暴涨250分!GPT-6越练越菜

放养AI练棋,Claude暴涨250分!GPT-6越练越菜

大模型竞技场Arena让Claude Opus 5.5与GPT-6 Astra各自练棋200局,前者估算评分从约1500升至1760,后者从第29盘的1810降至1400,显示AI仅靠记录与复盘提升能力的表现并不一致。

来自主题: AI资讯
8565 点击    2026-10-05 23:29