港科大Apple新研究:Tokens使用量减少,模型推理还更强了
港科大Apple新研究:Tokens使用量减少,模型推理还更强了1+1等于几?
搜索
1+1等于几?
王潜曾在美国创立量化基金,可“晚上经常睡不着想做机器人”,2023年,他解散了基金,回国创业。
在日益强调“思维能力”的大语言模型时代,如何让模型在“难”的问题上展开推理,而不是无差别地“想个不停”,成为当前智能推理研究的重要课题。
您是否遇到过这样的困扰:明明搭建了完善的RAG系统,但Agent总是回答过时的信息,或者面对历史偏好变化时一脸茫然?
去年行业信仰强共识,今年大家寻找非共识。
既能提升模型能力,又不显著增加内存和时间成本,LLM第三种Scaling Law被提出了。
2025年上半年,Agent成为大模型领域讨论最多的主题之一。
AI 就像一头野驴,跑起来就不停。人类花了几百万年才走上食物链顶端,而大模型只用了不到十年时间,已经能把你和刘亦菲 P 进一张自拍了。奥!最新进展是已经能自己生成音画同步的超真实脱口秀了。
医疗站在变革的关键节点,AI正渗透行业的每一个角落,为资源分布不均、诊疗效率不高等深层次难题提供解决方案
最顶尖的AI模型,做起奥数题来已经和人类相当,那做物理题水平如何呢?港大等机构的研究发现:即使GPT-4o、Claude 3.7 Sonnet这样的最强模型,做物理题也翻车了,准确率直接被人类专家碾压!