机器人又拿下一种家务:10小时学会煮咖啡,仅需观看人类演示视频
机器人又拿下一种家务:10小时学会煮咖啡,仅需观看人类演示视频上周斯坦福炒虾机器人炸场之后,又火了一个煮咖啡机器人。
搜索
上周斯坦福炒虾机器人炸场之后,又火了一个煮咖啡机器人。
如何从一段视频中找出感兴趣的片段?时序行为检测(Temporal Action Localization,TAL)是一种常用方法。过去TAL中的建模是片段甚至实例级的,而现在只要视频里的一帧就能实现,效果媲美全监督。
Vista-LLaMA 在处理长视频内容方面的显著优势,为视频分析领域带来了新的解决框架。
不久之前,《纽约时报》指控 OpenAI 涉嫌违规使用其内容用于人工智能开发的事件引起了社区极大的关注与讨论。
将2D扩散模型的强大图像生成能力与再绘策略的纹理对齐能力结合起来,Repaint123能够在2分钟内从零开始生成具有多视角一致性和精细纹理的高质量3D内容。
据知名苹果爆料人马克·古尔曼周日(1月7日)称,科技巨头苹果公司正准备在今年6月的全球开发者大会(WWDC)上推出一系列基于生成式人工智能(AI)的工具,这将是朝着未来迈出的一大步。
大模型推理再次跃升一个新台阶!最近,全新开源的国产SwiftInfer方案,不仅能让LLM处理无限流式输入,而且还将推理性能提升了46%。
版权法是一把悬在 AI 公司头上的利剑。当《纽约时报》正式宣布起诉 OpenAI 和微软侵权时,这把利剑的锋芒再度展露,似乎在预示着 2024 年又将是树立里程碑的一年。
近日,斯坦福华人团队的Mobile ALOHA“全能家务机器人”在网上爆火,它展示了做饭、铺床、浇花等多种家务技能,可谓是全复合“保姆人才”。
我对AI的信心从来没像这一刻这么强。这不是激进,能和这篇文章要一起看的是《为什么说AI现在还不行》,看着有点矛盾,但其实是一个事情的正反两面,统一于尺度判断。