中国95后团队发布首个Agentic浏览器-Fellou,超越浏览,直达行动
中国95后团队发布首个Agentic浏览器-Fellou,超越浏览,直达行动Fellou: 世界首个 Agentic Browser —— 超越浏览,直达行动 Beyond Browsing, Into Action
搜索
Fellou: 世界首个 Agentic Browser —— 超越浏览,直达行动 Beyond Browsing, Into Action
在全球AI技术加速重构产业格局的浪潮中,AI for Science(AI4S)赛道明星企业深度原理 Deep Principle 近日正式宣布完成亿元级Pre-A轮战略融资,本轮投资方包括联想创投、联想之星、锦秋基金、BV百度风投、启高资本,公司股东高瓴创投与线性资本持续追加投资,明德资本担任独家财务顾问。
游戏开发不仅需要生成新颖的内容,更需要在保持游戏世界一致性、多样性和用户修改持续性方面达到高度平衡。近日,一篇发表在Nature上的研究论文World and Human Action Models towards Gameplay Ideation揭示了如何利用生成式AI模型推动游戏玩法创意的生成。
AI正往行业深处进发,尤其是以往自动化和智能化程度较低的制造业。
近年来,视觉语言基础模型(Vision Language Models, VLMs)大放异彩,在多模态理解和推理上展现出了超强能力。现在,更加酷炫的视觉语言动作模型(Vision-Language-Action Models, VLAs)来了!通过为 VLMs 加上动作预测模块,VLAs 不仅能 “看” 懂和 “说” 清,还能 “动” 起来,为机器人领域开启了新玩法!
近年来,视觉-语言-动作模型(Vision-Language-Action, VLA)在诸多机器人任务上取得了显著的进展,但它们仍面临一些关键问题,例如由于仅依赖从成功的执行轨迹中进行行为克隆,导致对新任务的泛化能力较差。
在大语言模型和 AIGC 的热潮下,科研人员对构建「视觉对话智能体」(Visual Chat Agent)展现出极大兴趣。其中,可实时交互的人像生成技术(Audio-Driven Real-Time Interactive Head Generation)是实现链路中极为关键的一环。
从事客服行业的人,经常要应对巨大的心理压力。不仅要迅速处理客户提出的各种问题,还经常会遇到态度恶劣的“麻烦客户”,这往往让一整天的心情都变得糟糕透顶。结果,就是客服岗位的离职率和人员流动率居高不下,企业很难留住合适的人才。
别说什么“没数据就去标注啊,没钱标注就别做大模型啊”这种风凉话,有些人数据不足也能做大模型,是因为有野心,就能想出来稀缺数据场景下的大模型解决方案,或者整理出本文将要介绍的 "Practical Guide to Fine-tuning with Limited Data" 这样的综述。
颠覆现有Agent范式、让AI拥有“主动能动性! 清华&面壁等团队最新开源新一代主动Agent交互范式 ( ProActive Agent)。