标签:泛化能力

经得起观众「刁难」,扛得住宁德「检验」:WAIC后重新认识苏度

在2026年世界人工智能大会上,苏度科技通过生活与工业两大展区,全面展示了其在具身智能领域的最新技术成果与商业化进展。生活展区以完全开放交互的形式,验...

视频通用模型来了!DeepMind 再证「生成即理解」,何恺明参与

传统视频理解方法通常通过逐层剥离信息来完成任务,容易引发数据难以对齐和误差累积等问题。为解决此痛点,谷歌DeepMind提出GenCeption系统,将视频生成模型...

Claude团队用Qwen测试全新训练方法

多维度实验数据充分验证了该范式的实际效能与数据优势。在价值观导向测试中,研究人员为模型输入完全相同的偏好数据,仅因训练阶段植入的规范导向不同,模型...

超百万算力、72小时、近百台真机:具身智能的刷分时代,被一场「裸考」终结

本次全球首届具身智能开发者大会(EAIDC)暨「具亮计划」黑客松决赛于3月30日收官,是全球首个将真实环境与真实任务写入赛制的大规模具身智能赛事。20支来自...

弯道超车?国产具身,千小时人类数据激发智能涌现

当前具身智能领域,硅谷多家头部科技企业已形成新的行业共识:提升机器人灵巧性与泛化能力的核心,是堆积更多人类第一视角数据而非机器人真机数据。这些企业...

刚刚,宇树又宣布开源了

宇树科技正式开源其通用人形机器人操作大模型UnifoLM-VLA-0,该模型通过持续预训练实现了单一策略完成多项复杂长程操作任务的能力。模型在空间感知方面表现突...

Veo何止生成视频:DeepMind正在用它模拟整个机器人世界

通用型机器人策略的发展带来了高效的任务执行能力,但也面临真实世界评估成本高、安全性测试困难等挑战。传统的物理仿真器在真实感和多样性上存在局限,而视...

1100多个模型殊途同归,指向一个「通用子空间」,柏拉图又赢一回?

研究发现,不同神经网络在训练过程中会收敛到共享的低维子空间,表明存在一种先验的数学结构,架构对学习结果的影响可能比数据更大。约翰斯・霍普金斯大学的...

奖励模型也能Scaling!上海AI Lab突破强化学习短板,提出策略判别学习新范式

强化学习已成为推动人工智能向通用人工智能(AGI)发展的关键技术节点,但奖励模型的设计与训练一直是制约模型能力提升的瓶颈。当前,大语言模型通过Next Tok...

奖励模型终于迎来预训练新时代!上海AI Lab、复旦POLAR,开启Scaling新范式

在大语言模型的后训练阶段,强化学习是提升模型能力、对齐人类偏好的核心方法,但奖励模型的设计与训练仍是关键瓶颈。当前主流方法包括“基于偏好的奖励建模”...
1 2 3 4