DemoStart:新强化学习方法,通过少量模拟演示和稀疏奖励,让三指机械手的器人学习复杂操作行为
论文DemoStart: Demonstration-led auto-curriculum applied...
Read MoreAgentTorch:扩展基于代理的模型的新型框架,通过高效的计算方式可实现对百万级别代理的模拟
论文On the Limits of Agency in Agent-Based Models(《论基于代理的...
Read MoreMaskSR2:基于MaskSR,结合语义知识蒸馏和声学语言建模的全频带语音恢复生成框架
论文Joint Semantic Knowledge Distillation and Masked Acou...
Read More机器人效用模型(Robot Utility Models, RUM)实现零样本部署(Zero-Shot Deployment)
论文《Robot Utility Models: General Policies for Zero-Shot...
Read MoreOpenAI o1 系统说明(OpenAI o1 System Card)
OpenAI发布最新模型o1,其系统说明/系统卡(OpenAI o1 System Card)也相应发布。 O...
Read More“红队测试(Red Teaming)”用于人工智能(AI)系统的评估与测试
红队测试(Red Teaming)是一种源自网络安全领域的技术,近年来逐渐被应用于人工智能(AI)系统的评估与...
Read MoreUnreasonably Effective AI ,“超乎寻常有效”或“不合常理地有效”的AI
近期,Google DeepMind的联合创始人兼CEO Demis Hassabis与主持人Hannah F...
Read More








