← 标签
#research (54)
GEN-1:机器人可切换末端执行器实现物理推理
GEN-1末端执行器end effector工具切换tool changer
动态NVS:从记忆中恢复3D视角隐藏区域
神经视角合成NVSNeural View Synthesis3D video3D broadcast
现代MobED:为崎岖地形和真实任务打造的AI机器人
现代HyundaiMobED崎岖地形rough terrain
X-Humanoid发布TG-VLA赋予人形机器人类人智能
VLATG-VLAX-Humanoid人形机器人humanoid
Argus:室内全景3D度量重建的前馈网络
3D重建3D reconstruction全景panoramicArgus
AlayaWorld:15B参数可玩视频世界生成模型
world modelAlayaWorld视频生成video generation15B
JoyAI-VL-Interaction:8B视觉驱动实时交互模型
VL模型JoyAI-VL8B京东JD
GEN-1:支持多种末端执行器的具身基础模型
具身智能embodied AIGEN-1基础模型foundation model
FLUX 3:Black Forest Labs发布真实世界模型
FLUX 3Black Forest Labs世界模型world model多模态
模仿+强化学习实现抗干扰毛巾折叠
模仿学习imitation learning强化学习reinforcement learning操控
Astribot发布Lumo-2世界动作模型
世界动作模型WAMLumo-2AstribotQwen
实时3D模型操控转女性形象
实时视频生成Lucy 2.53D avatarvideo generationresearch
氦气浮力软体机器人:安静室内移动的陪伴助手
软体机器人soft robot氦气helium浮力
FARO:人形机器人全身运动优化框架
人形机器人FARO运动优化whole-body motionmotion planning
Agentic Real2Sim:从单段视频重建物理仿真器
world modelAgentic Real2Simphysics simulationVLAresearch
ABot-World-0:单张桌面GPU无限交互式世界推演
world modelABot-World-0视频生成video generation动作条件
中国智能黑板:AI读手写公式并生成3D可视化
智能黑板smart blackboardAI教育教育技术edtech
具身推理模型持续提升
具身智能embodied AI推理reasoningresearch
强化学习为何样本效率极低
强化学习reinforcement learningsample efficiencyworld model奖励学习
Patch Policy:0.7%参数量超越OpenVLA-OFT
VLAPatch PolicyViTOpenVLAmanipulation
FARO:人形机器人运动规划框架
人形机器人运动规划FAROmotion planninghumanoid
SceniX加入World Labs 空间智能迈向交互
空间智能World LabsSceniXFei-Fei Liresearch
SuperSplat Editor 2.32.0发布:新增定向工具
SuperSplat3D Gaussian Splatting编辑器editorPlayCanvas
3D高斯泼溅公寓:21KB体素碰撞实现可行走
3D Gaussian Splatting体素碰撞voxel collisionWebGPUSuperSplat
AI生成服装+UE5.8 Chaos Cloth实现流畅角色流程
UE5Chaos ClothAI生成角色流程Unreal Engine
ARDY语音交互:接入Godot实现语音控制
ARDY语音交互speech-to-speechGodotvoice control
Orbis 2:驾驶分层世界模型
世界模型world model驾驶driving分层
自动驾驶场景生成综述
自动驾驶autonomous driving场景生成scenario generationresearch
编程智能体需要可执行世界模型来解决ARC-AGI-3吗?
ARC-AGI编程智能体coding agent世界模型world model
走向人工神经:仿生光纤触觉感知
触觉感知tactile sensingOptiTac仿生biomimetic
Handroid:连接灵巧手与人形机器人
灵巧手dexterous hand人形机器人humanoidHandroid
AeroAct:语言条件四旋翼飞行的世界-动作模型
无人机UAV四旋翼quadrotor世界模型
EgoExoMoCap:分布式第一人称-第三人称人体动捕
动捕motion capture第一人称egocentric具身AI
自动驾驶测试数据集与基准综述
自动驾驶autonomous driving数据集datasetbenchmark
Vision-Language-Motion Maps:3D场景地图的运动属性
3D地图VLMM开放词汇open-vocabulary运动属性
Bake It Till You Make It:超快空间纹理图谱高斯泼溅
3D Gaussian Splatting纹理图谱texture atlas4K实时渲染
Ego Scene Augmentation:增强多模态大模型第一人称空间感知
MLLM第一人称egocentricVQA空间感知
VTLoc:视觉点云中的触觉接触定位
触觉感知tactile视觉点云point cloud
自动驾驶仿真测试综述
自动驾驶autonomous driving仿真simulationtesting
BayesContact:视觉-触觉提议与仿真推断的不确定姿态估计
触觉感知tactile姿态估计pose estimation仿真推断
CosFly-VLA:空间感知的无人机跟踪视觉-语言-动作模型
无人机UAVVLA目标跟踪tracking
DSWorld:高效自主智能体的数据科学世界模型
世界模型world model数据科学data science自主智能体
基于仿真的触觉感知与操作推断
触觉感知tactile仿真simulationmanipulation
人形机器人行为基础模型的扩展
人形机器人humanoid行为基础模型BFM全身控制
E3DGS:3D高斯泼溅的几何-光度等变性统一
3D Gaussian Splatting等变性equivariance几何geometry
MotionForesight:视频模型预测未来3D场景流
运动预测motion prediction3D场景流scene flow视频模型
让身体跟随:全身机器人遥操作的耦合第一人称控制
遥操作teleoperation全身控制whole-body第一人称
加速度CBF-QP:强化学习策略安全执行框架
强化学习RL安全safetyCBF-QP
ImprovedVBGS:实时持续变分贝叶斯高斯泼溅
3D Gaussian Splatting变分贝叶斯实时重建real-timerobotics
图处理器上渲染3D高斯
3D Gaussian SplattingIPU图处理器渲染rendering
Open-AoE:开放具身操控数据集与工具链
egocentric具身学习embodied learning数据集dataset
JoyNexus:VLA模型面向服务的多租户后训练
VLA后训练post-training多租户multi-tenant
超越单一专家:MLLM空间理解中多样视觉先验的协调
MLLM空间理解spatial understanding视觉先验visual prior
Exo2EgoPose:外视角演示引导的第一人称手部姿态预测
第一人称egocentric手部姿态hand poseVLM