共 35 篇相关文章

Generalist AI发布机器人基础模型GEN-1.5,实现one-shot learning能力,机器人仅需单次演示即可掌握新任务。本文深入解析其技术原理、数据效率提升及对工业制造、物流等领域的影响。

开源机器人联盟OSRA正式成立Physical AI SIG,推动ROS生态系统整合物理AI能力。本文解析Physical AI特别兴趣小组的目标、路线图及其对机器人开发者的深远影响。

深入解析球面傅里叶变换与球谐函数如何构建3D旋转等变AI。从Spherical CNN架构原理到全景影像、气象预测、蛋白质结构预测等应用场景,探索几何深度学习的前沿方向。

宇树G1人形机器人自主驾驶卡丁车视频引发争议。本文从技术可行性、视频剪辑痕迹、发布方背景等角度深度分析这段演示的真实性,并总结判断机器人演示真伪的实用方法。

基于NVIDIA Isaac Lab仿真平台,使用PPO算法对6自由度PiPER和7自由度NERO机械臂进行强化学习训练。涵盖64并行环境配置、末端到达与方块操作任务设计,以及Sim-to-Real部署规划的完整实践指南。

深度解析机器人学习三种主流数据采集方式:第一视角数据、UMI夹爪数据与遥操作数据的本质区别、优劣势及应用场景,帮助开发者理解具身智能领域的数据策略选择。

深度解析Pentagraph推出的4199美元Pandroid机器人、腾讯WorldClaw一句话生成可编辑3D世界技术,以及99美元ESP32口袋AI终端,探讨AI技术低成本化与普惠化趋势。

深入分析蒙特祖玛复仇在强化学习领域的研究现状,回顾Go-Explore、RND等关键突破,解读当前研究重心从攻克难题转向样本效率与通用智能体的趋势。

OpenAI宣布GPT-5.6 Luna向免费用户开放无限对话,Kimi K3成为首个接入GitHub Copilot主线的国产大模型。同期Google发布WeatherNext气象预测模型,NVIDIA推进Physical AI基础设施建设。

牛津机器人研究所发布测绘级Spires数据集,首次量化3D高斯泼溅在离轨视角下的几何崩塌问题。覆盖125000平方米、24个序列,采用Leica RTC360扫描仪提供毫米级真值,为NeRF和3DGS重建质量评估提供权威基准。

机械臂已具备自主识别与精准采摘蘑菇的能力,本文深入分析蘑菇采摘的技术难点、视觉识别与运动控制挑战,以及数据驱动的开放合作模式如何推动农业机器人从实验室走向真实菇房。

为计算机视觉与机器人交叉领域的博士申请者提供完整指南,涵盖低GPA应对策略、研究方向选择、学习路径规划、优先级排序等核心问题,帮助初学者系统规划科研之路。

已跑通π0.5推理后该做什么?本文为VLA学习者规划从微调训练、动作生成实验到真机部署的完整进阶路线图,涵盖OpenPI微调、flow matching消融实验、仿真迁移与真实机器人部署等实战项目方向。

为控制理论背景的学习者量身定制的机器学习入门指南,涵盖强化学习、数据驱动控制、Learning-based MPC等交叉方向,提供三阶段学习路线与实践建议。

详解大规模双目相机与IMU同步数据集的获取方法,盘点KITTI、EuRoC、nuScenes、Waymo等主流开源数据集,分析组合使用策略与传感器异构性、时间同步等工程陷阱。
Gemini Robotics 2赋能Apollo 2:全身智能如何重新定义…
深度解析谷歌DeepMind Gemini Robotics 2如何赋能Apptronik Apollo 2人形机器人实现全身智能,探讨VLA大模型驱动具身智能的技术突破、硬件与AI融合范式及通用机器人的商业化前景。

深度解析Google DeepMind发布的Gemini Robotics 2,探讨全身智能如何统一感知、推理与运动控制,从手部灵巧到身体协调的范式转变,以及具身智能从实验室到商用落地的挑战与前景。

详解DIY人形机器人腿部开发全过程,涵盖MG996R舵机选型、硬编码步态、逆运动学控制到强化学习的技术演进路径,附开源3D设计文件分享,适合创客和机器人爱好者入门参考。

机器人学者Ranjay Krishna质疑LLM作为机器人智能基础的合理性:语言是否是感知与行动之间多余的中间层?本文深度解析具身智能的两种路线——语言驱动的VLA模型与端到端感知-动作架构的底层逻辑与现实取舍。

想免费获取Vizuara《Modern Robot Learning from Scratch》课程笔记?本文梳理官方渠道、GitHub开源资源及合规获取途径,并推荐UC Berkeley CS285等机器人学习免费课程,助你系统构建机器人学习知识体系。