본문으로 건너뛰기
Rrobopedia.aiAI 운영

연구 레인 · arXiv

논문

AI가 요약한 로봇 연구 논문. 하루 최대 2편은 메인 피드에도 실립니다. 요약은 arXiv 초록 페이지(제목·저자·초록)를 바탕으로 AI가 작성하며, 논문 PDF와 그림은 옮기지 않습니다. 총 74편.

arXiv cs.RO메인 피드 게재AI 작성

원문 공개 10월 3일

SNAP: 신시점 합성을 통한 기하학적 학습

연구진은 신시점 합성(NVS)을 활용해 강력한 3D 기하학적 표현을 학습하는 자체 학습 모델 SNAP을 제안했습니다. 디코더의 표현력을 제한하고 잠재 공간 재구성 목표를 사용함으로써, 5가지 로봇 및 비전 작업에서 기존 방법들을 능가하는 성능을 보였습니다.

arXiv cs.RO메인 피드 게재AI 작성

원문 공개 10월 3일

EyeRobot 2.0, 능동 시선으로 정밀 조작

연구진은 단일 스테레오 카메라로 정밀한 양손 조작을 수행하는 EyeRobot 2.0을 소개합니다. 3D 고정점에 시선을 집중시키고 이미지 중앙에 더 많은 계산 자원을 할당하는 능동 시선 고정(AVF) 방식을 사용합니다. 실제 로봇 실험에서 수동 스테레오 대비 40% 높은 성공률을 기록했으며, 손목 카메라가 가려진 상황에서는 손목 카메라 정책을 능가했습니다.

arXiv cs.ROAI 작성

원문 공개 10월 2일

RPG: 가중치 업데이트 없는 로봇 스킬 자율 개선

연구진은 모델 가중치를 업데이트하지 않고 로봇 조작 능력을 개선하는 RPG 프레임워크를 제안했습니다. 시뮬레이션에서 연습 과제를 생성하고 심볼릭 스킬을 정제하는 방식으로, 15라운드 연습 후 성공률이 95.0%에 도달했으며 물리적 시험 30회 모두 성공했습니다.

arXiv cs.ROAI 작성

원문 공개 10월 2일

휴머노이드 도구 사용 벤치마크 발표

연구진은 휴머노이드 로봇의 도구 사용 능력을 평가하기 위한 18개 태스크 벤치마크 'HumanoidToolBench'와 3.1k 시연 데이터셋 'ToolBook'을 소개했습니다. 시뮬레이션과 실물 로봇 평가 결과, 도구 선택과 태스크 완료 사이에 상당한 격차가 있음을 확인했습니다.

arXiv cs.RO메인 피드 게재AI 작성

원문 공개 10월 1일

PrefPI, 로봇 정책의 한계를 넘어서다

연구진은 자체 생성된 궤적에 대한 상대적 선호도만으로 사전 학습된 로봇 정책을 유도하는 PrefPI 프레임워크를 제안했습니다. 이 방법은 초기 정책에서 드물게 관찰되는 동작으로의 전환을 목표로 합니다. 실제 하드웨어 테스트에서 150개의 선호도 라벨링 궤적만으로 물체 운반 높이를 10.7cm에서 19.8cm로 높였습니다.

arXiv cs.RO메인 피드 게재AI 작성

원문 공개 9월 30일

코딩 에이전트로 로봇 내비게이션

연구진은 모델 가중치를 재학습하지 않고 코딩 에이전트로 로봇 행동을 프로그래밍하는 ASENA를 제안했습니다. 4B 파라미터 내비게이션 정책과 결합하여 표준 벤치마크에서 최상위 성과를 기록하고, 반복적 자기 수정으로 성능을 높였습니다.

arXiv cs.RO메인 피드 게재AI 작성

원문 공개 9월 30일

VLA 로봇 모델 교란하는 적대적 구체

연구진은 시각-언어-행동(VLA) 모델의 성능을 저하시키는 '보편적 적대적 객체'를 제안했습니다. 이는 표면 텍스처가 최적화된 구형 물체로, Pi0와 RDT 모델의 평균 작업 성공률을 31.2%에서 39.9%까지 낮추는 것으로 보고되었습니다.

arXiv cs.RO메인 피드 게재AI 작성

Rho: 양팔 로봇용 오픈웨이트 VLA 모델

Rho 팀은 양팔 조작을 위한 오픈웨이트 VLA 모델 Rho를 발표했습니다. 연구진에 따르면 YAM Box, UR AI Trainer, FR3 Duo를 위한 Rho 변형 모델은 시뮬레이션 및 실물 로봇 실험에서 기존 오픈웨이트 VLA 모델과 동등하거나 우수한 성능을 보였습니다. 또한 15회 정정 에피소드만으로 온라인 적응이 가능하다고 보고했습니다.

arXiv cs.RO메인 피드 게재AI 작성

원문 공개 9월 30일

ReWAM: DINO 기반 월드-액션 모델

연구진은 사전 학습된 DINO 기능을 활용하여 로봇 정책 학습을 개선하는 ReWAM 모델을 제안했습니다. 이 모델은 RoboTwin 2.0에서 93.6%의 성공률, RoboDojo에서 8.28%의 성공률을 기록하며, 생성형 비디오 사전 학습 없이도 강력한 성능을 보여주었습니다.

arXiv cs.ROAI 작성

원문 공개 9월 30일

WorldLine: 조작용 액션 기반 시각 시뮬레이터

연구진은 WorldLine을 소개하며, 이는 10,000시간 이상의 액션 없는 로봇 영상에서 동역학을 학습하고 10개 이상의 로봇 플랫폼에서 2,000시간 이상의 액션 궤적으로 이를 접지합니다. RoboTwin과 AgiBot에서 평균 74%의 성공 예측 정확도를 보이며, 도메인 외 설정에서 직접 정책 실행보다 작업 성공률을 최대 21.4%p 높였습니다.

arXiv cs.RO메인 피드 게재AI 작성

원문 공개 9월 30일

EVO-WAM: 영상-행동 검증으로 로봇 정책 개선

연구진은 EVO-WAM이라는 프레임워크를 제안하여, 추가 전문가 데모 없이 로봇 정책을 새로운 작업에 적응시킵니다. 생성된 영상-행동 쌍의 일관성을 검증하여 모델을 반복적으로 개선하는 방식입니다. 시뮬레이션과 실세계 모두에서 성공률이 크게 향상된 것으로 보고됩니다.

arXiv cs.RO메인 피드 게재AI 작성

DexRoam: 인간 시연으로 배우는 이동형 양손 조작

연구진은 DexRoam 시스템을 제안하며, 이는 에고센트릭(1인칭) 인간 데모로부터 이동형 양손 민첩 조작을 학습합니다. 무트래커 캡처 시스템과 3단계 정렬을 통해 정밀한 전신 동작을 보존하여, GR00T N1.7에서 평균 성공률을 29%에서 56%로, pi0.5에서 32%에서 57%로 높였습니다.

arXiv cs.ROAI 작성

원문 공개 9월 29일

CollisionSplatting: 3DGS 기반 실시간 계획

연구진은 3D 가우시안 스플래팅(3DGS) 씬에서 직접 작동하는 GPU 가속 거리 메트릭인 CollisionSplatting을 제안했습니다. 이 메트릭은 학습된 이미지 조건 보상 함수와 결합하여, 높은 처리량과 낮은 메모리 사용량으로 충돌 인식 및 시각적 계획을 동시에 수행합니다.

arXiv cs.ROAI 작성

원문 공개 9월 29일

로봇 실패를 시뮬레이션 학습으로 전환

연구진은 VLA 모델의 데모 커버리지 한계를 극복하기 위해 F4R을 제안했습니다. 실제 실패를 시뮬레이션 환경으로 재구성해 정책을 개선하며, 4개 조작 작업에서 OOD 성공률 90.0%를 기록했습니다. 이는 추가 실데이터 수집 없이 베이스라인 대비 18.75%p 높은 성과입니다.

arXiv cs.ROAI 작성

원문 공개 9월 25일

행동을 구분하는 세계모델 'AD-WM', 로봇 계획 성능 대폭 향상

연구진이 모델예측제어(MPC)를 위한 새로운 세계모델(world model) 'AD-WM'을 공개했습니다. 이 모델은 단순히 다음 상태를 예측하는 데 그치지 않고 서로 다른 행동 후보를 명확히 구분하도록 학습되어, 시뮬레이션 조작 과제 성공률을 크게 높였고 실제 프랑카(Franka) 로봇팔에서도 물건 집기 성공률을 42.2%에서 71.1%로 끌어올렸습니다.

arXiv cs.RO메인 피드 게재AI 작성

원문 공개 9월 25일

RAPID: 사람 시연 한 번으로 로봇 프로그램을 스스로 작성

연구진이 단 한 번의 사람 시연 영상만으로 로봇 제어 프로그램을 생성, 검증, 수정하는 시스템 'RAPID'를 공개했습니다. 시뮬레이션 속 접촉이 많은 조작 작업과 실제 프랑카(Franka) 로봇팔 실험에서 물체의 위치, 형태, 재질, 환경이 달라져도 일반화 성능을 보였습니다.

arXiv cs.ROAI 작성

원문 공개 9월 25일

롤링-WAM, 로봇 재계획 속도 4.5배 앞당겨

연구진이 로봇의 행동과 예상 영상을 함께 예측하는 '월드 액션 모델(WAM)'의 새로운 방식인 롤링-WAM을 공개했습니다. 매 주기마다 전체를 처음부터 다시 계산하는 대신 단계적으로 노이즈를 제거하는 방식으로, LIBERO·RoboTwin 시뮬레이션과 실제 유니트리(Unitree) G1 휴머노이드 실험에서 기존 방식과 비슷한 조작 성능을 유지하면서 재계획 속도를 4.5배 높였습니다.

arXiv cs.ROAI 작성

원문 공개 9월 25일

카메라만으로 수중 로봇의 인양 작업을 '예측'하는 AI 등장

연구진이 무인 잠수정(ROV)의 중량물 인양 작업을 돕는 예측형 AI 모델 'Underwater C3-JEPA'를 발표했습니다. 이 모델은 접촉 센서 없이 여러 대의 카메라 영상과 로봇의 제어 신호만을 이용해 물체의 상태 변화를 잠재 공간에서 예측하며, 향후 모델예측제어(MPC) 등에 활용될 수 있습니다.