로봇은 어디서 연습할까: 피지컬 AI 브랜드 영상 '지금도 어딘가에서는' 공개
접시가 또 깨지는데 아무도 놀라지 않는 이유. 두 번째 피지컬 AI 브랜드 영상을 3개 언어로 공개하며, 영상 속 숫자와 만든 과정을 정리했습니다.
슈퍼브에이아이가 두 번째 피지컬 AI 브랜드 영상 '지금도 어딘가에서는'을 공개했습니다. 독자 AI 파운데이션 모델 프로젝트(이하 독파모) 2차수에서 구축한 3D 공간·4D 행동·지능형 객체 자산이 로봇 학습에서 어떻게 쓰이는지를 1분 33초에 담았습니다. 지난 7월 공개한 1편과 같은 시리즈로, 국문판과 영문판을 공식 유튜브 채널에서 보실 수 있습니다.
요약 (TL;DR)
- 영상의 주어는 '현실을 그대로 복제한 가상 세계'입니다. 로봇은 이 세계에서 실패를 반복하며 다루는 법을 배웁니다.
- 영상에 등장하는 숫자는 독파모 2차수 결과 그대로입니다. 3D 공간 자산 50개소, 4D 행동 자산 5,000건, 지능형 객체 10,000장, 그리고 촬영한 7,500개 동작 중 5,000개만 통과시킨 선별 기준입니다.
- 1편과 같이 나레이션 없이 화면 텍스트만으로 구성했습니다.
접시가 또 깨지는데, 아무도 놀라지 않습니다
영상은 문이 열리고 접시가 깨지는 장면으로 시작합니다. 사무실의 누구도 고개를 들지 않습니다. 이 모든 장면이 가상 세계에서 벌어지고 있기 때문입니다.
1편이 "AI에게 눈을 주기로 했습니다"라는 결심을 다뤘다면, 2편은 그 다음 질문에 답합니다. 눈을 가진 로봇은 어디서 연습하는가. 저희의 답은 한국의 실제 가정환경을 그대로 복제한 가상 공간입니다. 영상 속 카피를 빌리면 "누군가 만든 세계가 아니라, 현실을 그대로 복제한 세계"입니다.
영상 속 숫자는 전부 2차수 결과입니다
0:22 무렵 화면에 카운트업으로 등장하는 세 숫자는 독파모 2차수 결과 글에서 정리한 구축 결과와 같습니다.
| 자산 | 규모 | 영상 속 장면 |
|---|---|---|
| 3D 공간 자산 | 50개소 | 실사와 가상이 토글되는 거실·주방 |
| 4D 행동 자산 | 5,000건 | 7,500개 동작 중 PASS 스탬프를 받은 5,000개 |
| 지능형 객체 | 10,000장 | 냉장고·서랍·싱크대 문이 실제 무게감으로 열리는 컷 |
0:28의 입장 시험 장면이 저희가 가장 공들인 대목입니다. 촬영한 7,500개의 동작 가운데 학습 자산으로 통과시킨 것은 5,000개입니다. 실스케일과 지면 정합, 관절 8종의 작동까지 검수한 기준을 넘지 못한 동작은 REJECTED 스탬프를 받습니다. 가상 세계가 학습 데이터로 쓰이려면 보이는 것뿐 아니라 작동까지 현실과 같아야 한다는 것이 이 장면에 담긴 기준입니다.
제작 노트
로봇은 참조점, 주어는 세계. 기획 단계에서 로봇을 주인공으로 두는 안도 검토했습니다. 그러나 슈퍼브에이아이의 일은 피지컬 AI 데이터 팩토리를 운영하는 것이고, 로봇은 그 결과물을 검증하는 존재입니다. 그래서 카메라는 로봇이 배우는 장소, 즉 복제된 세계에 머물고, 로봇은 그 세계의 품질을 증명하는 존재로 등장합니다.
로봇의 실패는 컨셉입니다. 영상에서 로봇은 여러 번 실패합니다. 0:56의 "실패해도 괜찮습니다"와 연습 카운터(12회에서 4,912회로)가 그 장면입니다. 이 실패는 가상 세계가 제공하는 안전한 반복이고, 학습 자산 자체의 결함과는 다른 층입니다. 결함이 있는 데이터는 앞선 입장 시험에서 이미 걸러졌다는 것이 영상의 순서입니다.
나레이션 없는 화면 텍스트. 1편과 같이 음성 없이 화면 텍스트만으로 만들었습니다. 44개 텍스트 요소 중 38개를 영문·일문으로 옮겨 두었고, 오프닝과 엔딩의 '지금도 어딘가에서는'은 언어가 달라도 같은 구문으로 맞춰 수미상관을 유지했습니다. 숫자 그래픽은 숫자를 그대로 두고 단위만 번역했습니다.
시리즈 문법. 일상 장면으로 시작해 능청스러운 한마디로 반전하는 훅, 순차 노출 자막, 카운터 그래픽, "X를 넘어 Y로" 두 줄 엔딩은 1편에서 이어받은 문법입니다.
함께 보기
- 피지컬 AI 브랜드 영상 1편 공개 글
- 피지컬 AI 데이터 팩토리 첫 가동: 3D 공간 50개소·행동 5,000건·객체 10,000장
- 로봇 월드 모델을 위한 시뮬레이션 자산
- 피지컬 AI의 눈과 손을 만들다: 독자 AI 파운데이션 모델 3차수 진출
자주 묻는 질문 (FAQ)
Q. 영상에 나오는 가상 공간은 실제 어디인가요?
독파모 2차수에서 촬영한 한국 가정환경 50개소를 3D Gaussian Splatting 배경과 상호작용 사물의 물리 메시로 복제한 공간입니다. 특정 가정을 식별할 수 있는 정보는 담지 않았습니다.
Q. 연습 횟수 카운터(12회 → 4,912회)는 실측 통계인가요?
아닙니다. 가상 환경에서 반복 학습이 누적되는 구조를 표현한 컨셉 그래픽입니다. 인용 가능한 수치는 3D 공간 50개소·4D 행동 5,000건·객체 10,000장, 그리고 7,500개 촬영 중 5,000개 통과입니다.
Q. 영문판도 볼 수 있나요?
네. 같은 유튜브 채널에 영문판이 올라가 있습니다. English version에서 보실 수 있습니다.
피지컬 AI 학습 데이터 구축 파트너십 문의는 아래 내용을 남겨주시면, 슈퍼브 전문가들이 바로 연락 드리겠습니다.
슈퍼브에이아이는 산업 현장의 시각 데이터를 기업이 활용할 수 있는 인텔리전스로 전환하는 비전 인텔리전스 기업입니다. 독파모에서 구축한 3D 공간·4D 행동·지능형 객체 자산으로 로봇 학습용 합성 데이터 생산 체계를 운영합니다.