중국, 일반 비디오를 실시간으로 3D 장면으로 재구성하는 오픈 소스 모델 공개
요약
중국에서 일반 비디오 스트림만으로 실시간 3D 장면을 재구성하는 오픈 소스 모델 LingBot-Map을 공개했습니다. 별도의 LiDAR나 깊이 센서 없이도 초당 20프레임 속도로 안정적인 3D 지도 생성이 가능합니다.
핵심 포인트
- LingBot-Map: 비디오 기반 실시간 3D 재구성 모델
- 하드웨어 제약 없이 일반 카메라만으로 3D 매핑 가능
- 초당 약 20fps의 빠른 속도와 10,000 프레임 이상의 안정성
- 로보틱스, 드론, 공간 컴퓨팅 분야의 활용 가능성 확대
중국이 일반 비디오로부터 모든 장면을 실시간으로 3D로 재구성하는 모델을 오픈 소스로 공개했습니다.
LiDAR 없음. 깊이 센서 (depth sensor) 없음. 스캔 리그 (scan rig) 없음. 오직 비디오 스트림 (video stream)만 있으면 됩니다.
이 모델의 이름은 LingBot-Map입니다.
→ 일반 비디오 입력 시, 3D 지도 출력
→ 초당 약 20 프레임 (fps) 속도로 실행
→ 이동하면서 지도가 계속 확장됨
→ 10,000 프레임 이상에서도 안정적임
→ 오픈 소스 (open source), 무료 사용 가능
주목해야 할 부분은 다음과 같습니다.
과거에 3D 캡처 (3D capture)는 하드웨어의 문제였습니다. 스캐너, 리그, 또는 깊이 센서가 내장된 스마트폰이 필요했습니다.
이제 이것은 소프트웨어의 문제입니다. 어떤 카메라든 매핑 (mapping) 장치가 될 수 있습니다.
이 하나의 릴리스로 로보틱스 (robotics), 드론 (drones), 그리고 공간 컴퓨팅 (spatial computing)의 문이 모두 열렸습니다.
하드웨어의 해자 (moat)가 방금 다운로드 가능한 파일로 변했습니다.
AI 자동 생성 콘텐츠
본 콘텐츠는 X @thewhizzai (자동 발견)의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기