VLA란 무엇인가요? 로봇 착륙 시 행동 제어에 있어 비전-언어-행동을 피할 수 없는 이유는 무엇일까요?
VLA는 Vision-Language-Action의 약자로, 직역하면 'Vision-Language-Action' 모델을 의미합니다. 일반 멀티모달 모델과 가장 큰 차이점은 이미지를 읽고 텍스트를 이해할 수 있을 뿐만 아니라, 그 결과를 실행 가능한 동작으로 전환할 수...
AI 백과사전 • Admin •
134
Found 1 related articles