산업
메타, 인간 형체·움직임 정밀하게 읽어내는 비전 모델 개발
메타 연구진은 27일현지시간 인간 중심 시각 인식을 위한 차세대 파운데이션 모델 ‘사피엔스2Sapiens2’를 온라인 아카이브를 통해 공개했다.모션 캡처 시스템이 사람의 손가락 움직임을 처리하는 데 어려움을 겪거나 분할 모델이 치아와 잇몸을 구분하지 못하는 것처럼, 인간을 이해하는 컴퓨터 비전은 여전히 가장 까다로운 영역 중 하나다. 사피엔스2는 이를 극복하기 위한 모델이다.10억장에 달하는 고품질 인간 이미지 데이터를 기반으로 학습된 고해상도 트랜스포머 모델로, 0.4B부터 5B 매개변수까지 다양한 크기로 구성된다.1K 해
이 콘텐츠는 AI타임스 원본 기사의 요약입니다. 전문은 원본 사이트에서 확인해주세요.
원문 기사 보기 →