Amazon Rekognition은 딥러닝 기반의 컴퓨터 비전 기술을 손쉽게 애플리케이션에 통합할 수 있도록 지원하는 AWS의 완전 관리형 이미지 및 비디오 분석 서비스다. 머신러닝이나 컴퓨터 비전 전문 지식이 없는 개발자라도 API 호출 몇 번만으로 정교한 시각 분석 기능을 구축할 수 있도록 설계되었다.
◼️ 완전 관리형(Fully Managed)이란
사용자가 서버나 인프라를 직접 프로비저닝, 패치, 운영, 유지보수할 필요 없이, 클라우드 제공자(AWS, GCP 등)가 모든 백엔드 관리를 전담하는 서비스 형태를 뜻한다.
라벨 및 객체 감지 (Labels & Objects)
이미지나 비디오 프레임 내에 존재하는 수천 가지 객체(자동차, 건물, 동물 등), 장면(해변, 도시 등), 개념(야외, 석양 등)을 자동으로 식별한다. 각 객체에 대한 바운딩 박스(Bounding Box) 좌표와 신뢰도 점수를 함께 제공하여 시각적 위치를 정확히 파악할 수 있다.
얼굴 감지 및 분석 (Face Detection & Analysis)
이미지 속 얼굴의 위치를 찾고 연령대, 성별, 표정(미소 여부), 감정 상태(행복, 놀람, 슬픔 등), 안경 착용 여부, 눈을 떴는지 여부와 같은 상세 속성을 분석한다.
얼굴 검색 및 비교 (Face Search & Compare)
얼굴 벡터를 저장하는 '얼굴 컬렉션(Face Collection)'을 구축하여 특정 인물의 얼굴이 등록된 데이터베이스 내에 존재하는지 대규모로 검색할 수 있다. 두 얼굴 간의 유사도를 측정하는 기능도 제공하여 신원 확인 및 보안 출입 시스템에 활용된다.
텍스트 감지 (Detect Text)
도로 표지판, 차량 번호판, 제품 포장재, 간판 등 일상 환경(Scene Text)에 존재하는 텍스트를 감지하고 추출한다. 라틴 문자 기반 언어 및 아라비아 숫자를 인식하는 데 최적화되어 있다.
콘텐츠 조정 (Content Moderation):
성인물, 폭력성, 혐오 표현, 약물 관련 콘텐츠 등 부적절하거나 유해한 시각 미디어를 다단계 카테고리로 세분화하여 감지한다. 플랫폼의 커뮤니티 가이드라인 준수 및 자동 모니터링 파이프라인에 필수적으로 쓰인다.
유명인 인식 (Celebrity Recognition)
엔터테인먼트, 스포츠, 정치 등 다양한 분야의 수십만 명에 달하는 글로벌 유명인을 식별하여 미디어 라이브러리 자동 태깅을 지원한다.
Custom Labels
사전에 학습된 범용 모델로 해결할 수 없는 도메인 특화 작업(예: 공장의 특정 부품 불량 검수, 자사 로고 인식 등)을 위해, 소량의 자체 레이블링 이미지만으로 커스텀 머신러닝 모델을 노코드/로우코드로 훈련시키고 배포할 수 있는 기능이다.
이미지 처리
Base64 인코딩 바이트 배열을 직접 페이로드에 실어 전송하거나, Amazon S3 버킷에 업로드된 객체 참조를 전달하여 동기(Synchronous) 방식으로 수 초 내에 즉각적인 분석 결과를 반환받는다. (바이트 직접 전송 시 5MB 제한, S3 경유 시 15MB 제한)
저장된 비디오 분석
S3에 업로드된 MP4, MOV 등의 대용량 비디오 파일을 비동기(Asynchronous) 방식으로 처리한다. 작업 시작 요청 후 작업 ID를 발급받고, 처리가 완료되면 Amazon SNS/SQS 알림을 통해 분석된 타임스탬프 기반 JSON 결과를 받아온다.
실시간 라이브 비디오 스트림 분석
Amazon Kinesis Video Streams(KVS)와 직접 연동하여 실시간 CCTV, 방송 스트리밍 영상에서 얼굴을 감지하거나 지정된 인물을 실시간으로 추적하는 스트리밍 분석 파이프라인을 지원한다.
* 이 게시물은 쿠팡 파트너스 활동의 일환으로, 이에 따른 일정액의 수수료를 제공받습니다.