
Launch HN: Sieve (YC W22) – 비디오 검색을 위한 플러그형 API
요약
Sieve는 AI 연구소와 기업을 위해 수백 페타바이트 규모의 큐레이션된 비디오 데이터를 제공하는 플러그형 API 서비스입니다. 데이터 수집부터 필터링, 인덱싱, 어노테이션 과정을 거쳐 학습 준비가 된 고품질 데이터셋을 맞춤형으로 제공합니다.
핵심 포인트
- 방대한 원시 비디오 풀을 구축하고 품질 점수화 및 인덱싱을 통해 즉각적인 검색 지원
- 전문가 모델과 인간 검수를 결합한 밀도 높은 레이블링(Dense labels) 제공
- SLA 기반의 맞춤형 데이터 전달 및 S3 호환 전송 방식 지원
- SOC 2 Type 2 보안 준수 및 데이터 라이선스/권한 관리 기능 제공
수백 페타바이트(petabytes) 규모의 큐레이션된 비디오
선도적인 AI 연구소, Fortune 100 기업,
& 빠르게 성장하는 생성형 AI (generative AI) 스타트업들이 신뢰합니다.
Sieve의 작동 방식
소스 (Source)
우리는 방대한 원시 풀(raw pool)을 구축하기 위해 처음부터 비디오를 녹화하고 다양한 소스로부터 데이터를 수집합니다.
필터링 (Filter)
품질(아티팩트, 해상도, 움직임, 미학)을 점수화하여 가장 우수한 후보들만 남깁니다.
인덱싱 (Index)
탐지기(detectors)와 임베딩(embeddings)을 사용하여 수십억 개의 비디오를 인덱싱하므로 모든 것을 즉시 검색할 수 있습니다.
어노테이션 (Annotate)
전문가 모델과 대규모 인간 검수를 결합하여 밀도 높은 레이블(dense labels)과 페어링(pairings)을 추가합니다.
쿼리 (Query)
우리의 연구 팀이 카탈로그를 쿼리하고, 인간 QA를 수행하며, 학습 준비가 된 데이터셋(training-ready datasets)을 전달합니다.
Sieve의 작동 방식
우리와 함께하는 방법
데이터셋 탐색 (Explore Datasets)
즉시 사용 가능한 데이터셋을 찾아보거나 맞춤형 데이터셋을 요청하세요.
액세스 구매 (Purchase Access)
데이터셋의 볼륨과 특성에 따라 구매 계약을 체결합니다.
데이터 수령 (Receive Data)
1~2일 이내에 사전 패키징된 데이터를 받거나, SLA(서비스 수준 협약)에 따른 맞춤형 데이터를 S3 호환 전송 방식을 통해 받으세요.
선도적인 팀들을 위해 구축되었습니다
준수성 (Compliant)
학습 데이터의 완전한 권한 및 준수성을 보장하기 위해 특정 필터링 및 라이선스 요구 사항을 요청하세요.
전담 파트너십 (Dedicated partnership)
우리는 모든 연구 팀과 깊이 협력하여 그들의 요구 사항을 이해하고, 그들이 모델을 개발하는 것과 동일한 엄격함으로 데이터를 개발합니다.
확장 가능한 API (Scalable API)
언제든 수백만 시간의 비디오를 처리할 수 있도록 구축되었습니다.
보안 (Secure)
종단간 암호화(End-to-end encryption), 맞춤형 데이터 보관, SOC 2 Type 2 보안을 제공합니다.
AI 자동 생성 콘텐츠
본 콘텐츠는 HN Chip/GPU의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기