필요한 장면을 말로 찾기
“로고가 나오며 가격을 설명하는 장면”처럼 찾고 싶은 내용을 입력해 관련 구간을 확인합니다.
보유 콘텐츠를 자주 찾아 다시 쓰고, 여러 언어로 제공하는 팀에 적합합니다.
“로고가 나오며 가격을 설명하는 장면”처럼 찾고 싶은 내용을 입력해 관련 구간을 확인합니다.
같은 원본에서 자막·번역·더빙 작업을 이어갑니다. 원본과 결과물을 함께 관리합니다.
지정한 바이어에게 온라인 상영관을 공유하고, 어떤 콘텐츠를 시청했는지 확인합니다.
2026년 5월, 한국어 이미지·문서 검색을 공개 데이터셋으로 평가했습니다. 영상 검색은 별도의 제품 근사 평가 결과로 구분합니다.
| 모달리티 | 데이터셋 | 결과 |
|---|---|---|
| 이미지 | XM3600-ko (3,600장) | R@1 0.582 · R@5 0.813 · R@10 0.879 |
| 문서 | MIRACL-ko (30만 문서) | 리랭커 적용 시 R@10 0.944 → 0.958 |
| 영상 (제품 근사) | 120클립 · 멀티프레임 max-pool | R@1 0.625 · R@10 0.917 |
R@K는 상위 K개 검색 결과에 대한 재현율입니다. 이 수치는 특정 데이터와 평가 조건의 검색 결과이며, 서비스 전체 정확도나 모든 고객 자료의 성능을 뜻하지 않습니다. 실제 도입에서는 고객의 샘플 자료로 검색 품질을 확인합니다.
모달리티마다 별도 도구를 쓰면 권한·이력·검색이 파편화됩니다. LETR WORKS는 단일 자산 모델에 버전·폴더·접근권한·색인 상태를 함께 둡니다.
자동 태깅의 결과가 문자열 목록으로 남으면, 같은 인물이 자산마다 다른 이름으로 흩어지고 용어는 번역할 때마다 다시 정해집니다. LETR WORKS는 추출한 요소를 워크스페이스 단위의 온톨로지에 올려 서로 관계를 갖게 합니다.
| 개체 | 어떻게 이어지는가 |
|---|---|
| 인물 · 화자 | 음성 임베딩 + 얼굴 클러스터로 영상을 건너 같은 인물로 통합 |
| 용어 · 고유명사 | 번역메모리·용어집(TM/TB)과 연결해 번역·자막·더빙에서 같은 표기 유지 |
| 장면 · 객체 | 캡션·OCR·검출 결과를 장면에 묶어 검색과 재편집의 최소 단위로 사용 |
| 자산 · 파생본 | 원본과 번역본·더빙본·재조판본을 하나의 계보로 연결 |
이 구조 덕분에 검색 결과가 “파일 몇 개”가 아니라 의미가 연결된 지식으로 돌아오고, 생성·재생성 단계에서 같은 정의를 다시 쓰게 됩니다.
영상은 “말한 내용”과 “보이는 화면”이라는 서로 다른 축을 갖습니다. LETR WORKS는 색인 단위를 장면(scene) 으로 두고, 장면마다 성격이 다른 청크를 만들어 각각 적합한 모델로 임베딩합니다. 그래서 결과가 “몇 분 몇 초”가 아니라 의미 있는 구간으로 나옵니다.
| 청크 | 내용 |
|---|---|
visual | 키프레임 화면 |
transcript | 발화 자막(화자 라벨 포함) |
ocr | 화면에 찍힌 텍스트 |
caption | AI 생성 장면 설명 |
objects · faces | 검출 객체 / 얼굴 클러스터 |
텍스트·비주얼 두 인덱스를 병렬 조회해 병합하고 리랭커로 재정렬한 뒤 장면 단위로 묶습니다. 질의가 시각적 의도인지 텍스트 의도인지는 라우터가 가중치로 추정합니다.
찾은 장면과 자료에서 필요한 자막·더빙·문서와 메타데이터를 만듭니다. 같은 원본과 용어 정보를 활용해 후속 작업을 이어갑니다.
| 구분 | 무엇을 만드는가 |
|---|---|
| 생성 | 장면 캡션·요약·태그, 검색용 메타데이터, 세일즈킷 큐레이션 |
| 재생성 · 언어 | 16개 국어 자막 번역, TM/TB 기반 일관 표기, SDH 자막 |
| 재생성 · 음성 | 감정을 담은 AI 보이스와 원작 인물 기반 클론보이스 더빙 |
| 재생성 · 지면 | 이미지·웹툰 레이어 재조판(배경 재생성 없음), 문서 HWPX·DOCX 라운드트립 |
구조화한 자산은 추가 언어와 다른 형식의 결과물을 만드는 데 재사용합니다. 작업별 비용과 소요시간은 범위에 따라 확인합니다. 숏폼 자동 생성과 RAG 챗봇은 같은 자산 위에서 확장 중인 로드맵 항목입니다.
오늘 바로 도입해 쓸 수 있는 기능과, 순차 확장 중인 기능을 구분해 밝힙니다.
| 영역 | 상태 | 내용 |
|---|---|---|
| 영상 번역 | 제공 | STT → 번역 · 파형 병렬 → 프로젝트 생성 |
| 이미지·웹툰 번역 | 제공 | OCR → 번역 → 재구성. PSD 레이어 경로 포함 |
| 문서 번역 | 제공 | 파싱 → 번역. HWPX 라운드트립 |
| 더빙 | 제공 | 번역본 기반 TTS + 정렬 데이터 |
| DRM 세일즈킷 | 제공 | KMS·HLS 암호화 + 화이트리스트 + 뷰어 분석 |
| 멀티모달 RAG 색인·검색 | 제공 | 자체 GPU 추론, 벤치마크 측정 완료 |
| AI Signal (발견성 진단) | 제공 | 브랜드·콘텐츠·발견성 8개 카테고리, 다중 LLM 프로브 |
| 방송 QC · 번인 렌더 · 영상 합성 | 일부 제공 | 일부 제품군에 선반영 |
| 숏폼 생성 · RAG 챗봇 · 음원 분리 · 외부 커넥터 | 로드맵 | 설계 완료, 단계적 구현 |
비용은 워크스페이스 단위로 통제합니다 영상 색인은 비용이 큰 작업이라 선택 활성화 방식입니다. 검색까지 필요한 자산에만 색인을 켜면 되고, 색인하지 않은 영상도 프로젝트 안에서는 그대로 쓸 수 있습니다. 색인 대상과 물량에 맞춰 비용을 확인합니다.
원본과 번역본·더빙본을 함께 관리하고, 이메일 허용 목록과 KMS·HLS 암호화를 적용한 온라인 상영관으로 바이어에게 공유합니다. 뷰어별 시청 분석은 콘텐츠 검토와 후속 영업에 활용할 수 있습니다.
임베딩·리랭킹·OCR은 자체 GPU 추론을 활용합니다. 사용할 기능과 자료의 외부 처리 범위, 접근 권한, 검색 색인 대상을 도입 시 정합니다. 전문가의 번역·검수 작업까지 필요하다면 전문 번역 더빙 서비스를 함께 이용할 수 있습니다.
영상·이미지·문서·오디오를 올리고, 필요한 자산의 분석과 검색을 설정합니다.
장면과 내용을 찾고, 필요한 언어의 자막·번역·더빙을 만듭니다.
결과물을 검토한 뒤 내려받거나, 접근 권한을 정해 공유합니다.