고객이 AI에게 질문할 때 책은 누가 파는가? 5개 AI 엔진을 통해 본 루마니아 도서 시장
요약
5개의 AI 엔진을 통해 루마니아 도서 시장의 브랜드 가시성을 분석한 연구 결과입니다. AI 답변에서 특정 브랜드가 차지하는 순위와 엔진별 추천 성향이 시장 점유율에 미치는 영향을 다룹니다.
핵심 포인트
- AI 답변의 58%는 특정 구매 브랜드를 지목하지 않음
- 단순 언급 횟수보다 답변 내 노출 순위(가중치)가 중요함
- 엔진별로 브랜드 추천 빈도와 관대함의 차이가 큼
- Perplexity는 Gemini보다 브랜드 추천 자리가 훨씬 희소함
누군가 ChatGPT에게 _"어린이 책을 사려면 어떤 온라인 서점을 이용해야 할까요?"_라고 물으면, 10개의 파란색 링크가 아닌 단 하나의 답변을 받게 됩니다.
그래서 우리는 그 답변 안에 누가 포함되어 있는지 측정했습니다.
우리는 루마니아에서, 루마니아어로, 2주간의 완전한 실행 과정을 통해 18개의 실제 구매 질문을 5개의 AI 엔진 — ChatGPT, Google Gemini, Perplexity, Google AI Mode, Google AI Overviews — 에 던졌습니다. 어떤 질문에도 브랜드 이름은 포함되지 않았습니다. 등장하는 모든 브랜드는 엔진이 스스로 이름을 언급한 것입니다.
결과: 180개의 분석된 답변, 247개의 브랜드 언급, 21개의 추적된 브랜드, 422개의 고유한 인용 도메인.
가장 핵심적인 발견은 우리가 예상하지 못했던 것이었습니다.
답변의 58%는 아무도 지목하지 않는다
180개의 답변 중, 시장의 21개 주요 브랜드를 언급한 것은 단 **75개(42%)**뿐이었습니다. 나머지 105개는 도서 제목, 저자, 소규모 사이트들을 답변으로 내놓았지만, 어디서 구매해야 하는지는 결코 말하지 않았습니다.
그리고 그 75개 중에서도 단 19개만이 단일 브랜드를 추천했습니다. 나머지는 평균 3.3개의 브랜드가 무대를 나누어 가졌습니다.
18개 질문 중 6개는 2주 동안 모든 엔진에 걸쳐 총 3개 이하의 브랜드 언급만을 수집했습니다:
| 질문 영역 | 총 브랜드 언급 횟수 |
|---|---|
| 기업가를 위한 비즈니스 서적 | 1 |
| ... |
현재 시장의 구매 영역 중 3분의 1은 누구의 소유도 아닙니다.
언급되는 것과 추천되는 것은 다르다
이 부분은 여러분이 이를 측정하는 방식을 바꾸게 만들 것입니다.
시장 선두주자인 Libris는 37번 언급되었으며, 이는 전체 답변의 20.6%에 해당합니다. 하지만 흥미로운 수치는 그 언급들이 어디에 위치하느냐입니다:
| 1순위 | 2~3순위 | 4~7순위 | 8순위 이상 | |
|---|---|---|---|---|
| Libris (37회 등장) | 24 (65%) | 8 (22%) | 5 (13%) | 0 |
| BookZone (24회 등장) | 3 (12%) | 12 (50%) | 8 (33%) | 1 (4%) |
Libris는 단순히 가장 자주 등장할 뿐만 아니라, 세 번 중 두 번은 첫 번째로 등장합니다.
순위 가중치(1위 = 100%, 2위 = 50%, 3위 = 33%…)를 적용하면 계층 구조가 재편됩니다. Editura Trei는 단순 언급 횟수로는 6위이지만, 가중치 적용 가시성(weighted visibility)으로는 3위입니다. 언급 빈도는 낮지만, 언급될 때마다 최상단에 나타납니다. 소수의 영역을 점유하고 있는 것입니다.
만약 언급 횟수(mention counter)만으로 AI 가시성을 추적하고 있다면, 잘못된 것을 측정하고 있는 것입니다.
각 엔진은 서로 다른 채널입니다
각 엔진의 36개 답변 중 브랜드별 언급 비율:
| 브랜드 | ChatGPT | Gemini | Perplexity | AI Mode | AI Overviews |
|---|---|---|---|---|---|
| Libris | 13.9% | 30.6% | 16.7% | 13.9% | 27.8% |
| ... |
추출할 만한 가치가 있는 두 가지 사실이 있습니다:
엔진마다 관대함의 정도가 극명하게 다릅니다. Gemini는 36개의 답변에서 총 78회의 언급을 생성했습니다 — 답변당 평균 2.2개의 브랜드입니다. Perplexity는 30회를 생성했습니다 — 답변당 0.8개입니다. 통계적으로 Perplexity에서의 추천 한 번은 Gemini에서의 추천 두 번 반보다 더 큰 가치를 가집니다. 시상대에 오를 수 있는 자리가 훨씬 적기 때문입니다.
같은 회사임에도 상반된 판결이 내려집니다. Humanitas는 Gemini에서는 19.4%를 기록했지만, Google AI Overviews에서는 **0%**를 기록했습니다. 동일한 브랜드, 동일한 콘텐츠, 동일한 Google 제품임에도 불구하고 검색 로직(retrieval logic)은 완전히 다릅니다.
고스트 브랜드(Ghost brands): 인용은 되지만 이름은 불리지 않는 브랜드
이것은 가장 직접적인 실무적 가치를 지닌 발견입니다.
**인용(cited)**되는 것(귀하의 사이트가 답변의 정보원이 됨)과 **이름이 언급(named)**되는 것(답변이 귀하를 추천함)은 서로 다른 화폐 단위입니다. 이 둘을 교차 참조하면 두 가지 유형이 나타납니다:
| 브랜드 | 소스로 인용됨 | 브랜드로 이름이 언급됨 | 진단 |
|---|---|---|---|
| Târgul Cărții | 18 | 4 | ghost |
| ... |
**고스트 브랜드(Ghost brands)**는 크롤링(crawled)되어 그들의 목록과 가격이 답변을 구성하는 원재료로 사용되지만, 정작 엔진은 다른 누군가를 추천합니다. 그들의 _콘텐츠(content)_는 신뢰할 수 있지만, 그들의 _엔티티(entity)_는 그렇지 못합니다. 실무적으로 이는 약한 엔티티 신호(entity signals)를 의미합니다: 불완전한 구조화된 데이터(structured data), 통합되지 않은 정체성(sameAs, 프로필, 리뷰 등), 그리고 도메인과 연결하기 어려운 일반적인 이름 등이 원인입니다.
만약 귀하의 사이트가 인용되고 있음에도 불구하고 추천 목록에서 귀하의 이름이 누락된다면, 해결책은 더 많은 콘텐츠를 만드는 것이 아닙니다. 그것은 엔티티 (Entity) 작업이며, 이 분야 전체에서 가장 빠르게 성과를 낼 수 있는 방법입니다.
**메모리 브랜드 (Memory brands)**는 그 반대의 경우입니다. Humanitas는 전체 윈도우(window) 동안 humanitas.ro에 대한 인용이 단 한 번도 없음에도 13번이나 추천되었습니다. 이는 순수하게 모델의 파라미터 메모리 (Parametric memory) — 즉, 수십 년간 쌓아온 문화적 존재감 — 에 의존하고 있습니다. 기분 좋은 일이지만 취약하기도 합니다. 답변이 크롤링 가능한 (crawlable) 소스들로부터 구축되는데 귀하의 사이트가 그중에 포함되어 있지 않다면, 귀하는 대화에서 탈락하게 됩니다.
Reddit은 시장의 두 번째 소스입니다
180개의 답변 전체에서 422개의 서로 다른 도메인이 인용되었습니다. 그 목록의 상위 항목은 다음과 같습니다:
| 도메인 | 인용된 답변 수 |
|---|---|
| carturesti.ro | 46 |
| ... |
Reddit은 Facebook (11), YouTube (6) 및 세트 내의 모든 미디어 출판물보다 높은 위치에 있습니다. 누군가 AI에게 어떤 서점을 이용해야 하는지 물을 때, 답변의 일부는 특정 브랜드가 통제할 수 없는 스레드(thread) 내에서 독자들이 서로 논쟁하며 만들어진 결과물에서 나옵니다.
해당 목록에는 그림자 시장 (shadow market) 도 존재합니다 — clb.ro, librex.ro, librariadelfin.ro, booknation.ro — 대중적 인지도는 거의 없지만 지속적으로 등장하는 사이트들입니다. 모델은 유명세에 따라 인용하지 않습니다. 모델은 크롤링(crawl)하고 파싱(parse)할 수 있는 것을 인용합니다.
순위는 매주 변동합니다
동일한 18개의 질문, 동일한 5개의 엔진을 7일 간격으로 조사한 결과입니다:
| 브랜드 | 7월 20일 | 7월 27일 | 변화 |
|---|---|---|---|
| Editura Corint | 2 | 8 | ×4 |
| ... |
elefant.ro의 점유율(share of voice)은 일주일 만에 7.0%에서 10.9%로 상승했습니다. 이는 일반적인 구글(Google) 유기적 검색(organic)에서는 몇 달이 걸릴 법한 도약입니다.
이 현상을 설명하기에 적절한 단어는 '혼돈 (chaos)'이 아니라 **가소성 (plasticity)**입니다. 답변은 재크롤링된 소스와 지속적으로 업데이트되는 모델을 통해 매 쿼리(query)마다 재생성됩니다. 오늘날의 선두 주자들에게 이는 우위를 유지하기 위한 관리가 필요함을 의미합니다. 그 외의 모든 이들에게는 진입의 창이 영구적으로 열려 있음을 의미합니다. 이는 수년간 축적된 권위(authority)에 의해 1~3위 자리가 콘크리트처럼 굳어지는 전통적인 SEO와는 다릅니다.
재현하기
엔진별 비율은 소수점 첫째 자리에서 반올림한 n/36이며, 따라서 기초 수치를 통해 정확하게 재구성할 수 있습니다:
import csv
rows = list(csv.DictReader(open("piata-carte-ai-2026-07.csv", encoding="utf-8")))
...
247은 또한 mentiuni_total의 합계이자, 두 번의 주간 실행(128 + 119)의 합계이며, 18개 질문 전체에 걸친 언급(mentions)의 합계와도 같습니다. 네 개의 독립적인 축이 하나의 숫자로 수렴합니다.
주의할 점: 데이터셋은 두 가지 분모를 사용합니다. 언급률(Mention rates)은 180개의 답변(엔진당 36개)을 기준으로 합니다. 인용 백분율(Citation percentages)은 실제 인용이 포함된 답변인 172개를 기준으로 합니다. 8개의 답변은 링크가 전혀 포함되지 않은 채 생성되었습니다.
데이터 가져오기
위의 모든 내용은 CC BY 4.0 라이선스로 공개된 세 개의 CSV 파일에서 가져왔으며, 출처 표기 시 상업적 이용을 포함하여 자유롭게 사용할 수 있습니다:
- Zenodo (정식 저장소, DOI): 10.5281/zenodo.21736211
- GitHub: WebSEM-ai/websem-ai-visibility-book-market-ro
- Kaggle: ai-search-visibility-romania-book-market
- Hugging Face: WebSEM-ai/ai-search-visibility-romania-book-market
네 곳 모두 바이트 단위로 동일한 파일을 제공합니다. 직접 가져가서 확인해 보시기 바랍니다.
한계점 (사전 고지)
2주 동안 두 번의 실행을 거쳤으며, 이는 변동성을 확인하기에는 충분하지만 추세를 파악하기에는 부족합니다. 18개의 질문은 전체 구매 범위를 대변하지 못합니다. 21개의 추적 브랜드는 전체 시장이 아니며, 규모가 작은 업체들은 인용 데이터에서만 나타납니다. 질문당 답변이 대략 10개 정도이므로, 단일 질문의 차이는 노이즈(noise)일 수 있습니다. 언급(Mentions)이 곧 전환(conversions)을 의미하지는 않습니다. 모델은 지속적으로 업데이트되므로, 이 수치는 2026년 7월 18일부터 31일 사이의 엔진 동작을 설명하는 것이지 영구적인 진리가 아닙니다.
여기에 언급된 모든 브랜드는 저희가 아닌 AI 엔진들에 의해 언급된 것입니다. 본 내용은 시장 조사(market research)이며, 특정 제품이나 서비스에 대한 평가가 아닙니다.
전체 연구 내용, 18개 질문 및 인터랙티브 차트 포함: websem.ro
시리즈의 에피소드 1에서는 10개의 대규모 언어 모델 (LLM)에게 명품 보석에 관한 동일한 질문 하나를 던졌으며, 그 결과 29개의 서로 다른 브랜드가 도출되었습니다. 모델 간 일치율은 18%였습니다 — DOI 10.5281/zenodo.21724399.
AI 자동 생성 콘텐츠
본 콘텐츠는 Dev.to AI tag의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기