Show HN: AI 없는 Hacker News
요약
AI 관련 콘텐츠를 걸러내는 방법으로 Pangram이라는 기법을 활용한 서비스를 소개합니다. 이 서비스는 키워드 필터링 대신 콘텐츠의 전반적인 구조와 패턴을 분석하여 AI 생성 여부를 평가하는 데 효과적입니다.
핵심 포인트
- Pangram 기법은 키워드 기반이 아닌 콘텐츠 자체를 평가함.
- AI 관련 글을 걸러내는 데 Pangram이 효과적임.
- LLM 도구 프로젝트의 상당수가 LLM으로 작성된 소개글을 가짐.
- API 비용 문제로 직접 모델 학습은 시도하지 않음.
취지는 좋지만 필터 정확도와 탐색 기능에 몇 가지 아쉬움이 있음.
‘정신에 영향을 주는 약물이 안데스 문명의 부흥에 핵심 역할을 했다’처럼 명백히 AI와 무관한 글도 빠짐. 게시된 지 3시간 된 글이라, 단순히 갱신이 느린 것일 수도 있음.
다음 페이지로 넘어가는 기능도 없음. 빠진 글을 감안해도 글 순서가 HN과 조금씩 달라서, 다른 글도 누락됐는지 매번 확인하게 됨.
요즘 HN에 AI가 그렇게 많은가? 자주 들어오지만 주로 제목을 훑고 몇몇 사이트만 방문해서 잘 모르겠음.
이 추세라면 AI 글을 걸러내려고 바이브 코딩으로 만든 사이트가 매주 하나씩은 나올 듯함. 다들 태울 토큰이 넘치는 모양임.
나는 지난 1년간 이 서비스를 운영해 왔음. 다른 이들에게 영감을 줬다고 믿고 싶음.
LLM이 작성한 콘텐츠를 걸러내는 방법도 있음. https://hnslop.nilsherzig.com/.
키워드를 거르는 대신 Pangram으로 콘텐츠를 평가해 순위를 매김. AI에 관한 콘텐츠를 걸러내는 데도 꽤 효과적임. LLM 도구 프로젝트 상당수가 프로젝트 소개나 블로그 글을 LLM으로 작성하기 때문임.
‘AI가 내 뇌를 망친다’는 글 중에서도 LLM이 쓴 것으로 보이는 글이 이렇게 많다니 놀라움.
나도 해보려 했지만 Pangram API 비용이 너무 비쌌음. 직접 모델을 학습시키는 것도 생각했지만, 다행히 그 깊은 구덩이에 빠지기 직전에 멈춤.
AI 자동 생성 콘텐츠
본 콘텐츠는 GeekNews의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기