AI의 10만 가지 이유: 준결정론적 LLM 출력이 특징적 slop을 만드는 법

최근 Substack 게시글에서 lcamtuf(AFL 등 도구로 유명한 보안 연구원)는 인간이 작성한 텍스트와 LLM 출력을 구분할 수 있는지에 대한 반복되는 논쟁을 다룹니다. 그의 주장은 현재 모델이 실제로 어떻게 동작하는지에 대한 구체적인 관찰에 기반합니다.
핵심 주장: 준결정성
LLM은 인간 언어의 최첨단 통계 모델입니다. 이론적으로 그들의 출력은 어떤 통계 테스트에서도 인간 텍스트와 구별할 수 없어야 합니다. 그러나 lcamtuf는 실제 구별 요소는 준결정성이라고 주장합니다. 즉, 100명의 '저자'에게 비슷한 프롬프트(예: '어린이 참고서를 만들어 줘')를 주면 모델은 약 80%의 경우 기능적으로 동일한 출력을 생성합니다.
그는 '100000 whys' 검색 결과에서 나온 약 220개의 Amazon 책 표지 콜라주(링크)로 이를 설명합니다. 이미지는 거의 동일한 표지들의 클러스터를 보여줍니다:
- 위쪽 두 줄 모두 왼쪽에 포효하는 T-Rex가 있습니다
- 반복되는 모티프: 빨간색과 흰색 만화 로켓, 골든 리트리버, 사자
- 저자 이름에는 'Bright'가 믿기지 않을 정도로 많이 포함됩니다: Ethan, Nolan, Pamela, Daniel, Thomas, Andrew W., Mayan, Mary, Levi — 모두 Bright입니다
개발자에게 중요한 이유
AI 생성 콘텐츠를 출시하거나 LLM API 기반으로 구축하는 팀에게 이는 무작위성으로 AI 기원을 숨길 수 없다는 의미입니다. 통계적 특징은 개별 단어 선택이 아니라 유사한 프롬프트에 모델이 동일한 고수준 응답 구조를 반환한다는 점입니다. 비슷한 프롬프트에서 많은 변형을 생성하는 워크플로우라면 출력이 군집화되어 쉽게 식별됩니다.
lcamtuf는 말합니다: '이것은 애매한 신호이므로 인턴이 "이게 아니라 저것이다"라고 말한다고 해고하지 마세요. 그러나 더 캐주얼한 환경에서는 직감을 믿어도 괜찮습니다.'
실용적 시사점
블로그 자동화에 LLM을 사용한다면 콘텐츠가 다른 사람의 것과 똑같이 보일 수 있다는 점을 인지하세요. 게시글의 P.S.는 직설적입니다: '네, 기술은 놀랍지만 당신의 출판물 이름을 "100,000 Whys"로 바꿔도 될 가능성이 높습니다.'
게시글은 이 단일 제목 외의 예시(더 많은 예시)도 링크하며, 원래 'One Hundred Thousand Whys'는 중국에서 인기 있는 1929년 소비에트 아동 도서로, 프롬프트 용어의 시드가 되었을 가능성을 언급합니다.
📖 전체 소스 읽기: HN LLM Tools
👀 See Also

Synthetic이 주요 가격 구조 조정과 함께 상당한 속도 제한 변경을 발표합니다.
Synthetic는 표준 및 프로 등급을 월 30달러의 구독 팩으로 대체하며, 팩당 5시간 동안 135개의 메시지를 제공합니다. 기존 프로 사용자는 동일한 월 60달러 요금으로 5시간당 1,250개의 메시지에서 335개의 메시지로 줄어듭니다.

Claude Code IDE 확장 프로그램, Windows에서 로드 실패 – 상태 업데이트
공식 상태 업데이트에 따르면, Claude Code IDE 확장 프로그램이 2026-05-08T22:32:19Z 기준으로 Windows에서 로드되지 않는 문제가 보고되었습니다. 진행 상황 및 해결은 상태 페이지에서 확인하세요.

미니맥스 M2.7 및 10만 개 이상의 오픈클로 인스턴스 확장에 관한 생태계 세션 논의
Jim과 AndyML이 Minimax 팀을 초대하여 Minimax M2.7과 10만 개 이상의 OpenClaw 인스턴스를 지원하기 위해 호스팅 환경을 확장한 방법에 대해 논의했습니다. 이 세션은 Discord에서 100-110명의 사용자와 중국어 동시 중계에서 35만 명 이상의 시청자를 끌어모았습니다.

"모르겠어요, 클로드가 썼어요" 팬데믹: 인지적 항복이 코드 소유권을 대체할 때
엔지니어가 아키텍처 결정을 Claude에게 위임하고, PR을 설명하지 못합니다. Addy Osmani는 이를 '인지 항복'이라고 부릅니다 — AI의 결과물을 검토 없이 자신의 것으로 삼는 현상입니다.