🤖 LLMO 진단
LLMO(Large Language Model Optimization)는 AI 검색 시대를 위한 최적화 진단입니다. llms.txt 유무, GPTBot / ClaudeBot / Google-Extended 등 주요 AI 크롤러의 권한 상태, 구조화 데이터 유무를 한 번에 확인할 수 있습니다.
완전 무료
가입 불필요
서버 처리
로그 · DB 없음
레이트 리밋
5 개 언어
다크 모드
📖 이 진단으로 알 수 있는 것
이 진단은 /llms.txt 의 유무와 구조, robots.txt 에서의 AI 크롤러(GPTBot / ClaudeBot / PerplexityBot / Google-Extended / CCBot 등) 허용 상태, 구조화 데이터의 유무를 봅니다. 당신의 페이지가 ChatGPT 나 AI 검색에 인용될지는 누구도 측정할 수 없습니다. 순위 API 에 해당하는 것이 존재하지 않기 때문입니다. 여기서 확인할 수 있는 것은 기계가 읽을 수 있는 형태인가, 애초에 차단하고 있지 않은가 하는 전제 조건뿐입니다.
| 판정 항목 | 무엇을 보는가 | 걸렸을 때의 대처 |
|---|---|---|
| llms.txt 가 없음 | llms.txt 는 2024년에 제안된 사양으로, 현시점에서 어떤 LLM 도 필수로 하지 않으며, 두었다고 인용된다는 인과관계도 확인되지 않았습니다. 사이트 지도를 마크다운으로 기계에 건네준다는 정도의 위치입니다. 없다고 결함으로 볼 필요는 없습니다. | 준비한다면 /llms.txt 에 H1 으로 사이트명, 이어서 한 단락의 개요, 그 아래 ## 섹션명 별로 링크와 한 줄 설명의 목록을 마크다운으로 씁니다. 요컨대 사람용 사이트맵 페이지를 평범한 마크다운으로 두는 것뿐이며 전용 생성 도구는 필요 없습니다. |
| AI 크롤러를 일률 차단 | User-agent 마다 의미가 다릅니다. Google-Extended 의 Disallow 는 AI Overviews 등에서의 이용을 막을 뿐 통상 검색 순위에는 영향이 없습니다(크롤 자체는 Googlebot 이 하기 때문). 반면 GPTBot 이나 ClaudeBot 을 막으면 AI 로부터의 참조 트래픽까지 잃습니다. |
학습에는 쓰이고 싶지 않지만 인용은 되고 싶다면, 학습용 봇(CCBot, GPTBot 등)만 Disallow 하고 검색 · 답변 시 가져오는 봇은 허용하는 식으로 나눠 씁니다. 다만 준수는 각 사의 자율에 달려 있으므로 확실히 막으려면 서버 측에서 UA 를 차단하세요. |
| 구조화 데이터가 없음 | LLM 은 본문에서도 정보를 얻지만, 이것이 기사이고 저자가 누구이며 언제 갱신되었는지를 확실히 전할 수 있는 것은 schema.org 의 JSON-LD 뿐입니다. 날짜나 저자명이 본문 어디에도 구조로 존재하지 않으면 요약 시 누락되거나 잘못된 수치와 연결됩니다. | Article(또는 BlogPosting), Organization, BreadcrumbList 를 JSON-LD 로 둡니다. 중요한 것은 마크업과 가시 HTML 을 같은 데이터에서 생성하는 것으로, 따로 쓰면 반드시 한쪽이 낡습니다. 본 사이트도 FAQ 에서 같은 실패를 했기에 배열 하나에서 양쪽을 출력하도록 다시 만들었습니다. |
LLMO 에 확립된 정석은 아직 없습니다. 현시점에서 확실히 효과가 있는 것은 (1) 자바스크립트 없이 본문이 읽힌다, (2) 제목 계층이 내용과 일치한다, (3) 다른 곳에 없는 1차 정보가 있다 3가지이며, 이는 검색엔진용 시책과 거의 같습니다. llms.txt 를 두는 것보다 우선순위가 높다고 생각하세요.