검색 · AI 노출

AI가 답을 대신 읽어줄 때
우리 회사는 인용되고 있을까

검색 결과 목록 대신 답변을 먼저 보는 사람이 늘고 있습니다. 그 답변에 인용되지 않으면, 아무리 잘 만든 페이지도 읽히지 않습니다. 다만 인용 여부를 보장할 수 있는 방법은 없습니다. 확인할 수 있는 것과 없는 것을 나눠 정리했습니다.

목록에서 답변으로

기존 검색은 링크 열 개를 보여주고 어디를 열지는 사람이 골랐습니다. 생성형 AI 검색은 여러 문서를 읽고 하나의 답을 만든 뒤, 근거가 된 문서 몇 개만 함께 보여줍니다. 노출되는 자리가 열 개에서 두세 개로 줄어든 셈입니다.

그래서 준비의 방향도 달라집니다. 키워드를 반복해 넣는 방식보다, 질문에 대한 답이 문서 안에 문장으로 분명히 적혀 있는가가 중요해집니다. 기계가 읽어서 인용할 수 있는 형태인지의 문제이고, 이는 사람이 읽기 좋은 문서와 크게 다르지 않습니다.

먼저 분명히 해둘 것

AI 검색에 반드시 노출시켜 준다는 약속은 성립하지 않습니다. 각 서비스가 어떤 문서를 인용할지 정하는 기준은 공개되어 있지 않고, 계속 바뀝니다. 아래 항목은 노출을 보장하는 방법이 아니라, 인용될 수 없는 상태를 피하기 위한 점검 목록입니다.

점검 항목

우리가 통제할 수 있는 여섯 가지

순서대로 확인하시면 됩니다. 1번을 놓치면 나머지는 의미가 없습니다.

  • 1. AI 크롤러가 사이트에 접근할 수 있는가 robots.txt에서 AI 검색 크롤러를 막고 있지 않은지 확인합니다. 학습용 수집과 검색 색인은 이름이 다르므로, 학습은 거부하면서 검색 노출은 허용할 수 있습니다. ChatGPT 검색은 OAI-SearchBot, 학습은 GPTBot · Claude 검색은 Claude-SearchBot, 학습은 ClaudeBot · 제미나이는 Google-Extended (각 서비스 공개 문서, 2026년 9월 확인)
  • 2. 이름이 지정된 그룹에 규칙을 다시 적었는가 robots.txt에서 User-agent: OAI-SearchBot 처럼 이름을 지정한 그룹은 User-agent: *의 규칙을 물려받지 않습니다. 공통으로 막으려던 경로가 그대로 열리는 실수가 여기서 나옵니다.
  • 3. 질문이 제목이고, 첫 문단이 답인가 문서 첫머리에 결론이 문장으로 있으면 인용하기 쉬워집니다. 배경 설명부터 시작해 결론이 마지막에 나오는 구조는 불리합니다.
  • 4. 사실이 문장으로 적혀 있는가 수치와 조건이 이미지 안이나 표 안에만 있으면 읽히지 않을 수 있습니다. 표를 쓰더라도 핵심 값은 본문 문장으로 한 번 더 적어 둡니다.
  • 5. 구조화 데이터가 있는가 회사 정보(Organization), 자주 묻는 질문(FAQPage), 제품(Product), 위치(BreadcrumbList) 같은 표준 형식으로 정보를 함께 제공합니다. 화면에 없는 내용을 구조화 데이터로만 넣지는 않습니다.
  • 6. 회사 정보가 어디서나 같은가 상호·주소·대표번호·이메일이 홈페이지, 사업자 정보, 외부 디렉터리에서 서로 다르면 어느 쪽도 확신을 갖고 인용되기 어렵습니다. 사이트 요약과 핵심 문서를 정리한 llms.txt를 함께 두면 확인이 쉬워집니다.

하면 손해가 되는 세 가지

확인되지 않은 수치와 인증을 적는 것

AI 답변은 근거 문서의 내용을 그대로 옮깁니다. 틀린 수치를 적어 두면 그 오류가 회사 이름과 함께 여러 서비스로 퍼지고, 원문을 고쳐도 이미 나간 답변은 되돌릴 수 없습니다. 사람이 읽는 페이지보다 오히려 더 보수적으로 적어야 합니다.

크롤러에만 다른 내용을 보여주는 것

사람이 보는 화면과 크롤러가 받는 내용을 다르게 만드는 방식은 검색 서비스가 명시적으로 금지하고 있으며, 적발 시 색인에서 제외될 수 있습니다.

주제만 바꿔 대량으로 찍어내는 것

같은 틀에 키워드만 바꾼 페이지를 대량으로 만드는 방식은 사람에게도 기계에도 인용할 이유를 주지 못합니다. 한 편을 제대로 쓰는 편이 낫습니다.

이 사이트에 실제로 적용한 것

권하는 방식을 저희 사이트에도 그대로 적용해 두었습니다. 직접 열어 확인하실 수 있습니다.

  • robots.txtAI 검색·학습 크롤러를 이름별 그룹으로 나누고, 각 그룹에 필요한 규칙을 다시 적었습니다. 각 토큰의 출처와 확인 날짜를 주석으로 남겨 두었습니다.
  • llms.txt회사 소개, 서비스 범위, 가격, 확인되지 않은 정보를 다루는 원칙을 한 문서로 정리했습니다.
  • 구조화 데이터Organization · WebSite · Service · FAQPage · BreadcrumbList를 각 페이지에 넣었습니다. 화면에 없는 내용은 넣지 않습니다.
  • 보장하지 않는 문장검색 순위·문의 건수·매출 증가를 예측하거나 보장하는 표현을 쓰지 않습니다. 이 원칙은 사이트 전체와 llms.txt에 동일하게 적어 두었습니다.
자주 묻는 질문

AI 검색 노출에 대해 많이 받는 질문

AI 검색에 반드시 나오게 해준다는 제안을 믿어도 되나요?

권하지 않습니다. ChatGPT·제미나이·퍼플렉시티가 어떤 문서를 인용할지 정하는 기준은 공개되어 있지 않고 계속 바뀝니다. 노출과 인용을 보장한다는 말은 근거를 댈 수 없는 약속입니다. 확인할 수 있는 것은 크롤러 접근 허용 여부, 문서 구조, 정보의 정확성처럼 우리가 통제 가능한 항목뿐입니다.

GPTBot을 막으면 ChatGPT 검색 결과에도 안 나오나요?

토큰이 다릅니다. OpenAI는 학습용 수집(GPTBot)과 ChatGPT 검색 색인(OAI-SearchBot), 사용자가 링크를 열 때의 요청(ChatGPT-User)에 각각 다른 이름을 씁니다. 학습은 거부하면서 검색 노출은 허용하는 설정이 가능합니다. 다만 robots.txt에서 이름이 지정된 그룹은 User-agent: * 규칙을 물려받지 않으므로, 각 그룹에 필요한 규칙을 다시 적어야 합니다.

Google-Extended를 허용하면 구글 검색 순위가 올라가나요?

아니요. 구글은 Google-Extended가 제미나이 등의 학습과 근거 활용에만 관여하며 구글 검색 색인이나 순위에는 영향을 주지 않는다고 밝히고 있습니다. 검색 순위를 위해 허용해야 하는 항목이 아닙니다.

지금 우리 사이트가
어떤 상태인지 확인해 드립니다

robots.txt와 구조화 데이터, 문서 구조를 점검하고 무엇부터 손봐야 하는지 정리해 드립니다. 노출이나 인용을 보장하지는 않습니다.