기초

SEO·GEO 용어 사전 — 크롤링·색인부터 AI 개요·llms.txt까지 필수 용어 정리

SEO Check 편집팀 · 2026-09-28 업데이트 · 13분 읽기

SEO·GEO 용어 사전은 검색엔진 최적화와 AI 검색 최적화에서 자주 쓰는 용어 60여 개를 분야별로 풀이한 페이지입니다. 진단 결과나 서치 콘솔에서 낯선 단어를 만나면 여기서 뜻을 확인하고, 연결된 가이드에서 구체적인 해결 방법을 살펴보세요. 정의는 2026년 9월 기준 구글·네이버 공식 문서의 설명에 맞춰 정리했습니다.

기초 개념

SEO (Search Engine Optimization)

검색엔진 최적화. 구글·네이버 같은 검색엔진이 사이트를 잘 수집하고 이해해 자연 검색 결과에 노출하도록 사이트와 콘텐츠를 개선하는 작업입니다. 원리는 SEO란 무엇인가에서 설명합니다.

GEO (Generative Engine Optimization)

생성형 엔진 최적화. ChatGPT, Perplexity, 구글 AI 개요 같은 AI 답변에 내 사이트가 출처로 인용되도록 만드는 작업으로, AEO(답변 엔진 최적화)라고도 부릅니다. 자세한 내용은 GEO 가이드를 참고하세요.

SERP (Search Engine Results Page)

검색 결과 페이지. 자연 검색 결과뿐 아니라 광고, AI 개요, 지도, 이미지, 동영상 같은 여러 영역(SERP 기능)으로 구성됩니다.

검색 의도 (Search Intent)

사용자가 검색한 진짜 목적입니다. 보통 정보형·탐색형·거래형·비교 조사형으로 나누며, 의도와 맞지 않는 페이지는 순위가 오르기 어렵습니다. 좋은 콘텐츠의 조건에서 유형별 대응법을 다룹니다.

크롤링 (Crawling)

검색엔진 로봇이 링크와 사이트맵을 따라 웹 페이지를 가져오는 수집 단계입니다.

색인 (Indexing)

수집한 페이지를 분석해 검색용 데이터베이스에 저장하는 단계입니다. 색인되지 않은 페이지는 검색 결과에 나올 수 없습니다.

순위 (Ranking)

검색어마다 색인된 페이지의 노출 순서를 정하는 단계로, 관련성·콘텐츠 품질·사용성·사용자의 위치와 언어 같은 신호를 종합합니다.

코어 업데이트 (Core Update)

구글이 1년에 여러 차례 순위 시스템 전반을 크게 조정하는 업데이트입니다. 특정 사이트를 겨냥한 제재는 아닙니다.

기술 SEO

크롤러 (Crawler)

검색엔진이 웹 페이지를 수집하는 프로그램으로 검색로봇·봇이라고도 합니다. 구글은 Googlebot, 네이버는 Yeti, 다음은 Daumoa, Bing은 Bingbot을 사용합니다.

robots.txt (Robots Exclusion Protocol)

사이트 최상위 경로(/robots.txt)에 두고 크롤러별로 수집을 허용하거나 막을 경로를 알려 주는 텍스트 파일입니다. 색인 제거가 아니라 수집 제어용이며, 구글은 500KiB까지만 읽습니다. robots.txt 작성법을 참고하세요.

XML 사이트맵 (XML Sitemap)

검색엔진에 알리고 싶은 URL 목록과 수정일(lastmod)을 담은 파일입니다. 파일 하나에 URL 5만 개·50MB(압축 전)까지 넣을 수 있고, 넘으면 사이트맵 색인 파일로 나눕니다. 사이트맵 가이드를 참고하세요.

noindex (Robots Meta Tag)

<meta name="robots" content="noindex">로 페이지를 검색 결과에서 빼 달라고 요청하는 지시어입니다. PDF 같은 비HTML 파일은 응답 헤더 X-Robots-Tag로 같은 지시를 보냅니다. 크롤러가 태그를 읽어야 하므로 robots.txt로 막으면 효과가 없습니다.

canonical 태그 (Canonical Tag)

내용이 같거나 거의 같은 URL이 여러 개일 때 대표 URL을 알려 주는 <link rel="canonical"> 태그입니다. 구글은 이를 강한 힌트로 참고해 대표 URL을 스스로 결정합니다. canonical 가이드를 참고하세요.

리디렉션 (Redirect)

요청한 URL을 다른 URL로 자동 이동시키는 응답입니다. 영구 이동은 301(또는 308), 임시 이동은 302(또는 307)를 쓰고, A→B→C처럼 여러 번 거치는 리디렉션 체인은 한 번으로 줄입니다. 크롤링 오류·리디렉션 가이드를 참고하세요.

소프트 404 (Soft 404)

없는 페이지나 내용이 빈 페이지가 404 대신 200을 반환하는 상태입니다. 구글은 이런 페이지를 색인하지 않으므로, 없는 페이지는 실제 404나 410을 반환해야 합니다.

렌더링 (Rendering)

HTML·CSS·자바스크립트를 실행해 화면을 그리는 과정입니다. 구글은 자바스크립트를 렌더링하지만 네이버 Yeti와 상당수 AI 크롤러는 처리가 제한적이므로, 핵심 본문은 서버 렌더링(SSR)이나 정적 생성(SSG)으로 HTML에 넣는 것이 안전합니다.

모바일 우선 색인 (Mobile-first Indexing)

구글이 모바일 버전 페이지를 기준으로 색인하고 순위를 정하는 방식입니다. 모바일 화면에서 본문이 빠지거나 viewport 메타 태그가 없으면 불리합니다. 모바일 최적화 가이드를 참고하세요.

HTTPS (SSL/TLS)

TLS 인증서로 브라우저와 서버 사이의 통신을 암호화하는 방식으로, 구글의 순위 신호 중 하나입니다. HTTPS·보안 가이드를 참고하세요.

HSTS (HTTP Strict Transport Security)

브라우저가 해당 도메인에 항상 HTTPS로만 접속하도록 지시하는 응답 헤더입니다. max-age는 6개월(15768000초) 이상을 권장합니다.

hreflang

같은 내용의 언어·지역별 버전(예: 한국어·영어 페이지)을 서로 알려 주는 속성입니다. 모든 버전이 서로를 가리켜야 하고, 기본 페이지는 x-default로 지정합니다. hreflang 가이드를 참고하세요.

TTFB (Time to First Byte)

요청 후 서버가 첫 번째 응답 바이트를 보내기까지 걸린 시간입니다. SEO Check는 서울에서 측정해 0.8초 이하를 통과, 0.2초 안팎을 이상적인 수준으로 봅니다.

코어 웹 바이탈 (Core Web Vitals)

구글이 페이지 경험을 평가하는 세 지표 LCP·INP·CLS입니다. 실제 사용자 데이터의 75번째 백분위 값이 기준을 충족해야 '좋음'으로 판정됩니다. 페이지 속도 가이드를 참고하세요.

LCP (Largest Contentful Paint)

화면에서 가장 큰 이미지나 텍스트 블록이 표시되기까지 걸린 시간으로, 2.5초 이하가 좋음입니다.

INP (Interaction to Next Paint)

클릭·탭·키 입력 뒤 화면이 반응하기까지 걸린 시간으로, 200ms 이하가 좋음입니다. 2024년 3월 FID를 대체했고, 실험실 측정에서는 TBT(총 차단 시간) 200ms 이하를 대리 지표로 봅니다.

CLS (Cumulative Layout Shift)

페이지를 보는 동안 요소가 예기치 않게 밀리는 정도를 수치로 나타낸 값으로, 0.1 이하가 좋음입니다.

온페이지

타이틀 태그 (Title Tag)

<title>에 적는 페이지 제목으로, 검색 결과의 파란 제목과 브라우저 탭에 쓰입니다. 한글 15~30자 안에 핵심 키워드와 브랜드를 담는 것이 좋습니다. 타이틀·메타 설명 작성법을 참고하세요.

메타 설명 (Meta Description)

검색 결과 제목 아래에 보일 수 있는 페이지 요약문입니다. 순위 요소는 아니지만 클릭률에 영향을 주므로 한글 40~80자로 페이지마다 다르게 씁니다.

제목 태그 (Heading Tags)

H1~H6으로 본문의 제목 계층을 표시하는 태그입니다. 페이지 주제를 담은 H1을 하나 두고 H2→H3 순서로 내려가는 구조가 기본입니다. H1·제목 구조 가이드를 참고하세요.

대체 텍스트 (Alt Text)

이미지의 내용을 글로 설명하는 alt 속성입니다. 장식용 이미지는 alt=""로 비워 둡니다. 이미지 SEO 가이드를 참고하세요.

내부 링크 (Internal Link)

같은 사이트 안의 다른 페이지로 연결하는 링크입니다. 크롤러가 페이지를 발견하는 통로이자 페이지 사이의 관계와 중요도를 알리는 신호입니다. 내부 링크 전략을 참고하세요.

앵커 텍스트 (Anchor Text)

링크로 걸린 클릭 가능한 글자입니다. "여기를 클릭" 대신 "사이트맵 제출 방법"처럼 목적지 내용을 설명하는 문구가 좋습니다.

구조화 데이터 (Structured Data)

회사·상품·글 정보를 schema.org 어휘로 기계가 읽기 쉽게 표시한 코드입니다. 구글은 <script type="application/ld+json">에 넣는 JSON-LD 형식을 권장합니다. 구조화 데이터 가이드를 참고하세요.

리치 결과 (Rich Results)

가격·재고·별점·행사 날짜처럼 구조화 데이터를 바탕으로 일반 결과보다 풍부하게 표시되는 검색 결과입니다. HowTo 리치 결과는 2023년에 없어졌고, FAQ 리치 결과는 2023년 정부·보건 사이트로 제한된 뒤 2026년 5월 7일부터 표시되지 않습니다. 다만 FAQPage 마크업은 AI 답변 엔진이 질문과 답을 파악하는 데 여전히 도움이 됩니다.

오픈 그래프 (Open Graph)

카카오톡·페이스북 등에 링크를 공유할 때 보이는 제목·설명·이미지를 지정하는 og: 메타 태그입니다. 대표 이미지는 1200×630px을 권장합니다. Open Graph 가이드를 참고하세요.

콘텐츠·GEO

E-E-A-T (Experience, Expertise, Authoritativeness, Trustworthiness)

경험·전문성·권위·신뢰를 뜻하며, 구글 검색 품질 평가 가이드라인이 콘텐츠를 평가하는 기준입니다. 이 중 신뢰가 가장 중요하다고 명시되어 있습니다. E-E-A-T 가이드를 참고하세요.

YMYL (Your Money or Your Life)

건강·금융·법률·안전처럼 사람의 삶에 큰 영향을 줄 수 있는 주제입니다. 잘못된 정보의 피해가 크기 때문에 전문성과 출처가 더 엄격하게 요구됩니다.

사람 중심 콘텐츠 (People-first Content)

검색 순위보다 독자의 문제 해결을 먼저 생각해 만든 콘텐츠입니다. 구글의 '도움이 되는 콘텐츠' 평가는 2024년 3월부터 핵심 순위 시스템에 통합되어 상시 작동합니다.

얇은 콘텐츠 (Thin Content)

내용이 거의 없거나 다른 글을 짜깁기해 독자에게 새로운 가치를 주지 못하는 페이지입니다. 보강하거나 비슷한 글과 합치고, 가치가 없으면 삭제나 noindex로 정리합니다.

토픽 클러스터 (Topic Cluster)

주제 전체를 개괄하는 필러(기둥) 페이지와 세부 질문을 다루는 클러스터 글을 내부 링크로 묶은 구조입니다. 한 주제를 넓고 깊게 다뤄 주제 권위(Topical Authority)를 보여 주는 데 쓰입니다.

대규모 콘텐츠 악용 (Scaled Content Abuse)

순위 조작을 주목적으로 가치 없는 페이지를 대량 생산하는 행위로, 2024년 3월 구글 스팸 정책에 추가되었습니다. AI로 만들었든 사람이 썼든 똑같이 적용됩니다.

AI 개요·AI 모드 (AI Overviews / AI Mode)

AI 개요는 구글 검색 결과 위쪽에 생성형 AI 요약과 근거 링크를 보여 주는 기능이고, AI 모드는 후속 질문을 이어 갈 수 있는 대화형 검색입니다. 둘 다 구글 검색 색인을 근거로 삼으므로 별도 마크업 없이 기본 SEO가 출발점입니다.

AI 크롤러 (AI Crawler)

AI 서비스가 웹 문서를 수집하는 봇입니다. GPTBot·ClaudeBot 같은 학습용, OAI-SearchBot·Claude-SearchBot·PerplexityBot 같은 검색용, ChatGPT-User·Claude-User처럼 사용자 요청 시 방문하는 봇으로 나뉩니다. AI 크롤러 관리를 참고하세요.

Google-Extended

구글이 수집한 콘텐츠를 Gemini 모델의 학습과 그라운딩에 쓸지 정하는 robots.txt 제어 토큰입니다. 별도의 크롤러가 아니며, 차단해도 구글 검색과 AI 개요 노출에는 영향이 없습니다.

llms.txt

사이트 요약과 핵심 페이지 링크를 마크다운으로 정리해 AI 도구에 알려 주는 파일로, 2024년 9월 Jeremy Howard가 제안한 표준안입니다. 검색엔진이 요구하는 파일은 아니지만 AI 에이전트가 사이트를 파악하는 데 도움이 됩니다. llms.txt 작성 가이드를 참고하세요.

엔티티 (Entity)

검색엔진과 AI가 하나의 대상으로 인식하는 사람·회사·장소·개념입니다. 구글은 엔티티와 그 관계를 지식 그래프(Knowledge Graph)로 관리합니다.

sameAs

Organization 구조화 데이터에서 공식 SNS·블로그·위키 페이지 주소를 나열해 "모두 같은 회사"라고 알려 주는 속성입니다. 흩어진 채널을 하나의 엔티티로 묶어 줍니다.

AI 브리핑 (Naver AI Briefing)

네이버 통합검색에서 여러 문서를 요약해 출처와 함께 보여 주는 생성형 AI 답변입니다. 네이버가 수집·색인한 문서가 재료이므로 Yeti 수집 허용이 먼저입니다. 네이버 SEO 가이드를 참고하세요.

C-Rank·D.I.A. (네이버 검색 모델)

네이버가 공개한 순위 모델로, C-Rank는 출처가 특정 주제에서 얼마나 신뢰할 만한지, D.I.A.는 문서 자체의 품질과 경험 정보를 평가합니다. 주로 블로그 검색 순위 설명에 쓰입니다.

링크·권위

백링크 (Backlink)

다른 사이트에서 내 사이트로 연결된 링크입니다. 관련성 높고 신뢰할 만한 사이트의 링크는 추천처럼 작용하지만, 개수보다 질이 중요합니다. 백링크 가이드를 참고하세요.

참조 도메인 (Referring Domains)

내 사이트로 링크를 보낸 서로 다른 도메인의 수입니다. 한 사이트에서 받은 링크 100개보다 서로 다른 사이트 10곳의 링크가 권위를 판단하는 데 더 의미가 있습니다.

DR (Domain Rating)

Ahrefs가 백링크 데이터로 계산하는 0~100점 도메인 권위 지표로, 점수가 높을수록 한 단계 올리기가 어려운 로그 척도입니다. 구글이 쓰는 점수는 아니며, SEO Check는 지역 비즈니스 기준 30 이상을 양호로 봅니다.

링크 속성 (rel="nofollow" · "sponsored" · "ugc")

링크의 성격을 알리는 속성입니다. 광고·협찬 링크는 sponsored, 댓글·게시판 같은 사용자 작성 링크는 ugc, 보증하지 않는 링크는 nofollow를 쓰며, 구글은 이를 힌트로 참고합니다.

수동 조치 (Manual Action)

구글 검토자가 스팸 정책 위반을 확인해 사이트 일부나 전체의 순위를 낮추거나 제외하는 조치입니다. 서치 콘솔 '수동 조치' 보고서에서 확인하고, 문제를 고친 뒤 재검토를 요청합니다.

브랜드 언급 (Brand Mention)

링크 없이 언론·커뮤니티·리뷰에서 브랜드 이름이 거론되는 것입니다. AI는 여러 출처에서 반복되는 정보를 신뢰하므로 GEO에서 특히 중요한 신호입니다.

NAP (Name, Address, Phone)

상호·주소·전화번호입니다. 홈페이지, 구글 비즈니스 프로필, 네이버 플레이스, SNS에 똑같이 표기해야 지역 검색과 AI가 같은 업체로 인식합니다.

측정·도구

구글 서치 콘솔 (Google Search Console)

구글이 무료로 제공하는 사이트 관리 도구입니다. 색인 현황, 검색 실적, 수동 조치, 코어 웹 바이탈을 확인하고 사이트맵을 제출할 수 있습니다.

페이지 색인 생성 보고서 (Page Indexing Report)

서치 콘솔에서 색인된 페이지와 색인되지 않은 페이지, 그 이유(noindex, 리디렉션, 크롤링됨 - 현재 색인이 생성되지 않음 등)를 보여 주는 보고서입니다. 읽는 법은 구글 노출 점검법에서 설명합니다.

네이버 서치어드바이저 (Naver Search Advisor)

네이버의 웹마스터 도구입니다. 사이트 소유확인, 사이트맵·RSS 제출, 수집 요청, 검색 노출 현황 확인을 할 수 있습니다.

Bing 웹마스터 도구 (Bing Webmaster Tools)

Bing의 사이트 관리 도구입니다. Bing 색인은 Bing 검색뿐 아니라 이를 활용하는 일부 AI 검색 서비스에도 쓰이므로 함께 등록해 두는 것이 좋습니다.

노출수·클릭수·CTR (Impressions / Clicks / Click-through Rate)

노출수는 검색 결과에 페이지가 표시된 횟수, 클릭수는 실제 방문으로 이어진 횟수, CTR은 클릭수를 노출수로 나눈 비율입니다. 노출은 많은데 CTR이 낮다면 타이틀과 메타 설명부터 손봅니다.

PageSpeed Insights·Lighthouse

PageSpeed Insights는 실제 사용자 데이터(CrUX)와 실험실 측정을 함께 보여 주는 구글의 속도 진단 도구입니다. 실험실 측정에 쓰이는 Lighthouse는 성능·접근성·SEO를 0~100점으로 채점하는 오픈소스 도구입니다.

site: 검색 (site: Operator)

구글에 site:example.com처럼 입력해 해당 도메인에서 색인된 페이지를 대략 확인하는 검색 연산자입니다. 표시되는 개수는 추정치이므로 정확한 현황은 서치 콘솔에서 확인합니다.

SEO Check에서는 이렇게 점검합니다

무료 SEO 진단 결과는 이 사전의 용어로 구성되어 있습니다. 영역별 대표 용어와 통과 기준은 다음과 같습니다.

진단 영역 관련 용어 대표 통과 기준
접속·서버 HTTPS, 리디렉션, TTFB HTTP 200, HTTP→HTTPS 301, 리디렉션 1단계 이하, TTFB 0.8초 이하
메타·콘텐츠 타이틀 태그, 메타 설명, canonical, H1 title 한글 1530자, description 4080자, H1 1개
크롤링 robots.txt, 사이트맵, noindex 구글·네이버·다음·Bing 로봇 허용, 사이트맵 표본 URL 모두 200
공유·구조화 오픈 그래프, 구조화 데이터 og:image 1200×630, JSON-LD 문법 오류 없음
GEO AI 크롤러, llms.txt, 엔티티 AI 검색봇 허용, Organization + sameAs
권위 DR, 참조 도메인 DR 30 이상(지역 비즈니스 기준)

정밀진단 리포트는 여기에 Lighthouse 모바일 측정(LCP·TBT·CLS)과 30페이지 크롤링(상태 코드, 깨진 내부 링크, 얇은 콘텐츠)을 더합니다. 항목을 순서대로 점검하려면 SEO·GEO 체크리스트를 활용하세요.

자주 묻는 질문

SEO와 GEO는 어떻게 다른가요?
SEO는 검색 결과 목록에서 상위에 노출되는 것을, GEO는 ChatGPT·구글 AI 개요 같은 AI 답변에 출처로 인용되는 것을 목표로 합니다. AI 서비스도 웹 문서를 수집해 답을 만들기 때문에 크롤링·색인·신뢰라는 SEO의 기반이 GEO의 전제 조건입니다.
크롤링과 색인은 무엇이 다른가요?
크롤링은 검색엔진 로봇이 페이지를 가져오는 수집 단계이고, 색인은 가져온 내용을 분석해 검색용 데이터베이스에 저장하는 단계입니다. 크롤링된 페이지라도 품질이 낮거나 중복이면 색인되지 않을 수 있습니다.
DR과 DA는 같은 지표인가요?
아닙니다. DR은 Ahrefs, DA는 Moz가 각자의 링크 데이터로 계산하는 0~100점 지표입니다. 둘 다 구글이 순위에 쓰는 점수가 아니라 사이트의 링크 권위를 비교하기 위한 참고 지표입니다.

이 항목, 내 사이트는 어떨까요?

무료 간편진단으로 SEO 용어 사전를 포함한 핵심 항목을 1분 만에 확인하세요.

무료 진단하기