크롤링
Crawling
웹을 긁어 데이터를 모으는 일. AI 학습을 둘러싼 저작권 분쟁의 진원지.
쉽게 말하면
프로그램(크롤러)이 웹을 돌아다니며 페이지를 긁어 모으는 일입니다. 구글 검색이 원조 사용처이고, AI 회사들이 학습 데이터를 모으는 방법이기도 합니다.
AI 시대 저작권 분쟁의 진원지입니다 — 「내 기사·그림·글을 허락 없이 긁어 AI를 학습시켰다」는 소송이 언론사·작가·화가들로부터 이어지고 있습니다. 사이트가 「긁어 가지 마시오」라고 적어 두는 robots.txt 라는 표지판이 있지만 강제력이 약해서, 이를 무시한 수집이 자주 뉴스가 됩니다. 라이선스 계약(콘텐츠 사용료)으로 푸는 흐름도 함께 커지고 있습니다.
함께 볼 용어
이 용어가 나온 기사
- 법원 서류에 흰 글씨로 숨긴 AI 지시문, 결국 덜미 잡혔다Culture · 2026.08.15
- 커서, 코드베이스·리뷰 탭 비공개 베타 테스트Products · 2026.08.13
- 앤트로픽, 클로드 생성물에 전 세계 워터마크 의무화Products · 2026.08.11
- 렙플릿·구글 클라우드, '영화관 해커톤'으로 에이전트 개발자 모은다Business · 2026.08.12
- 구글, AI 생성물의 눈에 보이는 워터마크 제거 허용Products · 2026.08.15
- 구글, 어스 AI 기능 공개 하루 만에 내렸다Products · 2026.08.01