홈 개발 이야기 구글 반독점 재판에서 공개된 검색 랭킹 알고리즘의 실체

구글 반독점 재판에서 공개된 검색 랭킹 알고리즘의 실체

2023년 가을, 워싱턴 D.C. 연방법원에서 구글 검색 부사장과 전직 엔지니어가 선서한 채 검색 순위의 내부를 증언했습니다. 클릭 이야기를 흐려 온 구글의 공개 입장, 사내 슬라이드에 적힌 "우리는 문서를 이해하지 못합니다"라는 문장, 13개월치 클릭을 기억하는 Navboost와 주로 사이트 단위로 매겨지는 품질 점수 Q*까지, 속기록과 판결문을 따라 재판의 장면을 되짚었습니다.

카테고리 개발 이야기 작성일 2026. 8. 18 작성자 By 정재철

2023년 10월 18일 오후 1시 32분, 미국 워싱턴 D.C. 연방지방법원에서 재판이 다시 열렸습니다. 미국 법무부가 검색 시장 독점을 문제 삼아 구글을 제소한 사건이었습니다. Amit Mehta 판사 앞 증인석에는 구글 검색 부사장 Pandu Nayak이 앉아 있었습니다. 2004년 11월 구글에 입사해 오랫동안 검색 품질팀을 이끌어 온 그는, 오전 증언에서 자신을 구글의 검색 부사장 네 명 가운데 한 명이라고 소개했습니다.

그는 구글이 부른 증인이었습니다. 원고 측 입증이 이어지던 중에 일정 때문에 순서를 앞당겨 증인석에 섰고, 오전에는 구글 변호인의 질문에 답하며 검색을 만드는 일을 설명했습니다. 오후는 달랐습니다. 이번에는 법무부 변호사 Kenneth Dintzer가 반대신문을 시작했습니다.

나무 판사석에 앉은 판사, 증인석에서 마이크에 답하는 증인, 신문대에 선 변호사를 그린 연방 법정 일러스트
2023년 10월 18일 오후, 워싱턴 D.C. 연방지방법원. 배심원 없이 판사가 직접 심리한 재판이었습니다.

첫 질문에는 뜻밖에도 테일러 스위프트가 등장했습니다.

Dintzer: "넓은 질문부터 하겠습니다. 구글은 지금 사용자 데이터를 얼마나 갖고 있습니까? 제가 테일러 스위프트를 검색하면, 구글의 어떤 시스템이든 그 기록을 얼마나 오래 갖고 있습니까?"
Nayak: "구체적으로 답할 수 있을지 모르겠지만, 익명화되고 비식별화된 데이터라면 계속 보관할 수도 있을 것 같습니다. 지울지는 모르겠습니다."
Dintzer: "영원히요?"
Nayak: "글쎄요."
Dintzer: "영원은 긴 시간이죠."
Nayak: "영원은 긴 시간이니, 그렇게 말하지는 않겠습니다."
Dintzer: "무기한으로요?"
Nayak: "로그를 얼마나 오래 보관하는지는 제가 전문가가 아닙니다. 지울 가능성도 있지만, 저는 알지 못합니다."

구글이 사용자의 흔적을 얼마나 오래, 얼마나 많이 쥐고 있느냐. 이 질문은 그날 오후 반대신문이 어디로 향할지를 미리 보여 줬습니다. 그리고 얼마 지나지 않아, SEO 업계가 오랫동안 묻고 구글이 오랫동안 흐려 온 질문의 답이 속기록에 남았습니다.

구글이 밖에서 해 온 말

이 장면의 무게를 알려면 시곗바늘을 15년쯤 거꾸로 돌려, 법정 밖에서 구글이 해 온 말부터 들어 봐야 합니다. 2008년 구글 웹스팸팀을 이끌던 Matt Cutts는 한 기사를 두고, 글은 읽지 않았다면서도 이탈률은 스팸에 악용되기 쉬울 뿐 아니라 잡음도 많을 것이라는 댓글을 남겼습니다.

2016년 라스베이거스에서 열린 SEO 콘퍼런스 펍콘에서 Gary Illyes는 클릭에는 대체로 잡음이 엄청나게 많다고 말했습니다. 사람들이 검색 결과 페이지에서 정신없이 여기저기 누르는 이상한 행동을 한다는 이유였습니다. 다만 같은 자리에서 CTR(클릭률)이 개인화에는 쓰인다고도 했습니다. 2019년 레딧 질의응답에서는 한발 더 나아가, 체류시간이나 CTR을 둘러싼 이론은 대체로 지어낸 헛소리라고 잘라 말했습니다.

2021년 11월에는 John Mueller가 비슷한 말을 했습니다. CTR이 순위를 정한다면 검색 결과가 온통 낚시성 제목으로 덮였을 텐데, 그런 일은 보이지 않는다고 썼습니다.

세 사람이 든 이유 자체는 틀리지 않았습니다. 클릭에는 실제로 잡음이 많고, 클릭 수만으로 순위를 매기면 낚시성 제목이 판칠 것입니다. 다만 그 말들은 한 가지 질문에는 분명히 답하지 않았습니다. 구글이 순위를 매길 때 클릭을 쓰느냐는 질문입니다.

사내 슬라이드에 적힌 "우리는 문서를 이해하지 못합니다"

같은 시기 구글 안에서는 다른 문장이 돌고 있었습니다. 2016년 12월 8일 구글 검색 조직의 분기 전체회의에서 랭킹 부문 발표를 맡은 사람은 엔지니어 Eric Lehman이었습니다. 그의 발표 슬라이드에는 이런 제목이 붙어 있었습니다. "우리는 문서를 이해하지 못합니다. 이해하는 척할 뿐입니다."

어두운 강당에서 발표자가 화면 옆에 서 있고, 화면에 우리는 문서를 이해하지 못합니다, 이해하는 척할 뿐입니다라는 문구가 떠 있는 일러스트
2016년 12월 구글 검색 조직 분기 전체회의. 화면의 문구는 법무부가 공개한 Eric Lehman의 발표 슬라이드를 한국어로 옮긴 것입니다.

슬라이드에 딸린 발표 노트는 더 직설적입니다. "말도 안 되는 건 우리가 문서를 실제로는 이해하지 못한다는 사실입니다. 기본적인 것 말고는 문서를 거의 보지 않습니다. 우리는 사람을 봅니다. 어떤 문서에 긍정적인 반응이 오면 좋은 문서라고 판단합니다. 반응이 부정적이면 아마 나쁜 문서일 겁니다. 아주 단순하게 말하면, 이것이 구글이 부리는 마법의 원천입니다."

Lehman은 MIT에서 이론 컴퓨터과학으로 박사 학위를 받고 2005년 구글에 들어가, 17년 넘게 검색 품질과 랭킹 업무를 맡은 엔지니어입니다.

2년 뒤인 2018년 11월, Lehman은 검색 업무에 더 깊이 관여하게 된 구글 연구자들 앞에서 '연구자를 위한 랭킹'이라는 발표를 했습니다. 조심해야 할 주제를 모은 슬라이드에 그는 이렇게 썼습니다. "검색에서 클릭을 쓰는 일에 대해서는 이야기하지 마십시오. 꼭 알아야 하는 경우에, 밖에서 이 이야기를 하면 안 된다는 걸 아는 사람과 나누는 것만 예외입니다. 구글에는 공개 입장이 있습니다. 논란의 여지가 있는 입장입니다. 하지만 각자 자기 입장을 만들지는 마십시오."

이 발표가 있고 석 달이 채 지나지 않은 2019년 2월, 레딧에 "지어낸 헛소리"라는 답이 올라왔습니다. 밖에서 한 말과 안에서 한 말 사이의 거리는, 5년 뒤 법정에서 좁혀지기 시작합니다.

법무부가 부른 전직 엔지니어

Lehman은 2022년 11월 구글을 떠났습니다. 일이 너무 힘들어져 가족을 돌보는 것과 병행하기 어려웠다고 했습니다. Nayak보다 한 달 앞선 2023년 9월 20일, 증인석에서 지금 무슨 일을 하느냐는 질문을 받자 그는 "집에서 아이를 돌보는 아빠입니다"라고 답했습니다. 그를 증인으로 부른 쪽은 구글이 아니라 법무부였습니다.

법무부 변호사 Erin Murdock-Park가 사용자 상호작용 데이터가 무엇이냐고 묻자, Lehman은 이렇게 설명했습니다. "검색의 가장 큰 문제는, 검색어와 웹페이지가 주어졌을 때 그 페이지가 검색어와 관련이 있느냐는 것입니다. 사람은 쉽게 판단합니다. 페이지를 읽고 생각해 보면 되니까요. 하지만 검색엔진은 컴퓨터 위에서 돌아가고, 컴퓨터는 글을 읽지 못했습니다. 그래서 이걸 우회하는 요령 같은 게 있습니다. 사람들에게 웹페이지를 보여 주고 그 반응을 보는 겁니다."

그가 든 예는 검색 결과 다섯 개였습니다. 사람들이 그중 무엇을 누르고 무엇을 건너뛰는지가, 그 페이지가 검색어에 맞는지 알려 주는 힌트가 된다는 것입니다.

공개 신문이 끝나기 직전, Murdock-Park가 앞의 2018년 슬라이드를 꺼냈습니다. 그가 쓴 문구를 그대로 읽은 뒤 물었습니다. "그러니까 구글에는 클릭에 관한 공개 입장이 있는 거죠?" Lehman의 대답은 이렇게 시작했습니다. "그럼 그냥 이야기하겠습니다. 영업비밀 문제가 있는지, 경계가 어디인지 잘 모르겠습니다."

구글 변호인은 영업비밀에 관한 질문이니 비공개 신문에서 묻는 게 맞겠다고 나섰지만, 판사는 할 수 있는 질문까지는 해 보자고 했습니다. 법무부가 클릭에 관한 구글의 공개 입장이 완전히 정확하지는 않은 것 아니냐고 묻자 구글 변호인이 다시 끼어들었습니다. 판사가 정리했습니다. "공개 입장이 무엇인지부터 들어 봅시다. 공개된 것이니까요." Lehman이 답했습니다.

"저는 홍보 담당자는 아니지만, 우리가 지향해 온 입장은 이런 것 같습니다. 검색엔진 최적화를 하는 사람들이나 자기 이익을 위해 검색 결과를 조작하려는 사람들에게, 우리가 사용자 데이터를 쓴다는 분명하고 확실한 메시지를 주지 않는 것입니다. 그들이 그걸 이용해 구글을 해치고, 구글을 쓰는 모든 사람의 검색 품질을 해칠 수 있기 때문입니다. 그래서 우리는 검색 시스템을 평가할 때 사용자 피드백 데이터, 곧 클릭을 쓴다고 말해 왔습니다. 그리고 검색 결과의 순위를 매기는 데 사용자 데이터를 쓴다는 것은 확인해 주지 않으려 했습니다. 예를 들면 클릭을 순위에 쓰는 데는 어려움이 많다고 말하는 식이었던 것 같습니다. 쓰지 않는다고 대놓고 말하지는 않지만, 쓴다고 믿게 하지도 않는 거죠."

평가에 쓴다는 말까지만 하고, 순위에 쓴다는 말은 피해 왔다는 뜻입니다. 그는 이렇게 덧붙였습니다. "문제는 구글이 순위에 클릭을 쓴다는 걸 거의 모두가 안다는 겁니다. 우리는 이미 공격받고 있습니다. 그래서 가끔은 '잠깐, 왜 이걸 비밀로 하려는 거죠? 정말로 다들 아는 건데요'라고 말하는 사람들이 있습니다. 그래서 각자 입장을 만들지 말라는 겁니다. 그래서 논란의 여지가 있다는 것이고, 사람들이 벌이는 논쟁도 그겁니다. 전혀 모호하지 않은, 모두가 아는 문제를 왜 흐리려 하느냐는 거죠."

공개 신문은 이 대답을 끝으로 멈췄습니다. 판사는 3시 35분에 다시 시작하자고 했고, 휴정 뒤의 신문은 비공개로 이어졌습니다.

법원 복도에서 거의 닫힌 법정 문틈으로 푸른 빛이 새어 나오는 일러스트. 벽시계는 3시 16분을 가리킨다
2023년 9월 20일 오후 3시 16분 휴정 뒤, Lehman의 신문은 비공개로 이어졌습니다.

비공개 신문에서 법무부는 Lehman이 2017년 무렵 정리한 '랭킹 뉴스레터 개요'라는 사내 문서를 꺼내, 그가 쓴 한 줄을 읽었습니다. "Navboost는 최초의 클릭 활용 시스템이자 지금도 가장 강력한 시스템이다." 맞느냐는 물음에 Lehman은 "네"라고 답했습니다.

이어 Navboost가 일정 기간(공개본에서는 가려져 있습니다)의 사용자 데이터로 학습한다는 질문을 받자, Lehman은 이렇게 답했습니다. "그렇게 알고 있습니다. 다만 여기서 '학습'이라는 말은 조금 오해를 부를 수 있습니다. Navboost는 머신러닝 시스템이 아닙니다. 그냥 큰 표입니다. 이 검색어에서 이 문서는 클릭 두 번, 이 검색어에서 이 문서는 클릭 세 번, 이런 식입니다. 집계된 값이고 부가 데이터가 조금 있지만, 그냥 거대한 표라고 생각하시면 됩니다."

이 대목은 비공개 신문이었던 탓에 당시 공개 속기록에서 빠져 있었고, 2024년 5월 편집본 속기록이 공개되면서 비로소 알려졌습니다.

Lehman의 증언 한 달 뒤인 10월 18일, Nayak은 법정에서 Glue도 설명했습니다. 검색 결과 화면에서 웹 문서가 아닌 나머지 요소를 맡는 시스템으로, 그의 표현으로는 "페이지의 다른 모든 요소까지 포함한 Navboost의 또 다른 이름"입니다.

Lehman은 클릭의 한계도 숨기지 않았습니다. 역시 비공개로 진행된 구글 측 반대신문에서 그는, 사람들이 구글이 보여 주고 싶은 것보다 품질이 낮고 권위가 덜한 콘텐츠를 클릭하는 경향이 아주 뚜렷하다고 말했습니다. 클릭에 너무 끌려가면 검색 결과의 품질이 목표보다 떨어진다는 것입니다. 클릭을 모아 둔 장부가 있다고 해서 클릭만 많이 받으면 이기는 구조는 아니라는 뜻입니다. 구글이 품질을 따로 재는 이유이기도 하고, 이 이야기는 뒤에서 다시 나옵니다.

장부는 하나가 아니었습니다. 재판 후반, 원고 측 전문가 Douglas Oard 교수는 Glue에 더 빠른 판이 있다고 증언했습니다. Instant Glue라는 이 시스템은 최신 결과 가운데 무엇이 검색어에 맞는지 가려내는 데 클릭과 검색 데이터를 씁니다. 최근 24시간의 로그만 보기 때문에 처리가 빨라서, 약 10분 단위로 갱신된다고 했습니다. 13개월을 기억하는 Navboost라는 느린 장부 옆에서, 방금 벌어진 일을 따라가는 빠른 장부가 함께 돌아가는 셈입니다.

검색어, 문서, 클릭 칸에 클릭 수를 바를 정 자로 적어 나가는 큰 장부와, 최근 24시간·약 10분마다 갱신이라고 적힌 작은 장부
Navboost를 거대한 장부에, 최근 24시간만 보는 Instant Glue를 작은 장부에 빗댔습니다. 장부 속 검색어와 숫자는 예시입니다.

10월 18일 오후, 부사장이 인정한 것과 아니라고 한 것

다시 10월 18일 오후로 돌아가겠습니다. 한 달 전 법무부가 부른 전직 엔지니어가 털어놓은 이야기를, 이번에는 구글이 부른 현직 부사장의 입으로 확인할 차례였습니다. Dintzer는 Navboost를 하나씩 확인해 나갔습니다.

Dintzer: "Navboost 시스템은 예전 검색어에서 일어난 클릭을 기억합니다. 맞습니까?"
Nayak: "네."
Dintzer: "사용자 데이터로 학습하죠?"
Nayak: "네, 그렇습니다."
Dintzer: "지난 13개월 동안 들어온 모든 검색어에 대해 이 정보를 기억합니까?"
Nayak: "맞습니다."
Dintzer: "2017년 이전에는 18개월 동안 들어온 모든 검색어에 대해 기억했고요?"
Nayak: "네."

Dintzer는 이어서 Navboost가 수많은 문서 가운데 후보를 200~300개로 추려 주느냐고 물었습니다. Nayak은 그렇게 단순하지 않다고 했습니다. 클릭이 없는 문서가 많을 수도 있어서 Navboost가 유일한 요소는 아니고, 주제 적합성 신호와 페이지랭크 신호, 지역 신호처럼 온갖 신호가 함께 들어간다는 것이었습니다. 다른 대목에서는 이렇게 말했습니다. "기억하세요, Navboost는 문서가 일단 검색된 다음에야 작동합니다."

장부에는 칸도 나뉘어 있었습니다. Navboost가 지역 정보를 나눠 담느냐는 질문에 Nayak은 그렇다고 답했고, 모바일과 데스크톱도 따로 나눈다고 했습니다. 모바일용 Navboost가 따로 있느냐는 물음에는 "나뉜 조각 가운데 하나"라고 했습니다. 같은 검색어라도 어느 지역에서 찾았는지, 휴대폰으로 찾았는지 컴퓨터로 찾았는지에 따라 다른 칸의 기록이 쓰일 수 있다는 뜻입니다.

한참 뒤, Dintzer가 RankBrain과 DeepRank 같은 딥러닝 모델의 학습 데이터를 묻던 중에 판사가 직접 끼어들었습니다.

판사: "몇 개월치 사용자 데이터라고 할 때, 그게 무슨 뜻입니까? 말 그대로 구글이 13개월 동안 모은 데이터 전부입니까, 아니면 다른 겁니까?"
Nayak: "그 기간에 일어난 검색과 클릭입니다."
판사: "모든 사용자의 것입니까?"
Nayak: "모든 사용자입니다. 미국 전용 모델이라면 미국 사용자처럼 일부만으로 학습할 수도 있지만, 전 세계 모델이라면 모든 사용자를 봅니다."

2년 뒤 구제 판결은 이 문답을, Navboost가 쓰는 13개월치 데이터가 무엇인지 설명하는 근거로 인용합니다. 전 세계 사람들이 13개월 동안 남긴 검색과 클릭이, Lehman이 말한 거대한 표를 채운다는 이야기입니다.

Dintzer가 주제를 바꾸겠다며 여기서 끊어도 좋겠다고 하자, 판사는 얼마나 더 남았느냐고 물었습니다. 한 시간쯤이며 줄여 보겠다는 답에 판사는 15분 동안 줄일 수 있는지 보자고 했습니다. 오후 3시 16분 재판이 다시 열리자 판사가 말했습니다. "신문에 Navboost를 적용하셨다니 반갑군요."

앞서 Dintzer 자신이 Navboost를 수많은 문서 가운데 후보를 200~300개로 추려 주는 장치처럼 물었던 것을 떠올리면, 판사의 말은 이렇게 읽힙니다. 한 시간 분량이던 질문을, Navboost가 문서를 추리듯 꼭 필요한 것만 골라 왔군요.

재직접신문에서 구글 변호인은 Navboost가 구글의 유일한 핵심 알고리즘이냐고 물었습니다. Nayak은 "절대 아닙니다"라고 답했습니다. 신호가 몇 개냐는 물음에는 백 개쯤 넘을 것이라고 하고는 순서를 풀어 설명했습니다. 문서를 찾아낼 때는 문서 자체, 곧 색인에 담긴 단어 목록이 아마 가장 중요하고, 그것으로 후보를 수만 개까지 줄인다는 것입니다. 그다음에는 주제 적합성을 따지는 정보검색 알고리즘, 페이지 품질, 결과의 신뢰도, 지역에 맞추는 장치 같은 여러 요소가 들어가고, Navboost도 그 안에 있다고 했습니다. 판사가 다시 물었습니다. Navboost는 중요도로 치면 상위 10퍼센트입니까, 25퍼센트입니까, 절반입니까? Nayak은 순위를 매기기는 어렵다면서 이렇게 정리했습니다. "Navboost는 중요합니다. 조금도 축소하고 싶지 않습니다. 하지만 제가 말씀드린 것들처럼 다른 중요한 신호도 많습니다. 그리고 이 가운데 일부는 끌 수조차 없습니다. 문서 색인을 끈다는 게 무슨 뜻인지 모르겠습니다. 어떤 면에서는 그게 가장 중요한 것, 페이지에 적힌 단어 같은 것이니까요. 그래서 그런 식으로 판단하기는 좀 어렵습니다. Navboost는 우리가 가진 중요한 신호 가운데 하나라고 말하겠습니다."

그가 설명한 순서는 SEO의 순서이기도 합니다. 먼저 페이지에 담긴 단어로 수만 개 후보 안에 들어야 하고, 클릭은 그다음 단계에서 품질이나 지역 같은 다른 신호와 함께 순위를 움직입니다. 애초에 크롤링과 색인을 거쳐 검색되지 않는 페이지는 클릭을 받을 기회조차 없습니다.

색인된 문서가 페이지의 단어로 후보 수만 개로 줄고, 주제 적합성, 페이지 품질, 신뢰도, 지역, Navboost를 거쳐 최종 순서가 되는 깔때기 도해
Nayak의 증언을 바탕으로 정리한 순위 결정의 흐름입니다.

Nayak은 그날 오전에 페이지 품질 이야기도 했습니다. 전체적으로 보면 페이지 품질은 클릭과 약간 반대로 움직인다고 했습니다. 페이지 품질을 조금 높이면 실사용자 실험 결과가 오히려 나빠 보인다는 것입니다. 그 이유 가운데 하나로는 낚시성 콘텐츠를 아래로 내려도 사람들이 여전히 그것을 찾아 누를 수 있다는 점을 들었습니다. 그래도 장기적으로는 페이지 품질이 좋은 일이라고 덧붙였습니다. 클릭과 거꾸로 움직이기도 하는 그 품질에 구글이 어떤 점수를 매기는지는, 뒷날 공개된 메모에서 드러납니다.

한 달 뒤, "당연히 씁니다"

재판이 막바지로 향하던 2023년 11월, 구글의 검색 담당 대외 창구인 Danny Sullivan은 X에 이런 취지의 글을 올렸습니다. 당연히 사용자 상호작용 신호를 쓰고, 그 내용은 '검색 작동 방식' 페이지에도 적혀 있다는 것이었습니다.

실제로 구글의 공식 페이지에는 이런 문장이 있습니다. 집계하고 익명화한 상호작용 데이터로 검색 결과가 검색어와 관련 있는지 평가하고, 그 데이터를 신호로 바꿔 머신러닝 시스템이 관련성을 더 잘 추정하도록 돕는다는 내용입니다. 레딧의 "지어낸 헛소리"와는 결이 꽤 다른 문장입니다.

독점 판결문에 옮겨 적힌 마법의 원천

재판은 2023년 9월 12일부터 11월 16일까지 9주 동안 배심원 없이 이어졌고, 2024년 5월 최종변론을 거쳐 8월 5일 판결이 나왔습니다. Amit Mehta 판사는 286쪽 판결문에 이렇게 썼습니다. "증인들의 증언과 증거를 신중히 검토한 끝에 법원은 다음과 같이 결론 내린다. 구글은 독점기업이며, 독점을 유지하기 위해 독점기업처럼 행동했다. 구글은 셔먼법 2조를 위반했다."

두꺼운 판결문 더미 옆에서 판사봉이 받침을 내려치는 일러스트
2024년 8월 5일, Amit Mehta 판사는 286쪽 판결문에서 구글을 독점기업으로 판단했습니다.

판결문은 숫자로 그 독점을 설명합니다. 2020년 미국 검색의 90% 가까이가 구글을 거쳤고, 모바일에서는 95%에 가까웠습니다. 구글은 2021년 한 해에만 기본 검색엔진 자리를 얻는 대가로 260억 달러가 넘는 돈을 치렀습니다.

판결문에는 Navboost도 등장합니다. 판사는 Navboost가 사용자 클릭 데이터를 기억해 검색어와 문서를 짝짓는 신호라고 적었습니다. 그리고 구글이 13개월 동안 얻는 사용자 데이터가 경쟁사 빙이 17년 넘게 모은 데이터와 맞먹는다고 했습니다. 대형 언어 모델을 쓰는 새 신호들도 Navboost를 대체하지 못했다고 적고, Navboost가 역사적으로 가장 강력한 순위 요소 가운데 하나로 남아 있다는 구글 내부 문서를 인용했습니다.

판사는 앞에서 본 2016년 발표 노트의 문장도 판결문에 옮겨 적었습니다. 긍정적인 반응이 오면 좋은 문서, 부정적이면 아마 나쁜 문서, 아주 단순하게 말해 이것이 구글이 부리는 마법의 원천이라는 문장입니다. 그리고 검색의 모든 단계에서 사용자 데이터가 품질을 직접 높이는 핵심 재료라고 썼습니다.

엔지니어 메모에 담긴 순위의 설계도

판결 뒤에는 구글에 어떤 조치를 내릴지 다투는 구제 절차가 이어졌습니다. 심리는 2025년 4월 22일부터 5월 9일까지 열렸습니다. 이 과정에서 구글 엔지니어와의 통화를 정리한 메모 두 건이 증거로 공개됐습니다. 그중 하나가 2025년 2월 18일 구글 엔지니어 HJ Kim과 한 통화 기록입니다. 통화에는 구글 사내 변호사와 구글을 대리한 로펌 변호사들, 구글 측 전문가 James Allan 교수, 컨설팅사 인력이 함께했습니다. 메모는 Kim이 Navboost 관련 특허를 여럿 가진 사람이라고 소개합니다.

메모에 따르면 구글 순위의 바탕에는 ABC로 불리는 세 가지 기본 신호가 있습니다. A는 앵커, 곧 한 페이지가 다른 페이지를 가리키는 링크입니다. B는 바디, 문서 안의 단어입니다. C는 클릭으로, 원래는 사용자가 링크를 눌러 들어간 페이지에 얼마나 머물다가 검색 결과로 돌아왔는지를 뜻했습니다. 지금의 정의는 공개본에서 가려져 있습니다. T*는 적어도 이 세 신호를 합친 점수로, 검색어와 문서가 얼마나 관련 있는지 매기는 기초 점수입니다. 링크와 거기 붙는 문구인 앵커 텍스트, 곧 백링크가 오래도록 SEO의 기본으로 꼽혀 온 것도 이 구조와 맞닿아 있습니다.

이 세 축은 메모보다 앞서 구글 안에 있던 생각입니다. Lehman의 보관 파일에서 나온 발표자료 '클릭의 일생'에도 같은 그림이 있습니다. 본문은 문서가 스스로 하는 말, 앵커는 웹이 그 문서에 대해 하는 말, 사용자 상호작용은 사용자가 그 문서에 대해 하는 말입니다. 다만 Lehman은 법정에서 이 자료를 자기가 만들지 않았다고 증언했습니다.

메모에서 가장 무게가 실린 것은 Q*(큐스타)입니다. Q*는 페이지 품질, 곧 신뢰할 만한가에 관한 점수로, 대체로 잘 바뀌지 않고 주로 검색어보다 사이트에 따라 매겨집니다. 경우에 따라 검색어가 영향을 주기도 한다는 단서도 붙어 있습니다. 메모는 이 점수가 엄청나게 중요하며 오늘날에도 매우 중요하다고 적었습니다.

Kim은 약 17년 전 페이지 품질팀을 만든 사람입니다. 콘텐츠 농장이 학생들에게 글 한 편에 50센트씩 주고 주제마다 수천 개씩 글을 찍어 내던 때였고, 구글은 이 문제로 큰 골치를 앓았습니다. 메모는 요즘도 사람들이 품질에 불만이 많고, AI가 이 문제를 더 키우고 있다고 적었습니다.

앞서 Nayak이 언급한 페이지랭크도 메모에 나옵니다. 믿을 만하다고 알려진 출처에서 얼마나 떨어져 있는지를 재는 신호로, 품질 점수의 재료로 들어갑니다. 메모에 따르면 RankBrain과 DeepRank 같은 대형 언어 모델 기반 신호를 빼면, 거의 모든 신호를 엔지니어가 데이터를 보며 직접 설계합니다. 무언가 고장 나면 어디를 고쳐야 하는지 알기 위해서입니다.

정리하면 T*는 검색어마다 새로 매겨지지만, Q*는 주로 사이트에 매겨져 잘 변하지 않습니다. 메모에 E-E-A-T라는 말은 없지만, 신뢰성과 권위를 이야기한다는 점에서 이 품질 개념과 겹쳐 보이는 대목입니다.

거대한 장부를 경쟁사에 열라는 판결

2025년 9월 2일 구제 판결이 나왔습니다. 구글에 크롬을 팔라는 요구는 받아들여지지 않았습니다. 대신 판사는 구글에 검색 색인과 사용자 상호작용 데이터 가운데 일부를 자격을 갖춘 경쟁사에 제공하라고 명령했습니다.

그 근거를 설명하는 대목에서 판사는 2년 전 비공개 법정에서 나온 말을 다시 꺼냈습니다. Navboost는 검색 결과에 대한 클릭과 검색 데이터를 모아 두는 기억 장치이고, "그냥 거대한 표"로 생각할 수 있다는 Lehman의 증언입니다. 판사는 공유 대상이 이 데이터로 만든 모델이나 신호가 아니라 밑바탕 데이터 자체라고 선을 그었습니다. 그리고 이 데이터를 구글이 가진 규모 우위의 핵심이라고 부르며, 13개월치 사용자 데이터가 빙이 17년 넘게 받은 데이터와 맞먹는다는 점을 다시 짚었습니다.

구제 명령은 2025년 12월 5일 최종 판결로 정리됐습니다. 구글은 2026년 1월 항소했고, 법무부와 주 정부들도 맞항소했습니다. 최종 판결은 2026년 2월 3일 효력이 생겼습니다. 2026년 5월 법원은 데이터 공유와 검색 결과 공급 조항을 멈춰 달라는 구글의 일부 집행정지 신청을 기각하면서, 나중에 다시 신청할 여지는 남겨 두었습니다. 7월에는 법무부가 항소법원에 구제 조치를 더 강하게 해 달라는 서면을 냈습니다. 이야기는 아직 끝나지 않았습니다.

그래서 클릭을 사면 순위가 오를까

클릭이 순위에 쓰인다면 클릭을 모아 순위를 올릴 수도 있을까요. 이 질문에 직접 부딪혀 본 사람이 있습니다. 2014년 4월 30일 오후 6시 3분(미국 태평양 시간), Moz 공동창업자 Rand Fishkin은 일주일 전에 쓴 자기 블로그 글이 한 검색어의 미국 구글 결과에서 7위에 있는 것을 확인했습니다. 그리고 트위터에 글을 올렸습니다. 몇 시간 동안 사람들이 호응했습니다. 그가 짐작하기로 175~250명이 움직였고, 그날 구글 검색을 거쳐 그 글에 들어온 방문은 228건이었습니다. 전날은 7건이었습니다. 오후 9시 1분, 그 글은 1위에 올라 있었습니다.

Fishkin 스스로도 이것만으로 구글이 검색과 클릭으로 순위를 매긴다고 단정할 수는 없다고 썼습니다. 새 링크 같은 다른 요인이 작용했을 수 있고, 효과가 아주 일시적일 수도 있다는 것이었습니다. 캐나다, 영국, 호주 같은 다른 나라 결과에서는 여전히 6~9위였습니다. 그는 검색과 클릭 대부분이 미국에서 나왔기 때문일 거라고 짐작했습니다. 9년 뒤 법정에서 Nayak은 Navboost가 클릭 기록을 지역별로 나눠 담는다고 인정했습니다.

오후 6시 3분 7위에서 오후 9시 1분 1위로 오른 순위 그래프와, 구글 검색 방문이 7건에서 228건으로 늘어난 막대그래프
Rand Fishkin이 공개한 2014년 4월 30일 실험 기록입니다. 두 측정 시점 사이의 순위 변화는 기록되지 않았습니다.

법무부가 공개한 또 다른 메모, 2025년 1월 Nayak과 나눈 통화 기록에는 머신러닝 모델 도입을 설명하는 대목에 이런 문장이 있습니다. 구글은 어떤 결과가 클릭될지만 맞히도록 순위를 짜는 방식을 피하는데, 클릭은 조작하기 쉽고 사용자 경험이 나아졌는지 가늠하는 잣대로도 믿기 어렵기 때문이라는 것입니다. 같은 메모는 Navboost를 검색어와 문서별 클릭 횟수를 담은 표라고도 설명합니다.

재판과는 별개로, 2024년 5월에는 구글 검색의 내부 API 문서가 유출돼 화제가 됐습니다. 문서는 2024년 3월 깃허브에 올라갔다가 5월에 내려갔습니다. SparkToro의 Rand Fishkin이 공개한 분석에 따르면, 문서에는 좋은 클릭, 나쁜 클릭, 가장 오래 머문 마지막 클릭 같은 항목이 Navboost와 연결돼 있었습니다. 그는 구글이 쿠키 기록과 로그인한 크롬 데이터, 패턴 감지로 조작된 클릭에 대응한다는 제보자의 주장도 전하면서, 이런 내용이 구글러들이 해 온 공개 발언과 정면으로 어긋난다고 썼습니다. iPullRank의 Mike King은 유출 문서에 Navboost라는 이름이 84번 나온다고 셌고, 한 신호가 다른 신호를 압도하지 못하게 누르는 스쿼싱이라는 장치에 주목했습니다. 다만 각 항목이 순위 계산에서 얼마나 무게를 갖는지는 알 수 없다고 선을 그었습니다. 구글은 맥락이 빠졌거나 오래됐거나 불완전한 정보로 검색을 섣불리 짐작하지 말라고 경고했습니다.

재판 기록에 남은 말들을 나란히 놓으면 같은 그림이 나옵니다. Lehman은 사람들이 품질 낮은 콘텐츠를 클릭하는 경향이 있어, 클릭에 너무 끌려가면 결과의 품질이 목표보다 떨어진다고 했습니다. Nayak은 품질을 조금 높이면 실사용자 실험 결과가 나빠 보여도 장기적으로는 좋은 일이라고 했습니다. 판결문은 구글의 클릭 데이터에 사용자가 검색 결과로 돌아오는지, 얼마나 빨리 돌아오는지까지 들어 있다고 적었습니다.

구글은 클릭을 세기만 하지 않습니다. 누른 사람이 얼마나 빨리 돌아왔는지, 그 페이지의 품질은 어떤지를 함께 봅니다. 클릭 수를 부풀려도 낚여서 들어온 사람이 곧장 되돌아간다면, 그 클릭이 도움이 되리라 기대하기는 어렵습니다. 2016년 발표 노트의 말처럼, 구글은 문서보다 사람을 봅니다.

SEO 담당자를 위한 교훈, 다시 검색하게 만들지 않는 콘텐츠

재판 기록이 보여 준 것을 한 문장으로 줄이면 이렇습니다. 구글은 사람들이 검색 결과에서 무엇을 누르는지, 누른 뒤 얼마나 빨리 돌아오는지, 그 사이트가 믿을 만한지를 함께 봅니다. 구글이 공개한 콘텐츠 가이드에도 같은 방향의 질문이 있습니다. 이 콘텐츠를 읽은 사람이 더 나은 정보를 얻으려고 다시 검색해야 한다고 느끼는가? 이 질문을 우리 사이트의 콘텐츠에 어떻게 적용할 수 있는지 여덟 가지로 정리했습니다.

1. 사람들이 검색하는 말로 씁니다

Nayak의 증언대로 후보를 추리는 첫 관문은 페이지에 담긴 단어입니다. 업계 용어나 사내에서 쓰는 이름만 쓰면 정작 고객이 검색하는 말과 어긋날 수 있습니다. 고객이 실제로 쓰는 표현을 제목과 본문에 담고, 페이지가 크롤링과 색인을 제대로 거치는지부터 확인합니다. 후보에 오르지 못한 페이지에는 클릭 신호가 쌓일 기회도 없습니다.

2. 제목이 한 약속을 첫 화면에서 지킵니다

검색 결과를 누른 사람이 가장 먼저 확인하는 것은 제목이 약속한 답이 여기 있느냐입니다. 서론이 길거나 답이 스크롤 한참 아래에 있으면 사람들은 곧장 돌아가 다른 결과를 누릅니다. 판결문에 따르면 그렇게 얼마나 빨리 돌아오는지도 구글의 클릭 데이터에 담깁니다. 핵심 답은 첫 화면에, 자세한 설명은 그 아래에 둡니다.

타이틀 태그와 메타 디스크립션도 같은 원칙입니다. 구글 가이드는 제목이 내용을 정확하게 요약하는지, 과장하거나 자극적이지 않은지를 스스로 점검하라고 합니다. 클릭을 짜내는 제목은 곧장 돌아가는 방문을 부를 뿐입니다.

3. 검색한 이유에 맞는 형식으로 답합니다

같은 주제라도 뜻을 찾는 사람, 방법을 찾는 사람, 업체를 비교하는 사람이 원하는 형태는 다릅니다. 정의를 찾는 사람에게 긴 체험기를, 방법을 찾는 사람에게 이론을 내밀면 다시 검색하게 됩니다. 글을 쓰기 전에 그 검색어로 지금 상위에 뜨는 결과가 어떤 형식인지 보고, 검색 의도에 맞춰 그보다 더 빨리 답에 닿는 구성을 고민합니다.

4. 다음 궁금증까지 한 페이지에서 풀어 줍니다

읽는 사람이 이어서 궁금해할 질문을 미리 떠올려 본문에서 풀거나, 내부 링크로 바로 이어지는 글을 걸어 둡니다. 다른 사이트로 답을 찾으러 돌아갈 이유를 줄이는 일입니다. 분량을 늘리라는 뜻은 아닙니다. 구글은 선호하는 글자 수가 없다고 분명히 밝혔습니다. 필요한 답이 빠짐없이 있는지가 기준입니다.

5. 사이트 전체의 신뢰를 쌓습니다

Q*는 주로 검색어보다 사이트에 따라 매겨지고 잘 바뀌지 않는 점수였습니다. 페이지 하나를 잘 만드는 것만큼, 사이트 전체의 평균을 끌어올리는 일이 중요하다는 뜻입니다. 구글 가이드의 점검 질문도 누가 썼는지 분명한지, 직접 경험에서 나온 전문성이 드러나는지, 다른 곳에 없는 정보나 분석이 있는지를 묻습니다. 작성자와 근거를 밝히고 직접 해 보고 알게 된 내용을 담는 것이 E-E-A-T를 콘텐츠로 옮기는 방법입니다.

오래되고 얇은 페이지가 많다면 새 글을 더 쌓기보다 고쳐 쓰거나 합치는 편이 사이트 전체에 도움이 될 수 있습니다. 검색으로 사람을 모으는 것 자체가 목적인 글은 구글 가이드가 경계하라고 짚는 첫 번째 신호이기도 합니다.

6. 휴대폰 화면에서 먼저 확인합니다

Navboost는 클릭 기록을 모바일과 데스크톱으로 나눠 담습니다. 휴대폰에서 글씨가 작거나 첫 화면이 광고와 팝업으로 가려져 있다면, 모바일 칸에는 곧장 돌아가는 기록이 쌓일 수 있습니다. 구글 가이드도 여러 측면에서 전반적으로 좋은 페이지 경험을 주는지 확인하라고 권합니다. 로딩 속도와 화면 흔들림을 재는 코어 웹 바이탈이 좋은 출발점입니다.

여기에 글쓴이의 개인적인 생각을 하나 보탭니다. 재판 기록이나 구글 문서에 나오는 이야기는 아니지만, 콘텐츠가 AI로 대충 찍어 낸 듯한 뻔한 디자인이면 사람들은 내용을 읽기도 전에 떠난다고 봅니다. 어디서 본 듯한 구성과 장식은 이 사이트가 직접 공들여 만들었다는 신호를 지웁니다. 첫 화면의 인상 역시 곧장 돌아가느냐를 가르는 요소입니다.

7. 바뀌는 정보는 제때 고칩니다

최근 24시간의 반응을 따라가는 Instant Glue 같은 장치가 따로 있다는 것은, 새 소식이 중요한 검색어에서는 최근 반응이 빠르게 반영된다는 뜻으로 읽힙니다. 가격, 법규, 제품 사양처럼 바뀌는 정보를 다루는 글은 바뀐 내용을 제때 반영하고, 언제 고쳤는지 밝혀 둡니다. 오래된 정보를 보고 곧장 돌아가는 방문을 줄이는 길입니다.

8. 클릭을 사지 말고, 데이터로 고칩니다

순위를 올려 준다는 클릭 조작 서비스는 권하지 않습니다. 구글은 클릭이 조작하기 쉽다는 걸 알고 있고, 클릭 기록은 지역과 기기별로 나뉘어 쌓입니다. 2014년 실험처럼 잠깐 움직이더라도 그 효과가 오래간다는 보장은 없습니다.

대신 구글 서치 콘솔의 실측 데이터로 고칠 곳을 찾습니다. 노출은 많은데 클릭이 적은 페이지는 제목과 설명이 검색한 사람의 기대와 맞는지 봅니다. 클릭은 들어오는데 방문자가 금방 떠나는 페이지는 분석 도구로 확인해, 본문이 제목의 약속을 지키는지 다시 읽어 봅니다. 결국 구글이 보는 것은 검색한 사람이 여기서 답을 찾았느냐입니다.

이 글의 장면 삽화는 기록을 바탕으로 다시 그린 그림이며, 인물의 모습은 실제와 다릅니다.

참고 자료

글쓴사람

  • 정재철

Loading
Loading
Loading
Loading