Search Engine — Чтение на русском

Заголовки историй пока показаны по-английски; текст каждой истории — на русском.

Search Engine — обложка книги — Wonder Inventions В конце двадцатого века произошел взрыв информации, особенно с появлением Всемирной паутины. Изначально задуманный как мощная сеть для обмена научными работами…

В конце двадцатого века произошел взрыв информации, особенно с появлением Всемирной паутины. Изначально задуманный как мощная сеть для обмена научными работами, интернет быстро расширился в огромный, неизведанный цифровой ландшафт. Тем не менее, это безграничное хранилище знаний представляло собой глубокий парадокс: как можно было найти что-либо конкретное среди постоянно растущего океана данных? Это была монументальная задача, стоявшая перед ранними цифровыми пионерами. Доктор Винтон Серф, ключевой архитектор протоколов интернета, однажды размышлял об огромном потенциале ранней сети. «Будущее принадлежит тем, кто верит в красоту своих мечтаний», — как известно, сказала Элеонора Рузвельт. Мы мечтали о связанном мире, но быстро поняли, что мечта требует индекса, способа найти эту красоту среди огромного объема новой информации.

До появления сложных поисковых систем пользователи полагались на каталоги, курируемые людьми, такие как ранний каталог Yahoo!.

До появления сложных поисковых систем пользователи полагались на каталоги, курируемые людьми, такие как ранний каталог Yahoo!. Эти сервисы тщательно организовывали веб-сайты по категориям, очень похоже на традиционный библиотечный карточный каталог. Хотя это и предлагало некоторую структуру, такой ручной подход был по своей сути ограничен, с трудом поспевая за экспоненциальным ростом новых веб-страниц. Более того, базовые инструменты поиска по ключевым словам той эпохи просто сопоставляли слова, часто выдавая бесчисленные нерелевантные результаты, скрывая истинную ценность. Ранний веб-дизайнер, Элара Вэнс, работая за своим столом, выразила свое негодование. «Я помню, как часами вручную отправляла сайты в каталоги. Мы спорили с кураторами из-за категорий! Это было все равно что пытаться вручную организовать тропический лес. Каждый день вырастало десять новых деревьев, и мы просто не могли угнаться за обрезкой. Сети нужно было что-то гораздо более интеллектуальное, что-то, что могло бы видеть закономерности, которые мы не могли».

Фундаментальная проблема заключалась не просто в поиске веб-страниц, содержащих определенное слово; она заключалась в выявлении релевантных и авторитетных…

Фундаментальная проблема заключалась не просто в поиске веб-страниц, содержащих определенное слово; она заключалась в выявлении релевантных и авторитетных страниц. Поиск по запросу «болезни сердца» мог выдать тысячи результатов, от медицинских журналов до личных блогов и рекламных объявлений. Без механизма различения достоверности пользователи были вынуждены просеивать океан информации, часто не зная, каким источникам можно доверять. Эта «проблема качества» была критическим препятствием, которое не смогли преодолеть ранние механизмы веб-поиска. «Доктор Маркус Торн, разочарованный ученый, исследовавший онлайн-ресурсы, обсуждал эту проблему. «Нам отчаянно нужен был фильтр, индикатор качества. Огромный объем информации был ошеломляющим, но отсутствие проницательности парализовало. Как заметил римский философ Сенека, «Не потому, что вещи трудны, мы не смеем; а потому, что мы не смеем, они трудны». Трудность здесь заключалась в том, чтобы осмелиться изобрести систему, которая могла бы по-настоящему понимать ценность информации, а не просто ее присутствие».»

В Стэнфордском университете в середине тысяча девятьсот девяностых годов два докторанта, Ларри Пейдж и Сергей Брин, начали исследовать эту проблему.

В Стэнфордском университете в середине тысяча девятьсот девяностых годов два докторанта, Ларри Пейдж и Сергей Брин, начали исследовать эту проблему. Они поставили под сомнение общепринятую мудрость простого сопоставления по ключевым словам. Их радикальное озарение возникло из анализа моделей цитирования академических работ: важность работы часто определяется тем, сколько других значимых работ ссылаются на нее. Они предположили, что этот принцип может быть применен к веб-страницам, рассматривая гиперссылки как «цитаты» или «голоса». «Ларри Пейдж, молодой, стройный мужчина с короткими, аккуратно расчесанными светло-каштановыми волосами и сосредоточенным выражением лица, одетый в повседневную рубашку на пуговицах, повернулся к Сергею Брину, мужчине спортивного телосложения с темными, слегка вьющимися волосами, в очках и футболке. «Сергей, если «знание само по себе есть сила», как сказал Фрэнсис Бэкон, то связи между частями знания должны раскрывать его истинную мощь. Что, если мы будем не просто считать упоминания, а взвешивать их? Ссылка с сайта крупного университета должна значить больше, чем ссылка с личного блога, не так ли?»»

Пейдж и Брин назвали свою инновационную систему ранжирования «PageRank» в честь Ларри Пейджа. Её основной механизм был обманчиво прост, но при этом чрезвычайно…

Пейдж и Брин назвали свою инновационную систему ранжирования «PageRank» в честь Ларри Пейджа. Её основной механизм был обманчиво прост, но при этом чрезвычайно эффективен: важность веб-страницы определяется количеством и качеством страниц, ссылающихся на неё. Ссылка с высокоранжированной страницы придавала больше «авторитета», чем ссылка с низкоранжированной страницы. Это создало рекурсивную систему, в которой важность страницы постоянно пересчитывалась на основе важности входящих ссылок. «Ларри Пейдж указал на схему на их мониторе. «Думайте об этом как о демократической системе для веб-страниц. Каждая ссылка — это голос. Но, в отличие от простого подсчёта, вес вашего голоса зависит от вашего собственного влияния. Если The New York Times ссылается на страницу, это гораздо более сильное одобрение, чем ссылка с малоизвестного сайта по интересам. Мы называем это «передаваемым авторитетом»».»

Алгоритм PageRank функционирует как итеративное вычисление. Он начинается с присвоения начального, равного показателя PageRank каждой странице в интернете.

Алгоритм PageRank функционирует как итеративное вычисление. Он начинается с присвоения начального, равного показателя PageRank каждой странице в интернете. На последующих шагах этот показатель распределяется между страницами, на которые они ссылаются. Новый показатель страницы представляет собой сумму PageRank, которую она получает от входящих ссылок, пропорционально разделенную на количество исходящих ссылок с исходной страницы. Этот процесс повторяется, уточняя показатели до тех пор, пока они не сойдутся, создавая стабильную иерархию важности веб-страниц. Сергей Брин, держа ручку и указывая на сложное уравнение на доске, объяснял процесс группе первых инженеров. «Это, по сути, математический танец. Каждая итерация уточняет показатели. Представьте, что вы бросаете мяч по комнате; чем больше раз страница «ловит» мяч от важных игроков, тем выше её показатель. Красота заключается в его самокорректирующейся природе. Он находит свой собственный баланс авторитета. Речь шла не просто о поиске слов; речь шла о понимании взаимосвязей».

Проект BackRub, основанный на PageRank, оказался чрезвычайно эффективным в ранжировании веб-страниц. Признав его революционный потенциал, Пейдж и Брин…

Проект BackRub, основанный на PageRank, оказался чрезвычайно эффективным в ранжировании веб-страниц. Признав его революционный потенциал, Пейдж и Брин переключили свое внимание с академических исследований на создание компании. В сентябре тысяча девятьсот девяносто восьмого года была официально основана Google Inc. Их поисковая система, использующая PageRank, неизменно выдавала превосходные результаты по сравнению с существующими конкурентами, делая акцент на скорости, точности и удобстве использования. Итеративный алгоритм PageRank, хотя и требовательный к вычислительным ресурсам, был тщательно масштабирован для обработки растущего объема веб-страниц, навсегда изменив способ доступа к информации. Ларри Пейдж, стоя в их зарождающемся офисе Google, обратился к небольшой команде: «Это не просто лучшая поисковая система; это новый способ организации мировой информации. Мы создали движок; теперь мы должны создать инфраструктуру, чтобы сделать его доступным для всех. Задача огромна, но влияние будет глубоким. Мы не просто находим страницы; мы освещаем знания».

Публичный запуск Google кардинально изменил цифровой ландшафт. Его скорость, чистый интерфейс и, что самое важное, релевантность результатов поиска, быстро…

Публичный запуск Google кардинально изменил цифровой ландшафт. Его скорость, чистый интерфейс и, что самое важное, релевантность результатов поиска, быстро сделали его доминирующей поисковой системой. Пользователям больше не приходилось перемещаться по лабиринтным каталогам или сталкиваться с подавляющими, низкокачественными результатами. Алгоритм PageRank от Google предоставил надежный компас для обширной цифровой пустыни, позволяя людям быстро находить ответы, проводить исследования и подключаться к информации, как никогда раньше. Интернет, наконец, стал доступным для поиска. Доктор Елена Петрова, историк технологий, размышляла об этом поворотном моменте. «До Google интернет был библиотекой без каталога, или, возможно, книгой со всеми вырванными и разбросанными страницами. Внезапно у нас появился указатель, направляющая рука. Это было больше, чем технологическое достижение; это была демократизация информации, дар беспрецедентного доступа к человеческим знаниям. Это глубоко изменило наши отношения с данными».

Успех поисковой системы глубоко повлиял на мировую экономику. Она стала воротами, через которые предприятия достигали клиентов, трансформируя рекламу из…

Успех поисковой системы глубоко повлиял на мировую экономику. Она стала воротами, через которые предприятия достигали клиентов, трансформируя рекламу из традиционных медиа в целевые онлайн-кампании. Электронная коммерция процветала, поскольку потребители могли легко находить товары и услуги. Инновационная рекламная модель Google, AdWords, позволила предприятиям делать ставки на ключевые слова, согласовывая рекламу с намерениями пользователя и создавая многомиллиардную индустрию. Поисковые системы стали двигателем цифровой экономики, подпитывая инновации и связывая рынки по всему миру. Венчурный капиталист Роберт Чен, обсуждая влияние Google в интервью две тысячи четвертого года, заявил: «Мы видели в этом не просто инструмент; это был экономический двигатель. Способность так точно связывать спрос с предложением, движимая намерениями пользователя, выраженными через поисковые запросы, создала совершенно новые рынки. Экономист Джон Мейнард Кейнс однажды сказал: «Трудность заключается не в новых идеях, а в том, чтобы избавиться от старых». Google показал нам, как избавиться от старых бизнес-моделей и принять цифровую взаимосвязанную торговую площадку».

Сегодня поисковые системы незаменимы, они эволюционировали далеко за пределы простого текстового поиска, охватывая голосовые, графические запросы и даже запросы…

Сегодня поисковые системы незаменимы, они эволюционировали далеко за пределы простого текстового поиска, охватывая голосовые, графические запросы и даже запросы в дополненной реальности. Они демократизировали знания, обеспечили беспрецедентную связь и стимулировали бесчисленные инновации. Тем не менее, их влияние также поднимает сложные вопросы о привратниках информации, информационных пузырях и распространении дезинформации. Фундаментальная задача, которую решали Пейдж и Брин — организация мировой информации — продолжает развиваться, расширяя границы искусственного интеллекта и взаимодействия человека с компьютером. «Ведущий этик в области искусственного интеллекта, доктор Аня Шарма, завершила недавнюю панельную дискуссию. «Поисковая система дала нам карту, но теперь мы должны убедиться, что это карта к мудрости, а не просто к данным. Архитекторы раннего веба решили монументальную проблему, но следующий рубеж требует от нас решения проблемы ответственного, справедливого доступа к истине. Путь организации человеческих знаний далек от завершения»».