В двух словах
Archie — первая в мире программа, которая сама искала файлы по интернету вместо человека: в 1990 году аспирант Университета Макгилла в Монреале Алан Эмтидж написал скрипт, который обходил тысячи анонимных FTP-архивов по всему миру и складывал единый список того, что там лежит. До этого узнать, на каком из сотен серверов лежит нужный файл, можно было только вручную или по чужой наводке. В 1992 году Эмтидж и его начальник Питер Дойч превратили инструмент в одну из первых интернет-компаний — Bunyip Information Systems — и попытались брать с провайдеров деньги за лицензию. Через несколько лет пришёл веб, а с ним Google и AltaVista, и индексировать одни имена файлов на FTP стало незачем: Bunyip закрылась в 2003 году. Ни Эмтидж, ни Дойч не разбогатели — патентовать идею тогда никому не приходило в голову.
Как всё начиналось (основатели)
Алан Эмтидж родился в 1964 году на Барбадосе, в семье, где поощряли любопытство: тётя-учительница водила его слушать научные передачи BBC и исследовать бухту Карлайл. В 1981 году, во время поездки в Великобританию, он обзавёлся Sinclair ZX81 — первым компьютером. В 1983 году, выиграв стипендию Barbados Scholarship, поступил в Университет Макгилла в Монреале — сперва рассматривал метеорологию и геологию, но выбрал computer science как более надёжную карьеру в разгар рецессии 1983 года. Получив бакалавриат в 1987-м, он остался в магистратуре и параллельно устроился системным администратором в IT-отдел факультета — и именно там оказался в подчинении у Питера Дойча, который к тому моменту несколько лет выбивал у администрации McGill нормальное интернет-подключение (первая линия на Бостон стоила около $35 000 в год).
Работа Эмтиджа заключалась в том, чтобы вручную отслеживать полезный бесплатный софт на анонимных FTP-серверах по всему миру — сам Дойч в шутку называл его «резидентной крысой» отдела. В июне 1990 года Эмтидж, по собственному признанию, устал логиниться на каждый сервер вручную: «Rather than spending my time logging on to FTP sites... I wrote some computer scripts that would do the same thing, and much faster too». Программу назвали Archie — от «archive» без «v». Дойч, увидев внутренний инструмент, предложил сделать его публичным; реакция коллег: «Everybody was like, "Oh my God — of course! Why didn't we think of this?"». Третий соавтор, Билл Хилан, работал над первой реализацией вместе с Эмтиджем — но именно Дойч как начальник задним числом стал публичным лицом проекта и через два года — президентом компании.
Таймлайн по годам
- 1986 — Питер Дойч становится системным менеджером факультета Computer Science в McGill, начинает выбивать у администрации интернет-связность факт
- 1989 — Эмтидж получает от Дойча задачу отслеживать полезный софт на FTP-серверах вручную; сам Эмтидж позже датирует этим годом «замысел» Archie факт
- 1990-06 — Эмтидж пишет первые скрипты автоматического обхода FTP-архивов для собственного удобства факт
- 1990-09-10 — публичный релиз Archie на хосте archie.mcgill.ca; источник даты — Usenet-пост самого Дойча (comp.archives, 1990-09-11), вызвавший, по его словам, лавину запросов и public front-end факт
- 1992-01 — Эмтидж и Дойч основывают Bunyip Information Systems в Монреале. Журнал Caribbean Beat называет её «первым интернет-стартапом в истории», но UUNET основана раньше, в 1987 году (см. досье UUNET); часть источников (заметно позже событий) называет 1990 год, но первичное интервью Дойча 1993 года и институциональные биографии сходятся на январе 1992 оценка
- 1992-10 — выходит первая коммерческая версия Archie — полностью переписанный софт; лицензии продаются провайдерам-хостам, конечные пользователи в большинстве архи остаются с бесплатным доступом факт
- 1993 — Archie обрабатывает около 100 000 запросов в день на ~25 серверах по миру; в Bunyip работают шесть человек (пять на полной ставке, двое частично) факт
- 1994 — каталог покрывает «близко к 1 000» файловых архивов по всему миру; RFC 1635 об анонимном FTP выходит за соавторством Дойча и Эмтиджа факт
- 1996 — Эмтидж уходит из Bunyip из-за разногласий по поводу привлечения внешних инвестиций — Монреалю, по его словам, не хватало экосистемы Кремниевой долины факт
- сер. 1990-х — Archie вытесняется сначала Gopher-поисковиками (Veronica, Jughead), затем веб-поисковиками (AltaVista, Yahoo!); работа над софтом прекращается к концу десятилетия факт
- 2003 — Bunyip Information Systems официально распущена факт
- 2017 — Эмтидж — первый выходец с Барбадоса и из Карибского бассейна, принятый в Internet Hall of Fame факт
- 2023 → 2024-05-11 — легаси-сервер в Варшавском университете отключён; ретро-энтузиасты The Serial Port при содействии того же университета запускают новый публичный сервер archie.serialport.org, индексирующий около 30 000 файлов
Малоизвестные, но значимые факты
- Эмтидж работал не наравне с Дойчем, а у него в подчинении. Публичный образ «трое студентов-соавторов» упрощает реальную иерархию: Дойч был системным менеджером и начальником Эмтиджа, дал ему задачу как рутинную рабочую обязанность — а вовсе не пригласил в со-основатели с самого начала.
- Рост запустил один-единственный пост в Usenet. Archie задумывался как чисто внутренний инструмент; всё изменилось, когда о нём случайно упомянули в открытой рассылке — и хлынул поток запросов от посторонних людей, заставивший спешно прикрутить публичный front-end.
- Название компании «Bunyip» выбрано из ностальгии, а не маркетинга. Дойч наполовину австралиец; бунип — существо из мифологии аборигенов и герой детской книги, которую он читал в детстве. Название «просто застряло в голове».
- Нагрузку изначально спроектировали как федерацию, а не как один сервер на весь мир. Ещё в начале работы Archie-серверы в разных странах (Финляндия — через FUNET, Австралия — через AARNET) сами обходили только свой регион и обменивались готовыми копиями данных друг с другом — peer-репликация, а не наивный обход всей планеты каждым узлом.
- Создатели сами отвергли официальный международный стандарт каталогов X.500 как избыточно сложный и «политический», предпочтя строить собственный лёгкий протокол WHOIS++ через IETF — намеренная ставка на простоту против консенсусного тяжеловеса.
Легенда против документа
- Легенда: «Archie был первым поисковиком» — но что именно он искал? Формулировка верна, но коротка: Archie индексировал только ИМЕНА файлов на анонимных FTP-серверах — без полнотекстового поиска, пользователь обязан был примерно знать название файла. До Archie для этой задачи не было ничего сетевого масштаба — люди спрашивали в рассылках или перебирали архивы вручную. Вердикт: Первый автоматический интернет-индекс, но узкоспециализированный, а не поисковик в сегодняшнем смысле.
- Легенда: «Google сделал то же самое, что Archie». Сам Эмтидж формулирует связь гораздо осторожнее, чем звучит в пересказах: «Archie was the great great grandfather of Google» — то есть очень дальний предок по общей идее (автоматически собрать данные → сложить в индекс → дать простой запрос), а не «тот же метод в другом масштабе». Archie не делал полнотекстовый поиск и не ранжировал результаты по релевантности — этого не было и не могло быть при задаче «список имён файлов». Вердикт: общая идея автоматизации поиска — да, унаследована; сама технология и сложность задачи — нет, это качественно разные уровни.
- Легенда: «создатель первого поисковика разбогател». Документ говорит обратное: «At the time, nobody was making money off of the Internet, and we didn't patent any of the original ideas behind Archie... So the patents would have been where I would have made the money.» Поисковая индустрия сегодня стоит сотни миллиардов долларов в год — Эмтидж не получает из них ничего, но философски спокоен: «I wouldn't change anything». Вердикт: ни патента, ни доли, ни сожаления.
Первый рычаг роста
Рычагом роста стал не маркетинг и не запуск, а случайность: Archie задумывался как сугубо внутренний инструмент McGill, и Дойч признаёт это прямым текстом — «we mentioned it in a Usenet posting once, got flooded with postings with people asking us to do searches. So we stuck a frontend onto it, and that was sort of it». Один пост в открытой рассылке — и команда экстренно достраивала интерфейс под нахлынувший спрос. Тот же паттерн «один тред в сообществе запускает рост» сегодня встречается на Reddit — просто площадкой в 1990 году был Usenet.
Второй, менее очевидный рычаг — рост не обрушил инфраструктуру. Дойч подчёркивает: «we were actually very aware of this from the beginning», и команда с самого начала выстроила федеративную сеть зеркал — Финляндия (FUNET) и Австралия (AARNET) обходили только свой регион, а данные расходились между узлами копиями, не повторным обходом всего мира каждым сервером. Без этой предусмотрительности вирусный эффект от одного поста мог бы убить единственный сервер в Монреале, вместо мировой сети из ~25 узлов и ~100 000 запросов в день к 1993 году.
Пара для выпуска
Пара — WAIS. Archie и WAIS решали одну задачу 1990–1991 годов, найти что-то в интернете до появления веба, противоположными способами. Archie индексировал только ИМЕНА файлов на FTP-серверах, ничего не зная об их содержимом — механически похоже на каталог библиотеки без аннотаций. WAIS (Thinking Machines, 1991) искал по содержимому самих документов и с самого начала строился как партнёрство Thinking Machines, Apple, Dow Jones и KPMG Peat Marwick (см. досье WAIS). Коммерческие судьбы тоже разошлись: Bunyip продавала лицензии провайдерам и в 2003 году была распущена, а WAIS Inc. в 1995 году купила AOL за $15 млн акциями, и на эти деньги Брюстер Кейл построил Internet Archive (см. досье WAIS). Пара хорошо иллюстрирует развилку «искать по названию» против «искать по содержимому» — тот же выбор, что стоит перед любым современным индексатором чужого контента (см. параллели ниже).
Параллели сегодня (проекты из каталога)
- Awesome Indie (
awesome-indie) — та же механика «индекс чужого контента как продукт»: бесплатный курируемый список чужих запусков, ранжирование только апвоутами, а платно можно купить лишь удобную дату публикации. Как и у Bunyip, монетизация пристроена сбоку и не касается основной массы пользователей — большинство продолжает пользоваться бесплатно. Разница эпохи: у Awesome Indie рост тянет один канал (запуск на Product Hunt), у Archie — случайный пост в Usenet и федеративная архитектура, спроектированная заранее. — смотреть досье этого проекта → - AI Directories (
ai-directories) — прямая параллель модели Bunyip: бесплатный курируемый индекс (200+ AI-директорий) плюс платная надстройка «сделаем сабмит за вас» ($99–199 разово) — в точности то же расслоение «freely available, но не free», о котором говорил Дойч в 1993 году: открытый индекс остаётся бесплатным, платят только за конкретную дополнительную услугу поверх него. — смотреть досье этого проекта →
Чему это учит билдера в 2026
- Внутренний инструмент для собственной лени — законный источник продукта. Эмтидж не проектировал поисковик, он автоматизировал скучную рутину для себя — и именно поэтому решение оказалось простым и полезным сразу многим.
- Один пост в правильном месте может заменить весь маркетинг-план. Рост Archie начался не с запуска, а со случайного упоминания в Usenet — спрос уже существовал, нужен был только один публичный сигнал.
- Проектируй под нагрузку заранее, а не после первого падения сервера. Федеративная репликация по регионам была продумана с самого начала, а не добавлена в панике после первого наплыва трафика.
- «Бесплатно доступно» и «бесплатно» — разные вещи, и это нормально объяснить пользователям прямо. Дойч отказался извиняться за переход к лицензированию: «letting people starve is a crime», а брать разумную плату — нет.
- Первенство не гарантирует деньги — исполнение и время решают больше. Эмтидж признаёт: не патентовать было решением эпохи («nobody was making money off the Internet»), и не жалеет — это часть той же цепочки решений, что и сам факт изобретения.
Расхождения и что не удалось проверить
- Год основания Bunyip: 1990 vs 1992. Caribbean Beat называет 1990 год; первичное интервью самого Дойча 1993 года, Internet Hall of Fame и Wikipedia сходятся на январе 1992. Предпочтён более сильный и более близкий по времени первоисточник — 1992 год; расхождение зафиксировано, а не скрыто.
- Цифра «50% трафика на пике» — источник известен, само число не проверено. В EFF-гайде 1994 года её нет. Сноска Wikipedia ведёт на ретроспективную статью самого Дойча «Archie — a Darwinian development process» (IEEE, 2000) — источник первичный, но полный текст за пейволом, а доступный абстракт цифру не содержит, поэтому она остаётся [оценкой]. У TechSpot (2024) нашлась другая версия той же легенды — «половина трафика всей Канады», а не Монреаля — похоже на искажение при пересказе, не на независимое подтверждение.
- Текст оригинального Usenet-поста — автор и дата найдены, само сообщение нет. Пост локализован: Дойч, comp.archives, 1990-09-11 — на него ссылается Wikipedia как на источник даты релиза. Google Groups не отдал текст (429 дважды, JS-заглушка один раз), Wayback недоступен из этой среды.
- Судьба Питера Дойча после Bunyip. Карьера Эмтиджа задокументирована подробно (Mediapolis, Internet Hall of Fame), про Дойча — ни один источник; целевой поиск нашёл лишь причину, почему промо вёл Эмтидж — «у Дойча была семья».
- IEEE-статья Дойча (2000) — доступен только абстракт: проект возник в 1987 году как задача подключить McGill к интернету подешевле, поисковый инструмент не планировался. Это уже третья версия стартового года: Дойч в интервью 1993 года называл 1986-й, Эмтидж — 1989-й, здесь 1987-й. Дата написания скриптов (июнь 1990) при этом не меняется; это дрейф памяти о «начале», а не противоречие фактам. Полный текст за пейволом.
Источники (primary первыми)
Primary:
- Peter Deutsch — «Geek of the Week» интервью, Internet Talk Radio, 1993-06-26 — происхождение, архитектура нагрузки, философия монетизации
- «Life Before (And After) Archie», Internet Business Journal, 1993 — интервью с Deutsch, даты, масштаб, название Bunyip
- EFF's (Extended) Guide to the Internet — «Your Friend Archie», 1994 — масштаб на 1994 год, доступ к сервису
- Internet Hall of Fame — биография Alan Emtage — образование, IETF, Mediapolis
- RFC 1635 — Deutsch, Emtage, Marine, «How to Use Anonymous FTP», май 1994 — институциональный статус авторов
- Deutsch, P. «Archie — a Darwinian development process», IEEE Internet Computing, 2000 (только абстракт) — источник цифры «50% трафика»; полный текст за пейволом
Secondary:
- Wikipedia — Archie (search engine))
- Caribbean Beat — «Alan Emtage: The Codefather», issue 122, июль/август 2013, Georgia Popplewell
- HuffPost UK — «The Man Who Invented The World's First Search Engine (But Didn't Patent It)», 2013-01-04
- McGill News — «Search engine pioneer inducted into Internet Hall of Fame»
- TechSpot — «Archie, the first search engine, has been resurrected», 2024-05-17 — источник цифры «30 000 файлов»; версия про трафик расходится с Wikipedia (см. «Расхождения»)
- Wikipedia — Alan Emtage — точная дата рождения
- Global Voices — «The Codefather», 2013-10-27 — причина разделения ролей Эмтидж/Дойч