Humane AI Pin: красивая идея, которая пришла слишком рано
Полный перевод X Article о Humane AI Pin: экран без экрана, voice-first интерфейс, Laser Ink Display, Trust Light, облачный AI-пайплайн и причины провала продукта.
Оригинал опубликован shoty на X.
В ноябре 2024 года небольшой стартап выпустил устройство за $699, которое пыталось сделать то, на что почти никто раньше не решался.
Оно пыталось убить экран смартфона.
Не заменить телефон. Не конкурировать с ним функция за функцию. А убить саму идею, что стеклянный прямоугольник — единственный способ разговаривать с компьютером.
Устройство называлось AI Pin. Его создала компания Humane, основанная двумя бывшими ветеранами Apple — Имраном Чаудри и Бетани Бонджорно. Чаудри почти два десятилетия провёл в Apple и был одним из людей, помогавших формировать оригинальный интерфейс iPhone.
Поэтому, когда он решил, что интерфейс, который он помог построить, сам стал проблемой, люди обратили внимание.
К февралю 2025 года AI Pin был мёртв. HP купила программное обеспечение Humane, патенты и команду инженеров за $116 млн, а аппаратный бизнес полностью закрыли.
Это быстрый взлёт и падение. Но идеи внутри AI Pin интереснее его провала. Эта статья — о них: что Humane поняла правильно, что сломалось и что всё это говорит о том, куда на самом деле движутся компьютеры.
Почему смартфон может быть не финальной формой
Со смартфонами есть странная вещь.
Мы смотрим на них больше, чем почти на что-либо ещё в жизни. И при этом почти никто не говорит, что пользоваться телефоном приятно.
Это ощущается как компульсия. Как отвлечение. Телефон тянет взгляд вниз, а внимание — прочь из комнаты, в которой вы стоите.
БЮДЖЕТ ЧЕЛОВЕЧЕСКОГО ВНИМАНИЯ (в день)
┌─────────────────────────────┐
│ Сон ~33% │
│ Работа/учёба ~35% │
│ Экран телефона ~15–20% │
│ Всё остальное ~12–17% │
└─────────────────────────────┘
Смартфон победил, потому что был лучшим доступным контейнером для приложений. Сенсорный ввод, сетка иконок, экран, по которому можно нажимать, — в 2007 году эта модель имела смысл, когда альтернативой были физическая клавиатура и стилус.
Но телефон был спроектирован вокруг приложений, а приложения — вокруг внимания. Больше времени в приложении — больше выручки. Этот стимул никуда не исчез. Если что, он стал ещё сильнее.
Ставка основателей Humane была простой: если меняется базовый слой интеллекта вычислений — если AI-модели действительно могут понимать язык, намерение и контекст, — физическая форма устройства больше не обязана быть экраном.
Это может быть что-то, что вы почти не замечаете. Что отвечает — и уходит с дороги.
Вот в чём была ставка. Хорошо ли AI Pin её реализовал — отдельный вопрос. Но сама ставка не безумна.
Зачем Humane на самом деле построила Pin
Humane не пыталась построить телефон поменьше.
Основатели с самого начала говорили прямо: цель — проектировать вычисления в логике «AI-first», а не «app-first».
Устройство app-first предполагает, что вы знаете, что хотите сделать, и идёте искать нужную иконку. Открыть камеру, чтобы сделать фото. Открыть сообщения, чтобы написать кому-то. Открыть погоду, чтобы проверить дождь.
AI-first переворачивает это. Вы просто говорите, чего хотите. Устройство само понимает, какую возможность использовать.
APP-FIRST МОДЕЛЬ
Пользователь → Разблокировать телефон → Найти приложение → Открыть приложение → Сделать задачу
AI-FIRST МОДЕЛЬ (цель Humane)
Пользователь → Произнести намерение → Устройство интерпретирует → Задача выполняется
Это действительно другая философия дизайна, а не просто другая форма железа. Pin был физическим выражением ставки на то, что естественный язык может заменить сетку иконок как основной способ управлять компьютером.
На этой идее стоит задержаться: она лежит в основе многого из того, что сегодня происходит в AI-железе — от умных очков до голосовых ассистентов, встроенных в наушники. Humane просто пришла туда первой и выпустила это как самостоятельное носимое устройство, а не как дополнение к чему-то ещё.
Философия удаления экрана
В интервью до запуска Чаудри публично говорил о подходе, который называл «дизайном для доверия», и о снижении компульсивного экранного поведения.
Идея была не в том, что экраны — зло. А в том, что экран приглашает смотреть на него, скроллить и оставаться внутри. Как только вы помещаете экран в продукт, стимулы продукта начинают изгибаться в сторону удержания ваших глаз на этом экране.
Уберите экран — и вы уберёте эту гравитацию.
УСТРОЙСТВО С ЭКРАНОМ УСТРОЙСТВО БЕЗ ЭКРАНА
┌───────────────┐ ┌───────────────┐
│ Уведомление │ │ Уведомление │
│ ↓ │ │ ↓ │
│ Смотреть │ │ Услышать/ │
│ на экран │ │ почувствовать │
│ ↓ │ │ ↓ │
│ Засосало │ │ Ответил — всё │
│ (скролл, │ │ (нет петли │
│ новые apps) │ │ скролла) │
└───────────────┘ └───────────────┘
Ответ AI Pin состоял в том, чтобы сделать устройство ambient — фоновым. Прицепить к рубашке. Говорить с ним. Оно слушает, обрабатывает и отвечает вслух — или на несколько секунд проецирует что-то на ладонь, после чего взаимодействие заканчивается.
Никакой ленты. Никакого списка уведомлений для прокрутки. Никаких иконок приложений, конкурирующих за внимание.
Это действительно смелая дизайнерская позиция, и именно за неё AI Pin чаще всего хвалят задним числом — даже критики продукта. Проблема была не в философии. Проблема была в том, что для такой философии нужна почти идеальная реализация, а технологии 2024 года ещё не могли полностью её обеспечить.
AI-first computing простыми словами
Давайте замедлимся и разберём, что «AI-first» значит на техническом уровне: сказать легко, построить сложно.
Традиционный компьютер детерминирован. Вы нажимаете кнопку, и программа выполняет конкретную заранее написанную функцию. Нажали «камера» — открылась камера. Никакой неоднозначности.
AI-first устройство должно интерпретировать открытый человеческий язык и превращать его в действие. Это гораздо сложнее, потому что язык грязный, зависит от контекста и часто неясен даже другим людям.
ТРАДИЦИОННЫЕ ВЫЧИСЛЕНИЯ
Нажать иконку → Запускается фиксированная функция → Фиксированный результат
AI-FIRST ВЫЧИСЛЕНИЯ
Сказать что угодно → Модель интерпретирует смысл →
Модель решает, какую возможность вызвать →
Результат генерируется динамически
Чтобы это работало хорошо, три вещи должны быть надёжными:
- устройство должно точно слышать вас даже при фоновом шуме;
- AI должен правильно понимать, чего вы на самом деле хотите, а не только буквальные слова;
- ответ должен возвращаться достаточно быстро, чтобы система не казалась сломанной.
AI Pin полностью зависел от того, что эта цепочка будет гладко работать каждый раз, потому что у него не было экрана как запасного пути. Если экранное приложение вас неправильно поняло, вы видите ошибку и исправляете её визуально. На Pin, если AI ослышался или понял не то, вы могли узнать об этом только когда он вслух выдавал неправильный ответ.
Это главный технический риск, встроенный в AI-first железо, и большая часть причины, почему ранние обзоры Pin были смешанными. Идея была здоровой. Реализации нужны были AI-модели быстрее и надёжнее, чем существовали в 2024 году.
Голос как новый интерфейс
Если экрана нет, голос должен нести почти всю нагрузку взаимодействия. Это огромная дизайнерская ответственность для того, что раньше было лишь одной функцией среди многих.
Голосовой пайплайн Pin следовал довольно стандартной структуре для разговорных AI-устройств — похожей на умные колонки, но с обработкой на устройстве там, где возможно, и в облаке там, где необходимо.
ГОЛОС
↓
Распознавание речи
↓
Определение намерения
↓
LLM
↓
Ответ
↓
Аудиовывод
Вот момент озарения, на котором стоит остановиться: этот пайплайн на самом деле не новый. Alexa и Siri годами использовали его версии. Humane изменила другое: сделала голос единственным входом, а не одной опцией наряду с сенсорным экраном, кнопками и кнопкой Home.
Это одно решение полностью меняет дизайн-математику. Умная колонка может иногда ослышаться, потому что рядом всё равно есть экран или телефон. У AI Pin такой страховки для большинства взаимодействий не было.
Voice-first дизайн также означает, что устройство должно справляться с тем, чего экраны никогда не делали: решать, когда не отвечать и когда продолжать слушать остаток фразы. Правильно поймать этот момент — в speech tech это называется endpointing — одна из действительно сложных, негламурных инженерных задач любого голосового устройства.
Laser Ink Display
Самой визуально эффектной частью Pin была технология, которую Humane называла Laser Ink Display.
Вместо экрана в лицевую сторону Pin встроен небольшой маломощный лазерный проектор. Когда вам нужно что-то увидеть — номер телефона при наборе или меню опций — вы поднимаете ладонь перед устройством, и оно проецирует монохромный зелёный текст и простую графику на кожу.
Взаимодействие происходит жестами руки, которые Pin умеет распознавать: наклон ладони для прокрутки, щипок пальцами для выбора, движение руки ближе или дальше для зума.
Это действительно умная инженерия. Лазерный проектор потребляет гораздо меньше энергии, чем подсвеченный LCD или OLED-экран, а для такого маленького устройства с крошечной батареей это критически важно. И поскольку стеклянного экрана, в который можно залипнуть, нет, дисплей задуман для использования на несколько секунд — показал нужное и исчез.
Загвоздка, на которую постоянно указывали обзорщики: он плохо работал на улице или в ярких помещениях и требовал держать руку поднятой в непривычной, утомительной позе. Это по-настоящему изобретательное решение сложной проблемы, но сам физический акт использования — поднятая рука, ладонь к себе, правильный свет — в повседневной жизни так и не стал естественным.
Trust Light: приватность, которую можно увидеть
Носить на груди устройство с камерой и микрофоном — значит столкнуться с очевидным вопросом: как окружающие узнают, записывает ли оно?
Ответом Humane стал небольшой физический индикатор сверху Pin под названием Trust Light. Когда камера активна или что-то снимает, Trust Light загорается так, чтобы это видели люди рядом, а не только владелец.
СОСТОЯНИЕ КАМЕРЫ TRUST LIGHT
───────────── ───────────
Ожидание Выключен
Фото/видео Горит постоянно
Запись аудио Другое состояние индикатора
Это аппаратный сигнал приватности, а не программный переключатель, спрятанный в настройках. Разница важна. Программные индикаторы можно скрыть, они могут отключиться из-за бага, или им просто не поверит внешний наблюдатель, который не может проверить настройки вашего телефона.
Физический свет, жёстко связанный с состоянием сенсора, — гораздо более сильное обещание, потому что он не может лгать, если не лжёт само железо.
Это одна из тихо важных идей, которые принёс Pin. По мере появления новых носимых AI-устройств с всегда доступными камерами — а они уже появляются у нескольких компаний — вопрос «видят ли все вокруг, когда я записываю?» будет становиться только важнее. Trust Light был попыткой Humane ответить на него честно, и этот дизайн-паттерн стоит перенять другим производителям.
Камеры, микрофоны, сенсоры и мультимодальный AI
Полезность Pin зависела от того, воспринимает ли он мир, а не только слышит голосовые команды.
У него была камера для фото и видео, набор микрофонов для захвата голоса, акселерометр и гироскоп для жестов руки с Laser Ink Display, сенсор глубины и движения для отслеживания положения ладони и температурный датчик внутри корпуса.
┌────────────────────────┐
│ AI PIN │
│ │
│ Камера │◉│ Микрофоны │≈│
│ │
│ Motion │↻│ Depth/IR │◐│
└────────────────────────┘
│
▼
Объединённые данные сенсоров
│
▼
Отправка в мультимодальную AI-модель
│
▼
Понимание сцены + речи вместе
Эта комбинация называется мультимодальным AI — моделью, которая может принимать несколько типов входных данных одновременно, например изображение и устный вопрос, и рассуждать о них совместно.
Самый понятный пример пользы: вы могли направить камеру Pin на продукт и спросить «мне можно это есть?», а он использовал бы изображение и ваш вопрос, чтобы определить еду и дать информацию о питательности — такую функцию Humane публично демонстрировала.
Это действительно другая возможность по сравнению с телефонным приложением: не нужно разблокировать телефон, открывать нужное приложение, аккуратно кадрировать фото. Вы просто говорите, направив грудь на объект.
Компромисс в том, что вся эта мультимодальная обработка тяжёлая, и значительная её часть должна была происходить в облаке, а не на крошечном чипе внутри Pin. Отсюда следующий большой предел: как быстро можно вернуть ответ.
Сменная магнитная батарея
У маленьких носимых устройств есть батарейная проблема, которую почти невозможно решить одной химией: внутри просто мало физического пространства для ячеек.
Humane решила разделить батарею на две части. Меньшая батарея была внутри самого Pin, а второй, более крупный «Battery Booster», крепился магнитом с обратной стороны одежды, прижимаясь через ткань к базовой пластине.
СПЕРЕДИ (видно) СЗАДИ (под рубашкой)
┌───────────┐ магнит ┌───────────┐
│ AI PIN │◄───────►│ BOOSTER │
│ (маленькая│ через │ (большая │
│ батарея) │ ткань │ батарея) │
└───────────┘ └───────────┘
Идея была в том, что когда Booster разряжается, его можно заменить на свежий, не снимая Pin и ничего не прерывая — примерно как сменную батарею на профессиональной камере.
Это умная механическая инженерия: магниты достаточно сильные, чтобы держаться через ткань, но достаточно удобные, чтобы отсоединять одной рукой. На практике независимые тесты батареи после запуска показали, что суммарное время работы, даже с обеими ячейками, у многих пользователей при нормальном использовании не дотягивало до полного дня. Pin также мог заметно нагреваться при тяжёлых задачах. Эта комбинация — скромная автономность плюс устройство, которому иногда нужно дать остыть, — подрывала обещание «надел и забыл», на котором держалась вся концепция.
Как на самом деле работал облачный AI-процесс
Поскольку у Pin не было большого встроенного процессора для локального запуска крупных языковых моделей, большая часть его «мозга» жила в облаке.
Общая схема происходящего при запросе выглядела так:
ВЫ ГОВОРИТЕ
│
▼
Pin захватывает аудио (и кадр с камеры, если нужно)
│
▼
Данные уходят по cellular/Wi‑Fi на серверы Humane
│
▼
Облачный AI-пайплайн
speech-to-text → reasoning model → внешние сервисы
например карты, погода, поиск
│
▼
Генерируется ответ
│
▼
Ответ возвращается на Pin
│
▼
Произносится вслух или показывается через Laser Ink Display
Обратите внимание, сколько сетевых round trip’ов спрятано в этом потоке. Каждый добавляет задержку. Каждый зависит от живого соединения.
Pin использовал собственное встроенное подключение T-Mobile, а не пару с телефоном. Это было продуманное решение: Pin работал как независимое устройство, а не аксессуар. Но это также означало, что каждый запрос должен был пережить настоящий сетевой поход до серверной фермы и обратно до того, как вы получите ответ, без локального fallback для большинства задач.
Когда цепочка работала, это ощущалось почти как магия. Когда нет — слабый сигнал, сбой сервера, медленный ответ модели — экрана, который показал бы, что происходит, не было. Поэтому казалось, будто Pin вас игнорирует или ошибается. Эта неоднозначность, больше чем любая отдельная характеристика, сформировала значительную часть раннего раздражения пользователей.
В чём Pin был реально хорош в повседневности
После провала продукта легко помнить только недостатки. Но честно отметить и то, что AI Pin делал достаточно хорошо при правильных условиях.
Быстрые фактические вопросы без рук — пока руки заняты готовкой или вы что-то несёте — работали неплохо, примерно как вопрос умной колонке.
Отправить голосом текстовое сообщение на ходу, не доставая телефон, было действительно удобным сценарием, который чаще выделяли люди с позитивным опытом обзора устройства.
Перевод был одной из сильных демонстрационных функций: говорить на одном языке и получать перевод, произнесённый Pin на другом, полезно для простых разговоров в поездках.
Быстро сделать фото без социальной неловкости поднятого телефона — поскольку съёмка Pin более незаметна — тоже привлекало часть ранних пользователей.
ХОРОШО ПОДХОДИТ ДЛЯ PIN ЛУЧШЕ ПОДХОДИТ ДЛЯ ТЕЛЕФОНА
───────────────── ─────────────────────
Быстрые голосовые вопросы Скролл соцсетей
Hands-free сообщения Детальное редактирование фото
Простой перевод Сложные многошаговые приложения
Быстрые звонки Чтение длинных статей
Правая колонка — честная причина, почему Pin было трудно. Огромная доля того, что люди реально делают на телефонах — браузинг, сообщения с rich media, банковские приложения, навигация, рабочие инструменты — просто не имела эквивалента на screenless, app-less устройстве. Pin не пытался закрыть всё это и никогда не обещал полностью заменить телефон, но многие покупатели ожидали чего-то ближе к замене смартфона, чем продукт мог дать.
Почему продукт коммерчески не взлетел
AI Pin вышел по цене $699 плюс обязательная подписка $24 в месяц за сотовую связь и доступ к облачному AI. Это высокая цена для устройства, которое должно быть спутником телефона, а не его заменой.
Ранние обзоры крупных технологических изданий весной 2024 года были стабильно критичными: медленные ответы, перегрев при обычном использовании, ненадёжное управление жестами Laser Ink Display и батарея, которой не хватало на полный день.
Humane рассчитывала продать около 100 000 устройств, но сильно не дотянула — по сообщениям, продажи были около 10 000.
ЧТО ПОШЛО НЕ ТАК
(накладывающиеся, а не изолированные проблемы)
┌───────────────────────────────────────┐
│ Высокая цена + подписка │
│ + │
│ Задержка ответов из-за облака │
│ + │
│ Автономность ниже ожиданий │
│ + │
│ Нагрев устройства при использовании │
│ + │
│ Нет аналогов must-have приложений │
│ = │
│ Трудно оправдать как daily-carry │
└───────────────────────────────────────┘
Ни одна из этих проблем по отдельности, возможно, не утопила бы продукт. Только медленные ответы — простительно. Только высокая цена — ранние пользователи могли бы принять. Но вместе они означали, что ровно в моменты, когда Pin должен был доказать, что он лучше, чем достать телефон, он обычно не был быстрее и часто не был надёжнее.
Стартап привлёк примерно $230 млн с момента основания в 2018 году и в разные моменты, по слухам, оценивался почти в $1 млрд. Финальная цена покупки HP в $116 млн стала резким падением относительно пиковых оценок — ясный сигнал, насколько снизилась уверенность рынка к моменту закрытия сделки.
Что индустрия вынесла из истории Humane
Провал Pin на самом деле не был провалом видения. Это был провал тайминга относительно технологий, существовавших в 2024 году.
Несколько уроков видны особенно ясно, и уже заметно, как другие компании их усваивают.
Задержка убивает screenless-интерфейсы быстрее всего. Если у устройства нет экрана, чтобы показать прогресс или подтвердить понимание, каждый ответ должен ощущаться почти мгновенным — иначе пользователь почти сразу теряет доверие.
Облачная зависимость — хрупкий фундамент для основного устройства. Запуск основного интеллекта удалённо был логичным при ограничениях чипов 2024 года, но это означало, что сетевые условия напрямую определяли, кажется продукт магическим или сломанным.
Устройства-компаньоны нуждаются в телефоне как backup, а не как сопернике. Продукты, вышедшие после Pin, включая несколько умных очков, больше склоняются к связке с телефоном, а не к полной замене: телефон берёт на себя тяжёлую экосистему приложений, wearable — быстрые ambient-взаимодействия.
Ограничения батареи и тепла — всё ещё физика. Никакой умный industrial design полностью не отменяет факт, что маленькие устройства имеют маленькие батареи и мало места для отвода тепла.
ПОДХОД HUMANE НОВЫЙ ПОДХОД (после Humane)
Полностью без экрана Без экрана ИЛИ простой дисплей
Самостоятельная cellular Связка с телефоном для тяжёлых задач
Cloud-dependent AI Больше обработки на устройстве
Заменить телефон Расширить телефон
Пожалуй, самый ясный урок: амбиции сами по себе не дают скидку на базовые вещи. Обзорщики и ранние покупатели действительно были воодушевлены философией Pin. Но goodwill быстро испарился, когда повседневный опыт — ждать ответа, чувствовать нагрев, остаться без батареи к середине дня — не совпал с обещанием.
Почему AI-железо всё равно остаётся будущим
Легко прочитать крах AI Pin как доказательство, что screenless AI-wearables — тупик. Скорее всего, это неправильный вывод.
Базовый инсайт — что более сильные AI-модели в итоге меняют саму форму компьютерного интерфейса — никуда не исчез. Если что, модели стали заметно быстрее и дешевле в запуске с конца 2024 года, а это бьёт прямо по главной слабости Pin: задержке.
2024 2026 И ДАЛЬШЕ
┌─────────────┐ ┌─────────────┐
│ Только │ │ Больше │
│ облачные │ │ on-device │
│ AI-модели │ → │ AI-моделей │
│ медленнее, │ │ быстрее, │
│ зависят │ │ меньше │
│ от сети │ │ зависимости │
└─────────────┘ └─────────────┘
AI Pin доказал работоспособность нескольких реальных аппаратных идей, которые, вероятно, переживут компанию: аппаратный индикатор приватности, которому люди могут доверять; действительно маломощный проекционный дисплей; магнитный механизм сменной батареи; и voice-first модель взаимодействия, построенная без экрана как костыля.
HP купила Humane не ради самого Pin. Она купила программную платформу, портфель патентов и инженерную команду — именно чтобы встраивать AI-first мышление в собственные продукты дальше. Это сильный сигнал, что идеи считались ценными даже после коммерческого провала конкретного устройства.
Здесь виден более широкий паттерн, который снова и снова повторяется в истории железа. Первая версия по-настоящему нового интерфейса почти никогда не побеждает. Обычно она слишком ранняя, слишком дорогая или слишком ограничена доступными технологиями. Но она наносит карту территории для тех, кто придёт следующим.
Экраны не исчезли после Pin. Они не исчезнут и после следующего wearable AI-продукта. Но тезис, который Pin сформулировал, — что голос и ambient intelligence могут осмысленно заменить часть того, что делает экран, для некоторых задач и некоторых людей, — всё ещё жив, даже если конкретное устройство исчезло.
Pin провалился не потому, что screenless AI computing — плохая идея. Он провалился потому, что попытался собрать всё будущее в одном продукте, на железе и облачной инфраструктуре, которые ещё не были готовы нести такой вес.
Кто-то другой продолжит с того места, где Humane остановилась. Некоторые уже продолжают.