AI И НЕЙРОСЕТИ

Apple пытается запустить Gemini на iPhone, но без облака не выходит

Apple пытается ужать Gemini с триллионами параметров для iPhone, но новая Siri, вероятно, будет опираться и на облако Google с Nvidia.

✍️ Редакция iTech News | 29.05.2026 | ⏱ 5 мин | Источник: Ars Technica
Apple пытается запустить Gemini на iPhone, но без облака не выходит

Apple пытается собрать Siri с Gemini в корпусе iPhone, хотя исходная задача выглядит почти издевательской: речь идет о моделях класса Gemini с триллионами параметров, а не о компактных нейросетях для локальных подсказок. Для разработчиков и продуктовых команд это важный сигнал: даже компания, которая годами продавала идею приватного ИИ «на устройстве», похоже, упирается в старую физику смартфона — мало памяти, мало тепла, мало места для по-настоящему больших моделей.

По данным Ars Technica, Apple готовит гибридную архитектуру для будущей Siri: часть запросов будет обрабатываться на iPhone, а более тяжелые — уходить в облако. Основа этой истории — работа Apple над дистилляцией Gemini, то есть попыткой обучить уменьшенную модель повторять поведение большой серверной версии. Если коротко, компания хочет, чтобы Siri с Gemini выглядела умнее, чем нынешние локальные ассистенты, но при этом не убивала батарею, не зависала на каждом втором запросе и не превращала iPhone в раскаленный пауэрбанк.

Проблема в том, что маркетинг мобильного ИИ и реальная инженерия давно живут в разных комнатах. Производители смартфонов любят рассказывать про нейродвижки, AI-ускорители и чудеса локальных вычислений, и Apple не исключение: почти каждый новый чип получает отдельный блок презентации про Neural Engine. Но разговорный ассистент уровня Gemini — это не суммаризация уведомлений и не контекстная подсказка в интерфейсе. Для таких задач смартфону обычно хватает небольшой модели на несколько миллиардов параметров, часто еще и квантованной, то есть урезанной по точности ради скорости и экономии памяти. Для полноценного диалогового сценария этого мало: модель начинает чаще промахиваться, терять контекст и в целом вести себя как стажер в пятницу вечером.

У Google уже есть мобильная линейка Gemini Nano, но она заточена под локальные функции вроде кратких пересказов или контекстных фич, а не под универсального разговорного ассистента. На Android Google, по сути, даже не делает вид, что такой ассистент можно честно держать на телефоне: полноценный диалог с Gemini идет через облако. Для Apple это неприятный сюжет не только технически, но и идеологически. Компания много лет строила вокруг приватности и локальной обработки данных почти религиозный культ, а теперь вынуждена объяснять, почему Siri с Gemini все же будет смотреть в сторону удаленных серверов.

Контекст здесь тоже важен. Apple впервые пообещала обновленную ИИ-версию Siri в 2024 году, но затем переносила запуск несколько раз. Теперь, по информации из публикации, соглашение с Google должно привести к интеграции Gemini в Siri уже в 2026 году. На фоне приближающейся WWDC это выглядит как попытка наконец показать рабочую историю, а не еще один красивый слайд про «персональный интеллект». Вопрос только в том, насколько эта история будет действительно apple-подобной. Если ключевые запросы придется гонять в облако партнера, разговор о полном контроле над стеком становится заметно менее убедительным.

Отдельно интересно, что даже собственная облачная инфраструктура Apple, судя по публикации, не справилась с задачей в лоб. Речь идет о Private Cloud Compute — фирменной системе компании на базе чипов серии M, которую Apple показывала как более приватную альтернативу обычным AI-облакам. Однако The Information, на которую ссылается Ars Technica, утверждает, что Apple испытывала трудности с запуском крупных, не дистиллированных версий Gemini в этой среде. Это уже не просто вопрос оптимизации модели, а намек на то, что чужой передовой ИИ не так просто пересадить на собственную платформу, даже если у тебя свои чипы, свои дата-центры и очень хорошая презентация.

В результате вырисовывается схема, где сложные запросы Siri, вероятно, будут обрабатываться не в инфраструктуре Apple, а в облаке с участием Nvidia. По данным публикации, Apple заключила соглашение на использование платформы Nvidia Confidential Computing. Ее идея понятна и хорошо продается в пресс-релизах: данные остаются зашифрованными даже во время обработки на GPU. Для Apple это почти идеальный компромисс на бумаге. Можно сказать пользователю: да, запрос ушел в облако, но мы по-прежнему не махнули рукой на приватность. Для инженеров, впрочем, здесь важнее другой нюанс: полностью защищенные вычисления обычно добавляют накладные расходы, а значит, дополнительную задержку. И если Siri начнет заметно чаще задумываться перед ответом, пользователи быстро поймут, какой именно слой в этой «бесшовной» архитектуре сейчас работает.

Для российской IT-аудитории эта история полезна как холодный душ от завышенных ожиданий вокруг on-device AI. Если даже Apple не может безболезненно засунуть в телефон интеллект серверного класса, значит, и большинству продуктовых команд стоит трезвее оценивать, что именно можно запускать локально. Небольшие модели хороши для приватных и быстрых сценариев: классификация, подсказки, суммаризация, простые агенты в узком домене. Но как только бизнес хочет «умного универсального помощника», разговор почти неизбежно уходит в гибридную архитектуру, где часть логики живет на устройстве, а часть — в облаке. И это уже не про красивый лозунг, а про баланс между задержкой, стоимостью, безопасностью и качеством ответа.

Главный вопрос теперь не в том, сможет ли Apple встроить Gemini в Siri хоть в каком-то виде, а в том, сумеет ли она сделать это так, чтобы пользователь не заметил инженерных швов. Если новая Siri окажется заметно умнее, рынок простит ей походы в облако. Если же задержки вырастут, а приватность придется объяснять мелким шрифтом, вся конструкция начнет выглядеть не как триумф Apple Intelligence, а как признание того, что эпоха действительно больших моделей пока принадлежит не смартфонам, а дорогим удаленным кластерам.

Поделиться: Telegram X LinkedIn