Zilmac Блог
← Назад к технической практике

Тест AI-агента iPhone 18 Pro: сможет ли Siri AI заменить ChatGPT и Gemini?

Экосистема Apple ·~16 мин чтения

Пользователь на iPhone с Siri AI и Apple Intelligence — сравнение мобильного агента с ChatGPT и Gemini
28 / 40
Сумма Siri AI (20 задач, по 0–2)
29 / 40
Контрольная сумма ChatGPT (GPT-6)
28 / 40
Контрольная сумма Gemini 3.8

Сначала вывод: на 9 сентября 2026 Siri AI не заменяет ни ChatGPT, ни Gemini. В «прочитать почту / сообщения / календарь / экран и довести дело в системных приложениях» он явно впереди; в длинном рассуждении, поиске с источниками, коде и открытом планировании — всё ещё позади. На 20 реальных задачах суммы почти вничью (28 / 29 / 28), но выигранные задачи вообще не пересекаются. Считать iPhone 18 Pro «телефоном, на котором крутится системный агент» — верно; считать его «заменой ChatGPT в кармане» — разочароваться.

Статья для трёх читателей: частных пользователей, которые решают, закладывать ли бюджет на стартовый iPhone 18 Pro; iOS-команд, которые вписывают Apple Intelligence в roadmap; и разработчиков, уже сидящих на ChatGPT / Gemini и зашедших из-за «Siri наконец можно пользоваться». Окно презентации и слухи о железе: специальный материал об осеннем событии Apple 2026; Siri AI на Mac: гайд по обновлению macOS 27 Golden Gate. По моделям: Gemini 3.8 Flash и GPT-6 Astra.

Три пункта до таблицы баллов
  • Siri AI — новое поколение Siri с WWDC26 (8 июня 2026), архитектура Apple Intelligence; у пользователя сейчас английская бета, не мировой GA.
  • Сегодня день презентации Apple «Surprise and Shine». Розничный iPhone 18 Pro ещё не отгружают. Мы тестировали программный стек, который iPhone 18 Pro будет предустанавливать: iOS 27 + Siri AI — не бенчмарк A20 Pro с распакованного розничного аппарата.
  • ChatGPT и Gemini в этом тесте — официальные приложения на том же iPhone, не десктопный веб и не голый API. Сравниваем «как этим пользуются в кармане», не лабораторный пик.

Сначала вывод: не заменит, но заберёт половину повседневных задач

Если вопрос один — «можно ли удалить ChatGPT», ответ нет. Если вопрос — «для ежедневных повторов на iPhone всё ещё нужно сначала открывать стороннее приложение», ответ становится часто уже нет.

Когда 20 задач разложили по типу провала, граница ясная:

  • Siri AI уверенно выигрывает: личный контекст, действия между приложениями, содержимое экрана, чувствительные локальные саммари. На этих 8 задачах — 15/16; у двух других вместе только 6/16.
  • ChatGPT / Gemini уверенно выигрывают: поиск с источниками, длинное планирование с ограничениями, гонки Swift, длинные диалоги, где сначала признать ошибку и потом сменить план. На этих 6 задачах у Siri только 5/12.
  • Все трое справляются, разрыв меньше 1 балла: переписать письмо, собрать заметки встречи, суммировать непрочитанное. Инструменты письма уже системная способность, не крепость одной модели.

Поэтому слово «заменить» неверное. Точнее: Siri AI — системный агент, ChatGPT / Gemini по-прежнему универсальные движки рассуждения. Если iPhone 18 Pro покупают из-за Neural Engine, памяти и локальных моделей на весь день — это тезис про железо; если из-за «больше не нужна подписка ChatGPT», этот тест такое суждение не поддерживает.

Какой стек «AI-агента iPhone 18 Pro» мы тестировали

iPhone 18 Pro в заголовке — это системный опыт AI-агента, который осенний флагман 2026 будет нести вперёд, а не то, что мы уже распаковали розничный аппарат. Информацию лучше держать в трёх слоях, чтобы слайды презентации не попали в акт приёмки:

Слой Состояние на 2026-09-09 Как это учтено здесь
Подтверждено (Apple) WWDC26 представила Siri AI и следующее поколение Apple Intelligence; открыты тесты iOS 27 для разработчиков; Siri AI у пользователя сначала как английская бета; в материковом Китае пока недоступно, в ЕС на старте нет Siri AI на iOS / iPadOS / watchOS. Порог устройств: iPhone 16 и новее, iPhone 15 Pro / Pro Max и др. (см. Apple Newsroom). Как базовая линия софта — всё входит в периметр теста.
Событие подтверждено, страница продукта нет Apple разослала приглашение на «Surprise and Shine» 9 сентября в 10:00 PT. Имя чипа, память и цена iPhone 18 Pro / Pro Max ещё не появились на продуктовых страницах apple.com. Не записывать A20 Pro, 12 ГБ памяти и прочие медиацифры как лабораторный результат.
СМИ Пресса в основном ждёт серию iPhone 18 Pro на сцене сегодня; розница примерно через 9–10 дней после презентации; обычный iPhone 18 могут сдвинуть на весну 2027. Только ориентир закупочного календаря, не в баллы.

Официальные способности Siri AI укладываются в пять фраз: видеть экран, искать по личным данным (сообщения / почта / фото и т. д.), выполнять системные действия между приложениями, отвечать знанием из сети, плюс отдельное приложение диалога Siri, чья история приватно синхронизируется через iCloud между устройствами. Инструменты письма и Visual Intelligence дальше расширяются в системные приложения. Часть генеративных способностей с дневным лимитом; поднять квоту — через iCloud+.

Это другая продуктовая форма, чем у ChatGPT и Gemini. Те двое — облачная универсальная модель + одно приложение; Siri AI — системные права + модель на устройстве + Private Cloud Compute + App Intents. Сравнивать суммы бессмысленно; сравнивать «какой класс задач кому» — смысл есть. Про слои оркестрации агентов: стек AI-агентов 2026.

Метод: тот же iPhone, те же 20 задач

Чтобы «полевой тест» можно было повторить, переменные зафиксированы. Всё, что несправедливо к одной стороне, написано в примечании к задаче — баллы задним числом не крутим.

  • Дата и место: 8–9 сентября 2026, та же лаборатория, тот же Wi‑Fi.
  • Устройство: iPhone с включённым Apple Intelligence, iOS 27, английская бета Siri AI (аппарат с возможностями Apple Intelligence). Язык и Siri — английский, чтобы «китайский ещё не GA» не записали как тупую модель.
  • Контрольные приложения: официальное приложение ChatGPT (диалоговая модель GPT-6, не десктопный API); официальное приложение Gemini (3.8, уровень мышления по умолчанию). Оба на платной ступени, экспериментальные переключатели вроде «действовать в сторонних приложениях от моего имени» выключены, чтобы несуществующее управление телефоном не легло им в баллы.
  • Один и тот же промпт: каждую задачу сначала голосом, при провале — тот же текст. Голос не вышел, текст вышел: 1 балл.
  • Оценка: 2 = с первого раза и результат можно сразу использовать; 1 = частично, нужен ещё один ручной шаг; 0 = отказ, галлюцинация ключевого факта или нужное приложение не вызывается.
  • Приватность: задача 20 использует имитацию медицинских саммари и PDF-счетов лабораторного аккаунта, без настоящих номеров документов.
Это не бенчмарк презентации и не SLA

Английская бета, региональные ограничения и дневные лимиты меняют опыт. Другой почтовый ящик, стороннее приложение без App Intent — и межприложенческие задачи сразу падают. Читайте таблицу как базовую линию маршрутизации и перепроверьте свои 10–20 частых задач, прежде чем решать по подпискам.

Сводная таблица из 20 задач

Ниже баллы за 20 реальных задач. Siri AI 28, ChatGPT 29, Gemini 28. Ничья не значит взаимозаменяемость — нули сидят ровно наоборот.

# Задача Siri AI ChatGPT Gemini
1Найти подтверждение рейса в Mail и записать в календарь211
2Найти в Сообщениях договорённость «ужин в четверг»200
3Суммировать непрочитанные письма и набросать 3 ответа222
4Найти фото доски за прошлый месяц и извлечь to-do212
5Опоздаю на 10 минут — написать человеку на 15:00200
6Извлечь срок из PDF-счёта и создать напоминание211
7Распознать товар на текущем экране и найти похожие212
8Перевести фото меню и рекомендовать с учётом аллергенов122
9Объяснить скриншот ошибки Xcode и дать следующий шаг122
10Распознать дорожный знак / растение и дополнить предостережениями212
11Сократить письмо в поддержку и сделать его разговорнее222
12Вычитать двуязычную оговорку договора (ZH/EN)121
13Превратить заметки совещания в action items222
14Сравнить Foundation Models и ChatGPT API122
15Объяснить новость дня с источниками122
16Трёхдневный маршрут с ограничениями (вегетарианство, без пересадок, бюджет)122
17Диагностировать гонку Swift concurrency и поправить код021
18Бронь + календарь + сообщение в чат100
19Длинная коррекция: сначала неверные ограничения, потом поправка122
20Локальное резюме здоровья / счетов — уходит ли с устройства200
Итого282928
Разработчик сравнивает результаты задач Siri AI, ChatGPT и Gemini между iPhone и Mac
Сравнение должно идти на том же iPhone и тех же промптах. На десктопном вебе баллы глубокого рассуждения ChatGPT / Gemini вырастут ещё — но это уже не «агент в кармане».

Личный контекст и действия между приложениями

Задачи 1–6 — домашнее поле Siri AI. Формула Apple с WWDC «personal context + systemwide app actions» в лаборатории не была слайдом демо.

Задачи 2 и 5 — водораздел. «Где именно ужин в четверг» живёт только в треде Сообщений; «человек на 15:00» требует сначала календарь, потом контакт, потом Сообщения. Siri AI оба раза сделал за один проход. ChatGPT и Gemini дают инструкцию «откройте Сообщения / Календарь», но не достают до реальных объектов системных контактов и календаря — это не тупая модель, это другая модель прав. После выключения экспериментальных переключателей «действовать в других приложениях» ноль — ожидаемый результат, не сюрприз.

Задачи 1 и 6 похожи: подтверждение рейса и PDF счёта лежат в Mail / Файлах. Siri AI находит вложение, вытаскивает время, пишет в календарь или напоминание. Двум сторонним приложениям сначала нужно бросить файл в диалог; уже внутри извлечение часто годное — поэтому 1 балл.

Задача 3: у всех 2. Саммари непрочитанного и черновики ответов модели письма уже умеют; плюс Siri AI — только отсутствие ручного шага «экспортировать письма».

Задача 4: Gemini догнал Siri. OCR и структурированные to-do с фото доски мультимодальной модели не мешают. ChatGPT нашёл фото (мы импортировали вручную), но колонку «к обсуждению» записал как уже решённое — минус до 1.

Восприятие экрана и Visual Intelligence

Задачи 7–10 меряют «на что вы сейчас смотрите». On-screen awareness Siri AI ярче всего на задаче 7: Safari стоит на карточке товара, прямой вопрос «есть ли похожее, но легче» — поиск идёт по свойствам текущей страницы, без предварительного скриншота. Gemini тоже взял 2 после того, как скриншот бросили в чат; ChatGPT предложил три верные по категории, слишком общие по модели — 1 балл.

Задача 8 наоборот. Фото меню + «аллергия на орехи, без кинзы» как визуальное рассуждение с ограничениями: ChatGPT и Gemini полнее — помечают рискованные блюда, дают замену и напоминают, что соусы тоже могут содержать орехи. Siri AI переводит точно, но рекомендует слишком осторожно и пропускает риск заправки к салату — 1 балл.

Задача 9 — для разработчиков. На скриншоте ошибки Swift Concurrency из Xcode Siri AI читает символы и имя файла, а на следующем шаге останавливается на «проверьте isolations» — верно, но неисполнимо. ChatGPT (GPT-6) сразу указывает границу actor и даёт вставляемый патч. Gemini 3.8 тоже даёт компилируемый патч, только короче объясняет. Если iOS-команда каждый день «читает ошибку», на телефоне всё равно стоит оставить приложение универсальной модели; настройка Agent в Xcode 27: гайд по AI-программированию в Xcode 27.

Задача 10 (знак / растение): Siri и Gemini оба стабильны. Visual Intelligence плюс локальный картографический контекст: Siri часто добавляет «эту улицу днём перекроют» — источник уже есть в системных картах, это не внезапная эрудиция.

Системные инструменты письма

Задачи 11–13 почти без интриги. Системная переписка, вычитка и саммари в Mail / Notes / Pages — все трое сдают работу. Плюс Siri AI: не уходить из текущего приложения; плюс ChatGPT / Gemini: контроль тона и двуязычное выравнивание.

Разрыв даёт задача 12. В двуязычной оговорке об ограничении ответственности (ZH/EN) ChatGPT показал, что английское «consequential damages» и китайское «间接损失» покрывают разный объём, и дал таблицу для юристов. Siri AI и Gemini сгладили текст и не поймали рассинхрон — по 1 баллу. Договоры, соглашения, политики безопасности — тексты, где одно неверное слово имеет последствия, по-прежнему универсальная модель + человек, не системная кнопка письма.

Открытые знания, новости и код

Задачи 14–17 — домашнее поле ChatGPT / Gemini и место, где тезис «Siri всё заменит» ломается быстрее всего.

Задача 14: «сравните Foundation Models API и ChatGPT API, только инференс на устройстве, перечислите три допущения, которые нельзя писать в закупочный договор». Siri AI повторяет тезисы WWDC, но смешивает «на устройстве» и «Private Cloud Compute» и не даёт проверяемых якорей в документации — 1 балл. ChatGPT и Gemini перечисляют длину контекста, поверхность инструментов, биллинг и границу приватности и сами пишут «ориентир — документация дня на developer.apple.com».

Задача 15 (техноновость дня + источники): Siri AI выходит в сеть, ответ читаемый, но цитаты часто обрываются на уровне домена; универсальные модели дают конкретные заголовки. Задача 16 (вегетарианство, без пересадок, дневной бюджет): Siri даёт читаемый каркас, но на третий день превращает «без пересадок» в промежуточную посадку. Универсальные модели сначала перечитывают ограничения, потом строят маршрут.

Задача 17 — единственный 0 у Siri AI. Пример Swift, который теряет обновления между изолированными actor: сначала корректно повторяет Sendable, затем предлагает устаревшую схему блокировок — патч не компилируется. ChatGPT чинит с первого раза; Gemini чинит гонку, но вводит лишний MainActor — 1 балл. Вывод жёсткий: код Siri AI не отдавать, даже если в руке iPhone 18 Pro.

Многошаговый агент: бронь, исправление, приватность

Задачи 18–20 отвечают, «это агент или только окно чата».

Задача 18 (бронь + календарь + групповой чат): полные 2 не взял никто. Siri AI дошёл до календаря и чата; бронь остановилась на «открыть приложение брони и заполнить число / время» — стороннее ресторанное приложение не отдаёт полный App Intent, система не может нажать подтверждение за вас. Типичная форма единицы: цепочка системных действий рвётся на сторонней странице подтверждения. ChatGPT / Gemini не достают даже до объектов календаря — 0.

Задача 19 меряет рабочую память. Сначала «бюджет 80 долларов, без музеев», через два круга — «бюджет 150, музей обязателен». ChatGPT и Gemini перестраивают план и отмечают изменение; Siri AI добавляет музей, но рестораны рекомендует всё ещё в лиге 80 долларов — 1 балл. Отдельное приложение диалога Siri умеет смотреть историю, но глобальная перепланировка после исправления ограничений слабее, чем у универсальных моделей.

Задача 20 — та, где Siri AI обязан взять 2, и взял. Медицинское саммари и PDF счетов лабораторного аккаунта структурируются на устройстве; в диалоге нет подсказки «загружаем в стороннюю модель». По приватной архитектуре Apple такие запросы должны оставаться на устройстве или в Private Cloud Compute. Те же файлы в ChatGPT / Gemini — это облачная отправка; по правилам теста 0 не потому, что саммари плохое, а потому что путь данных по умолчанию неприемлем. Медицина, финансы, неопубликованные договоры — это не балл за UX, это балл за соответствие.

Одной фразой

  • Siri AI: системный агент. Делает дела, знает ваш iPhone, не отправляет личные данные с устройства без нужды. Компилируемый Swift за вас не напишет и не должен быть единственным исследовательским движком.
  • ChatGPT (GPT-6): самое стабильное глубокое рассуждение и правка кода. Без системных контактов это не телефонный агент.
  • Gemini 3.8: самое ровное зрение и поиск. «Написать человеку на 15:00» тоже не умеет.

Может ли Siri AI заменить ChatGPT и Gemini?

Замена = «удалить одно из приложений и не потерять ключевую способность в быту»: ответ нет.

Маршрутизация = «для частых повторов на iPhone сначала спрашивать Siri AI»: ответ да, так и надо. Почта, сообщения, календарь, напоминания, разбор экрана, извлечение из локальных файлов — сначала система; исследование, код, длинное планирование с ограничениями, двуязычные юридические тексты — по-прежнему ChatGPT или Gemini.

Три частых промаха лучше сразу вычеркнуть:

  1. «Более сильный чип iPhone 18 Pro превратит Siri в ChatGPT.» Neural Engine и память влияют на ширину, задержку и офлайн локальной модели — сами по себе не закрывают открытый веб-поиск, экосистему инструментов и длинные кодовые агенты. Железо необходимо, но недостаточно.
  2. «Что умеет английская бета, китайский GA обязательно умеет.» Apple пишет: Siri AI сначала на английском, потом расширение языков; материковый Китай идёт через регуляторику. Считать 28 баллов английской беты обещанием китайского GA — сломать график.
  3. «Суммы близки, значит всё равно какое.» 28 и 29 близки, потому что сильные стороны гасят друг друга. Случайно выбрать один вход — подряд ловить нули в поиске по сообщениям или в коде.

Для разработчиков четвёртое: без серьёзных App Intent / App Shortcut Siri AI на вашем продукте остановится на единице из задачи 18 — система откроет вас, но не подтвердит за пользователя. Это не проблема модели, это слишком узкая поверхность намерений.

Маршрутизация: что оставить на iPhone, что на Mac

Не обязательно держать всех троих на максимальном тарифе. Дефолтный вход по типу задачи дешевле спора «кто сильнее».

Тип задачи Дефолт на iPhone Когда поднимать к ChatGPT / Gemini
Календарь, сообщения, почта, напоминания, локальные файлы Siri AI Длинная стратегия или сравнение нескольких вариантов
Разбор экрана, Visual Intelligence, перевод меню Siri AI, жёсткие ограничения — затем Gemini Аллергия / медицинские ограничения или сверка по нескольким фото
Переписка, саммари, протокол встречи Системные инструменты письма Договоры, политики, внешние юридические тексты
Поиск, новости, поездки, исследование Не только Siri Дефолт ChatGPT или Gemini и сверка источников
Писать код, читать crash, править concurrency Не Siri AI ChatGPT; или обратно в Xcode / Claude Code на Mac
Здоровье, счета, неопубликованные договоры Siri AI / на устройстве Только если вы явно принимаете облачную отправку

На компьютере не ждите, что iPhone 18 Pro перехватит работу. Xcode, подпись, TestFlight и длинные циклы агента по-прежнему требуют стабильный Mac. Если в окне презентации нет стартового железа — изолированный облачный Mac, чтобы прогнать SDK iOS 27 и вызовы Foundation Models, выгоднее очереди за розницей.

Три вещи, которые проверить разработчикам

В отличие от пользовательской маршрутизации, iOS-командам в окне iPhone 18 Pro стоит считать Siri AI новым системным входом, а не новой чат-моделью. На непродовом устройстве проверить только три вещи:

  1. App Intent покрывает ключевые действия. Создать, запросить, обновить, отменить должны находиться системой; без «подтвердить / оплатить» как необратимого шага пользователь останется на нашей единице из задачи 18.
  2. Содержимое экрана и запасной путь шаринга. Даже если пользователь не говорит с вашим приложением, Siri AI может задать вопрос по текущему экрану. Проверьте, не уходят ли чувствительные поля в системное саммари, и деградацию Visual Intelligence / листа «Поделиться».
  3. Пути отказа Foundation Models. Модель на устройстве режет длину, отказывает и падает, когда квота кончилась. «Siri умеет ответить» — не SLA приложения; при локальном сбое нужен облачный или человеческий запасной путь. Права, метки приватности и региональная доступность — до GA iOS 27.

Закупку железа не привязывайте к имени чипа, которого нет на странице продукта. Большинству бизнес-приложений хватит ранней обратной связи и стабильной Xcode; стартовый iPhone 18 Pro нужен, только если камера, большие локальные модели или доказательства day-one совместимости стоят в roadmap. По срокам одной модели см. материал про iPhone 18 Pro Max на сайте.

Частые вопросы

Может ли Siri AI уже заменить ChatGPT?

Нет. Суммы по 20 задачам близки, но код, поиск с источниками и длинное планирование с ограничениями по-прежнему за ChatGPT или Gemini. Siri AI заменяет системную работу вроде «открыть три приложения, чтобы ответить SMS об опоздании».

Нужен ли iPhone 18 Pro, чтобы пользоваться этими возможностями?

Нет. Apple пишет, что Apple Intelligence / Siri AI в iOS 27 поддерживает iPhone 16 и новее, а также iPhone 15 Pro / Pro Max и др. Прирост iPhone 18 Pro — железо (Neural Engine, память, энергоэффективность), не «Siri AI только на новом аппарате». Розничные спецификации — по странице продукта после презентации.

Когда такая же Siri AI появится в китайской среде?

Публичная линия Apple: Siri AI сначала как бета на английском для поддерживаемых устройств, затем расширение языков. Apple Intelligence уже покрывает набор языков, включая упрощённый / традиционный китайский, но Siri AI — это не все уже локализованные функции Apple Intelligence. Материковый Китай идёт через регуляторику; в ЕС на старте Siri AI на iOS нет. График: apple.com/apple-intelligence.

Вы тестировали на розничном iPhone 18 Pro?

Нет. 9 сентября 2026 — день презентации, розничные аппараты ещё не отгружают. Мы тестировали стек iOS 27 + Siri AI, который iPhone 18 Pro будет нести. Задержку чипа и цифры батареи — отдельным материалом про железо, когда появятся покупаемые устройства.

Агента маршрутизируйте на iPhone, сборку оставляйте Mac

Siri AI закрывает системные действия; SDK iOS 27, подпись и TestFlight по-прежнему нуждаются в стабильном узле Xcode. В окне презентации изолированный облачный Mac, чтобы прогнать сборки, надёжнее ожидания стартового железа.

Модель и машину принимайте отдельно. — Смотреть тарифы облачного Mac

Лимитированное предложение

Zilmac

Siri AI маршрутизирует системные действия; сборка, подпись и TestFlight iOS 27 по-прежнему нуждаются в стабильном облачном Mac.

На главную
Лимитированное предложение Смотреть планы