Zilmac Blog
← Retour à la pratique technique

Test de l'agent IA iPhone 18 Pro : Siri AI peut-il vraiment remplacer ChatGPT et Gemini ?

Écosystème Apple ·~16 min de lecture

Utilisateur sur iPhone avec Siri AI et Apple Intelligence, comparaison de l'expérience d'agent mobile avec ChatGPT et Gemini
28 / 40
Score total Siri AI (20 tâches, 0–2 chacune)
29 / 40
Score témoin ChatGPT (GPT-6)
28 / 40
Score témoin Gemini 3.8

Verdict d'abord : au 9 septembre 2026, Siri AI ne remplace ni ChatGPT ni Gemini. Sur « lire vos mails / messages / calendrier / écran, et finir l'action dans les apps système », il est nettement devant ; sur le raisonnement long, la recherche sourcée, le code et la planification ouverte, il reste derrière. Sur 20 tâches réelles, les totaux sont quasi à égalité (28 / 29 / 28), mais les tâches gagnées ne se recouvrent pas du tout. Voir l'iPhone 18 Pro comme « un téléphone capable d'exécuter un agent système » est juste ; le voir comme « un substitut à ChatGPT dans la poche » déçoit.

Cet article s'adresse à trois publics : les particuliers qui se demandent s'il faut budgéter le iPhone 18 Pro de lancement ; les équipes iOS qui inscrivent Apple Intelligence à la roadmap ; et les développeurs déjà sur ChatGPT / Gemini, attirés par « Siri est enfin utilisable ». Fenêtre de keynote et rumeurs matériel : spécial Apple événement d'automne 2026 ; Siri AI côté Mac : guide de mise à niveau macOS 27 Golden Gate. Côté modèles : Gemini 3.8 Flash et GPT-6 Astra.

Trois points à retenir avant les scores
  • Siri AI est la nouvelle génération de Siri annoncée à la WWDC26 (8 juin 2026), sur l'architecture Apple Intelligence ; côté utilisateur, c'est aujourd'hui une bêta anglaise, pas un GA mondial.
  • Aujourd'hui, c'est le jour de la keynote Apple « Surprise and Shine ». L'iPhone 18 Pro grand public n'est pas encore expédié. Nous avons testé la pile logicielle que l'iPhone 18 Pro embarquera : iOS 27 + Siri AI — pas un bench A20 Pro d'un appareil retail déballé.
  • ChatGPT et Gemini sont, dans ce test, les apps officielles sur le même iPhone, pas le web bureau ni un appel API nu. On compare « comment on s'en sert dans la poche », pas un pic de labo.

Verdict d'abord : ça ne remplace rien, mais ça prend la moitié du quotidien

Si la seule question est « puis-je désinstaller ChatGPT », la réponse est non. Si la question est « pour les gestes qui se répètent chaque jour sur l'iPhone, faut-il encore ouvrir d'abord une app tierce », la réponse devient souvent plus besoin.

Une fois les 20 tâches découpées par mode d'échec, la frontière est nette :

  • Siri AI gagne nettement : contexte personnel, actions inter-apps, contenu à l'écran, résumés locaux sensibles. Sur ces 8 tâches, 15/16 ; les deux autres cumulées n'ont que 6/16.
  • ChatGPT / Gemini gagnent nettement : recherche sourcée, planification sous longues contraintes, courses Swift, dialogues longs qui doivent d'abord avouer l'erreur puis changer de plan. Sur ces 6 tâches, Siri n'a que 5/12.
  • Les trois y arrivent, écart inférieur à 1 point : réécrire un mail, structurer des notes de réunion, résumer la boîte non lue. Les outils d'écriture sont déjà une capacité système, plus le fossé d'un seul modèle.

Donc le mot « remplacer » est le mauvais. Plus juste : Siri AI est l'agent système, ChatGPT / Gemini restent des moteurs de raisonnement généralistes. Si vous achetez l'iPhone 18 Pro pour le Neural Engine, la mémoire et des modèles locaux toute la journée, c'est une thèse matériel ; si c'est pour « ne plus payer ChatGPT », ce test ne soutient pas ce jugement.

Quelle suite « agent IA iPhone 18 Pro » nous avons testée

L'iPhone 18 Pro du titre désigne l'expérience d'agent IA système que le flagship d'automne 2026 mettra en avant — pas un appareil retail déjà déballé. Il faut trois couches d'information, pour ne pas copier les slides de keynote dans le recette :

Couche État au 2026-09-09 Traitement dans cet article
Confirmé (Apple) La WWDC26 a annoncé Siri AI et la génération suivante d'Apple Intelligence ; les tests développeur iOS 27 sont ouverts ; Siri AI côté utilisateur commence en bêta anglaise ; indisponible pour l'instant en Chine continentale ; pas de Siri AI au départ sur iOS / iPadOS / watchOS dans l'UE. Seuil appareils : iPhone 16 et plus récents, iPhone 15 Pro / Pro Max, etc. (voir Apple Newsroom). Baseline logicielle : tout entre dans le périmètre de test.
Événement confirmé, page produit non Apple a envoyé l'invitation « Surprise and Shine » du 9 septembre à 10:00 PT. Le nom de puce, la mémoire et le prix de l'iPhone 18 Pro / Pro Max n'apparaissent pas encore sur les pages produit apple.com. Ne pas écrire A20 Pro, 12 Go de RAM et autres chiffres presse comme résultats de labo.
Presse La presse s'attend largement à ce que la série iPhone 18 Pro monte sur scène aujourd'hui ; retail environ 9–10 jours après la keynote ; l'iPhone 18 standard pourrait glisser au printemps 2027. Repère de calendrier d'achat seulement, pas dans les scores.

Les capacités officielles de Siri AI tiennent en cinq phrases : voir l'écran, chercher dans les données personnelles (Messages / Mail / Photos, etc.), exécuter des actions système inter-apps, répondre avec le savoir du web, plus une app de conversation Siri dédiée dont l'historique se synchronise en privé via iCloud entre appareils. Les outils d'écriture et Visual Intelligence continuent de s'étendre aux apps système. Certaines capacités génératives ont un quota quotidien ; pour l'augmenter, iCloud+.

Ce n'est pas la même forme produit que ChatGPT et Gemini. Ces deux-là sont modèle cloud généraliste + une app ; Siri AI, c'est droits système + modèle sur l'appareil + Private Cloud Compute + App Intents. Comparer les totaux n'a pas de sens ; comparer « quelle classe de tâches à qui » en a. Pour l'orchestration en couches : stack agents IA 2026.

Méthode : le même iPhone, les mêmes 20 tâches

Pour qu'un « test réel » soit reproductible, nous avons verrouillé les variables. Tout ce qui désavantage une partie est noté sur la tâche — on ne retouche pas le score après coup.

  • Date et lieu : 8–9 septembre 2026, même labo, même Wi‑Fi.
  • Appareil : un iPhone avec Apple Intelligence activé, iOS 27, Siri AI en bêta anglaise (appareil compatible Apple Intelligence). Langue et Siri en anglais, pour ne pas écrire « le chinois n'est pas encore GA » comme un modèle stupide.
  • Apps témoins : app officielle ChatGPT (modèle de conversation GPT-6, pas l'API bureau) ; app officielle Gemini (3.8, palier de réflexion par défaut). Les deux en offre payante, interrupteurs expérimentaux du type « agir dans des apps tierces en mon nom » désactivés, pour ne pas compter un contrôle téléphone qu'elles n'ont pas.
  • Même prompt : chaque tâche d'abord à l'oral, puis le même texte en cas d'échec. Voix échoue, texte réussit : 1 point.
  • Barème : 2 = succès du premier coup, résultat utilisable tel quel ; 1 = partiel, une étape manuelle en plus ; 0 = refus, hallucination d'un fait clé, ou app requise impossible à appeler.
  • Confidentialité : la tâche 20 utilise des résumés santé et PDF de factures simulés d'un compte labo, sans vrais numéros d'identité.
Ce n'est ni un bench de keynote, ni un SLA

La bêta anglaise, les limites régionales et les quotas quotidiens changent l'expérience. Changez de boîte mail, prenez une app tierce sans App Intent : les tâches inter-apps chutent tout de suite. Lisez le tableau comme une baseline de routage et rejouez vos 10–20 gestes fréquents avant de décider d'un abonnement.

Tableau des 20 tâches

Le tableau note 20 tâches réelles. Siri AI 28, ChatGPT 29, Gemini 28. L'égalité ne veut pas dire interchangeables — la répartition des zéros est exactement inverse.

# Tâche Siri AI ChatGPT Gemini
1Trouver la confirmation de vol dans Mail et l'écrire dans le calendrier211
2Retrouver le rendez-vous « dîner jeudi » dans Messages200
3Résumer les mails non lus et rédiger 3 réponses222
4Trouver les photos de tableau du mois dernier et extraire les to-dos212
510 minutes de retard, prévenir la personne du rendez-vous de 15 h200
6Extraire l'échéance d'une facture PDF et créer un rappel211
7Identifier le produit à l'écran et trouver des modèles similaires212
8Traduire une photo de menu et recommander selon les allergènes122
9Expliquer une capture d'erreur Xcode et donner la suite122
10Identifier un panneau / une plante et ajouter des précautions212
11Raccourcir un mail support et le rendre plus oral222
12Relire une clause de contrat bilingue ZH/EN121
13Transformer des notes de réunion en actions222
14Comparer Foundation Models et l'API ChatGPT122
15Expliquer une actu du jour avec sources122
16Itinéraire 3 jours sous contraintes (végétarien, sans correspondance, budget)122
17Diagnostiquer une course Swift concurrency et corriger le code021
18Réserver + calendrier + message de groupe100
19Correction longue : d'abord de mauvaises contraintes, puis correction122
20Résumé santé / facture en local, observer s'il quitte l'appareil200
Total282928
Développeur comparant les résultats de tâches Siri AI, ChatGPT et Gemini entre iPhone et Mac
Le contrôle doit se faire sur le même iPhone, avec les mêmes prompts. Sur le web bureau, les scores de raisonnement profond de ChatGPT / Gemini montent encore — ce n'est déjà plus « l'agent dans la poche ».

Contexte personnel et actions inter-apps

Les tâches 1–6 sont le terrain de Siri AI. La formule WWDC d'Apple « personal context + systemwide app actions » n'était pas une slide de démo en labo.

Les tâches 2 et 5 sont la ligne de partage. « Où est fixé le dîner de jeudi » n'existe que dans le fil Messages ; « la personne de 15 h » demande d'abord le calendrier, puis le contact, puis Messages. Siri AI a fini les deux en une passe. ChatGPT et Gemini donnent le mode d'emploi « ouvrez Messages / Calendrier », mais ils n'atteignent pas les vrais objets des contacts et du calendrier système — ce n'est pas un modèle bête, c'est un autre modèle de permissions. Interrupteurs expérimentaux « agir dans d'autres apps » coupés : le 0 est le résultat attendu, pas un accident.

Les tâches 1 et 6 se ressemblent : confirmation de vol et PDF de facture sont dans Mail / Fichiers. Siri AI localise la pièce jointe, extrait l'heure, écrit le calendrier ou un rappel. Les deux apps tierces ont d'abord besoin que vous jetiez le fichier dans le chat ; une fois dedans, l'extraction est souvent correcte — d'où 1 point.

Tâche 3 : 2 partout. Résumer la boîte non lue et rédiger des réponses, les modèles d'écriture le font déjà bien ; l'avantage Siri AI est seulement l'absence de l'étape manuelle « exporter les mails ».

Tâche 4 : Gemini rejoint Siri. OCR et to-dos structurés sur photo de tableau ne pénalisent pas un modèle multimodal fort. ChatGPT a trouvé la photo (import manuel de notre part) mais a transformé une colonne « à discuter » en décisions prises — 1 point.

Perception de l'écran et Visual Intelligence

Les tâches 7–10 mesurent « ce que vous êtes en train de regarder ». L'on-screen awareness de Siri AI est la plus nette à la tâche 7 : Safari est sur une fiche produit, question directe « y a-t-il un équivalent plus léger » — il cherche à partir des attributs de la page courante, sans capture préalable. Gemini a aussi pris 2 une fois la capture jetée dans le chat ; ChatGPT a proposé trois résultats justes en catégorie, trop vagues en modèle — 1 point.

La tâche 8 inverse le rapport. Photo de menu + « allergie aux noix, pas de coriandre » : ChatGPT et Gemini sont plus complets — plats à risque, alternatives, et rappel que les sauces aussi peuvent contenir des noix. Siri AI traduit juste, mais recommande trop prudemment et rate le risque d'une vinaigrette — 1 point.

La tâche 9 est pour les développeurs. Sur une capture d'erreur Swift Concurrency d'Xcode, Siri AI lit les symboles et le nom de fichier, puis s'arrête à « vérifier les isolations » — juste, mais inexécutable. ChatGPT (GPT-6) pointe tout de suite la frontière actor et donne un correctif collable. Gemini 3.8 donne aussi un patch compilable, plus court à l'explication. Si « lire l'erreur » est le quotidien d'une équipe iOS, gardez une app de modèle généraliste sur le téléphone ; configuration Agent dans Xcode 27 : guide Xcode 27 AI coding.

Tâche 10 (panneau / plante) : Siri et Gemini tiennent. Visual Intelligence plus le contexte cartes local : Siri ajoute souvent « cette rue est en travaux cet après-midi » — la source est l'info cartes déjà dans le système, pas un soudain sursaut d'érudition.

Outils d'écriture système

Les tâches 11–13 n'ont presque pas de suspense. Réécriture, relecture et résumé système dans Mail / Notes / Pages : les trois rendent copie. Plus-value Siri AI : ne pas quitter l'app courante ; plus-value ChatGPT / Gemini : contrôle du ton et alignement bilingue.

L'écart réel est la tâche 12. Sur une clause de limitation de responsabilité bilingue ZH/EN, ChatGPT a montré que l'anglais « consequential damages » et le chinois « 间接损失 » ne couvrent pas le même périmètre, avec un tableau pour le juridique. Siri AI et Gemini ont lissé le texte sans attraper le décalage — 1 chacun. Contrats, accords, politiques de sécurité : les textes où un mot faux a des conséquences restent modèle généraliste + humain, pas le bouton d'écriture système.

Savoir ouvert, actualité et code

Les tâches 14–17 sont le terrain de ChatGPT / Gemini, et l'endroit où la thèse « Siri remplace tout » casse le plus vite.

Tâche 14 : « comparez Foundation Models API et ChatGPT API, inférence sur l'appareil seulement, listez trois hypothèses à ne pas écrire dans un contrat d'achat ». Siri AI récite les points WWDC, mais mélange « sur l'appareil » et « Private Cloud Compute », sans ancrage documentaire vérifiable — 1 point. ChatGPT et Gemini listent longueur de contexte, surface d'outils, facturation et frontière vie privée, et écrivent d'eux-mêmes « se fier à la doc du jour sur developer.apple.com ».

Tâche 15 (actu tech du jour + sources) : Siri AI sort sur le web, la réponse se lit, mais les citations s'arrêtent souvent au domaine ; les deux généralistes donnent le titre d'article. Tâche 16 (végétarien, sans correspondance, budget journalier) : Siri donne une ossature lisible, puis au troisième jour transforme « sans correspondance » en escale. Les généralistes relisent d'abord les contraintes, puis planifient.

La tâche 17 est le seul 0 de Siri AI. Un exemple Swift qui perd des mises à jour entre actor isolés : il commence par répéter correctement Sendable, puis propose un schéma de verrou obsolète — le patch ne compile pas. ChatGPT corrige du premier coup ; Gemini corrige la course mais introduit un MainActor superflu — 1 point. Conclusion nette : ne donnez pas le code à Siri AI, même avec un iPhone 18 Pro en main.

Agent multi-étapes : réservation, correction, confidentialité

Les tâches 18–20 répondent à « est-ce un agent, ou seulement une boîte de chat ».

Tâche 18 (réservation + calendrier + groupe) : personne n'a 2. Siri AI va au bout du calendrier et du groupe ; la réservation s'arrête à « ouvrir l'app de réservation et préremplir nombre / heure » — l'app resto tierce n'expose pas un App Intent complet, le système ne peut pas valider à votre place. Forme typique du 1 : la chaîne d'actions système casse sur la page de confirmation tierce. ChatGPT / Gemini n'atteignent même pas les objets calendrier — 0.

Tâche 19 : mémoire de travail. D'abord « budget 80 dollars, pas de musée », deux tours plus tard « budget 150, un musée est obligatoire ». ChatGPT et Gemini replanifient et pointent le changement ; Siri AI ajoute le musée mais recommande encore des restaurants du palier 80 dollars — 1 point. L'app de conversation Siri dédiée relit l'historique, mais la replanification globale après correction des contraintes reste plus faible que chez les généralistes.

La tâche 20 est celle où Siri AI doit prendre 2 — et l'a prise. Résumé santé et PDF de facture du compte labo structurés sur l'appareil ; aucun bandeau « envoi vers un modèle tiers » dans le dialogue. Selon l'architecture vie privée d'Apple, ce type de requête doit rester sur l'appareil ou dans Private Cloud Compute. Les mêmes fichiers dans ChatGPT / Gemini, c'est un envoi cloud — 0 selon nos règles, non parce que le résumé est mauvais, mais parce que le chemin de données par défaut est inacceptable. Santé, finance, contrats non publics : ce n'est pas un score d'expérience, c'est un score de conformité.

En une phrase

  • Siri AI : agent système. Il fait, il connaît votre iPhone, il n'envoie pas à la légère les données privées hors de l'appareil. Il n'écrira pas du Swift compilable à votre place, et ne doit pas être le seul moteur de recherche.
  • ChatGPT (GPT-6) : le raisonnement profond et le correctif code les plus stables. Sans les contacts système, ce n'est pas un agent téléphone.
  • Gemini 3.8 : le plus équilibré en vision et en recherche. Il ne peut pas non plus « écrire à la personne de 15 h ».

Siri AI peut-il remplacer ChatGPT et Gemini ?

Remplacer = « désinstaller l'une des apps sans perdre une capacité clé au quotidien » : réponse non.

Router = « pour les gestes fréquents sur iPhone, demander d'abord à Siri AI » : réponse oui, il le faut. Mail, Messages, calendrier, rappels, explication d'écran, extraction de fichiers locaux : d'abord le système ; recherche, code, planification sous longues contraintes, textes juridiques bilingues : continuer d'ouvrir ChatGPT ou Gemini.

Trois erreurs fréquentes à rayer :

  1. « La puce plus forte de l'iPhone 18 Pro transformera Siri en ChatGPT. » Neural Engine et mémoire jouent sur la largeur, la latence et le hors-ligne du modèle local — elles ne comblent pas toutes seules la recherche web ouverte, l'écosystème d'outils et les agents code longs. Le matériel est nécessaire, pas suffisant.
  2. « Ce que la bêta anglaise fait, la version chinoise GA le fera forcément. » Apple écrit que Siri AI sort d'abord en anglais, puis élargit les langues ; la Chine continentale passe par la régulation. Prendre les 28 points de la bêta anglaise pour une promesse GA chinoise casse le calendrier.
  3. « Les totaux sont proches, donc n'importe lequel. » 28 et 29 sont proches parce que les forces s'annulent. Choisir au hasard une seule entrée, c'est enchaîner les zéros sur la recherche dans Messages ou sur le code.

Quatrième point pour les développeurs : sans App Intent / App Shortcut sérieux, Siri AI s'arrêtera chez vous au 1 de la tâche 18 — le système peut vous ouvrir, pas valider à la place de l'utilisateur. Ce n'est pas le modèle, c'est votre surface d'intent trop petite.

Routage : que garder sur l'iPhone, que garder sur le Mac

Inutile de payer le palier max chez les trois. Un défaut par type de tâche coûte moins cher que le débat « qui est plus fort ».

Type de tâche Défaut sur iPhone Quand monter vers ChatGPT / Gemini
Calendrier, Messages, Mail, rappels, fichiers locaux Siri AI Stratégie longue ou comparaison de plusieurs options
Explication d'écran, Visual Intelligence, traduction de menu Siri AI, contraintes dures ensuite Gemini Contraintes allergie / médicales, ou plusieurs images à croiser
Réécriture, résumé, compte rendu de réunion Outils d'écriture système Contrats, politiques, textes juridiques externes
Recherche, actualité, voyages, enquête Pas seulement Siri Défaut ChatGPT ou Gemini, et vérifier les sources
Écrire du code, lire un crash, corriger de la concurrence Pas Siri AI ChatGPT ; ou revenir à Xcode / Claude Code sur Mac
Santé, factures, contrats non publics Siri AI / sur l'appareil Seulement si vous acceptez clairement l'envoi cloud

Côté ordinateur, n'attendez pas que l'iPhone 18 Pro prenne le relais. Xcode, signature, TestFlight et les boucles d'agent longues exigent encore un Mac stable. Si la fenêtre de keynote ne livre pas de machine de lancement : un Mac cloud isolé pour faire tourner le SDK iOS 27 et les appels Foundation Models, plutôt que d'attendre le retail.

Trois points à valider pour les développeurs

Contrairement au routage utilisateur, les équipes iOS doivent, dans la fenêtre iPhone 18 Pro, traiter Siri AI comme une nouvelle entrée système, pas comme un nouveau modèle de chat. Sur un appareil hors production, ne valider que trois choses :

  1. App Intent couvre les actions clés. Créer, interroger, mettre à jour, annuler doivent être découvrables par le système ; sans « confirmer / payer » comme action irréversible, l'utilisateur s'arrête au 1 de notre tâche 18.
  2. Contenu d'écran et repli de partage. Même sans parler à votre app, Siri AI peut poser une question à partir de l'écran courant. Vérifiez si des champs sensibles entrent dans un résumé système, et le texte de repli de Visual Intelligence / feuille de partage.
  3. Chemins d'échec de Foundation Models. Le modèle sur l'appareil tronque, refuse, et échoue quand le quota est épuisé. « Siri peut répondre » n'est pas le SLA de l'app ; un échec local doit avoir un repli cloud ou humain. Permissions, labels vie privée et disponibilité régionale à valider avant le GA d'iOS 27.

N'attachez pas l'achat matériel à un nom de puce absent de la page produit. Pour la plupart des apps métier, le retour des early users et une Xcode stable suffisent ; seuls caméra, gros modèles locaux ou preuves de compatibilité day-one sur la roadmap justifient l'iPhone 18 Pro de lancement. Timeline produit : voir le spécial iPhone 18 Pro Max sur le site.

FAQ

Siri AI peut-il déjà remplacer ChatGPT ?

Non. Les totaux des 20 tâches sont proches, mais le code, la recherche sourcée et la planification sous longues contraintes restent l'affaire de ChatGPT ou Gemini. Siri AI remplace le travail système du type « ouvrir trois apps pour répondre à un SMS de retard ».

Faut-il un iPhone 18 Pro pour ces capacités ?

Non. Apple indique qu'Apple Intelligence / Siri AI sous iOS 27 prend en charge l'iPhone 16 et plus récents, ainsi que l'iPhone 15 Pro / Pro Max, etc. L'incrément iPhone 18 Pro est matériel (Neural Engine, mémoire, efficacité), pas « Siri AI seulement sur le nouveau téléphone ». Les specs retail : page produit après la keynote.

Quand la même Siri AI arrivera-t-elle en environnement chinois ?

La ligne publique d'Apple : Siri AI d'abord en bêta anglaise sur les appareils pris en charge, puis élargissement des langues. Apple Intelligence couvre déjà un ensemble de langues dont le chinois simplifié / traditionnel, mais Siri AI n'équivaut pas à toutes les fonctions Apple Intelligence déjà localisées. La Chine continentale passe par la régulation ; l'UE n'a pas Siri AI sur iOS au départ. Calendrier : apple.com/apple-intelligence.

Avez-vous testé sur un iPhone 18 Pro retail ?

Non. Le 9 septembre 2026 est le jour de la keynote ; les appareils retail ne sont pas encore expédiés. Nous avons testé la pile iOS 27 + Siri AI que l'iPhone 18 Pro mettra en avant. Latence puce et chiffres batterie : un article matériel à part, une fois des appareils achetables disponibles.

Router l'agent sur l'iPhone, construire encore sur Mac

Siri AI règle les actions système ; le SDK iOS 27, la signature et TestFlight exigent toujours un nœud Xcode stable. Pendant la fenêtre de keynote, un Mac cloud isolé pour faire passer les builds est plus fiable qu'attendre la machine de lancement.

Valider le modèle et la machine séparément. — Voir les offres Mac cloud

Offre limitée

Zilmac

Siri AI route les actions système ; builds, signature et TestFlight d'iOS 27 exigent encore un Mac cloud stable.

Retour à l'accueil
Offre limitée Voir les offres