Verdict d'abord : au 9 septembre 2026, Siri AI ne remplace ni ChatGPT ni Gemini. Sur « lire vos mails / messages / calendrier / écran, et finir l'action dans les apps système », il est nettement devant ; sur le raisonnement long, la recherche sourcée, le code et la planification ouverte, il reste derrière. Sur 20 tâches réelles, les totaux sont quasi à égalité (28 / 29 / 28), mais les tâches gagnées ne se recouvrent pas du tout. Voir l'iPhone 18 Pro comme « un téléphone capable d'exécuter un agent système » est juste ; le voir comme « un substitut à ChatGPT dans la poche » déçoit.
Cet article s'adresse à trois publics : les particuliers qui se demandent s'il faut budgéter le iPhone 18 Pro de lancement ; les équipes iOS qui inscrivent Apple Intelligence à la roadmap ; et les développeurs déjà sur ChatGPT / Gemini, attirés par « Siri est enfin utilisable ». Fenêtre de keynote et rumeurs matériel : spécial Apple événement d'automne 2026 ; Siri AI côté Mac : guide de mise à niveau macOS 27 Golden Gate. Côté modèles : Gemini 3.8 Flash et GPT-6 Astra.
- Siri AI est la nouvelle génération de Siri annoncée à la WWDC26 (8 juin 2026), sur l'architecture Apple Intelligence ; côté utilisateur, c'est aujourd'hui une bêta anglaise, pas un GA mondial.
- Aujourd'hui, c'est le jour de la keynote Apple « Surprise and Shine ». L'iPhone 18 Pro grand public n'est pas encore expédié. Nous avons testé la pile logicielle que l'iPhone 18 Pro embarquera : iOS 27 + Siri AI — pas un bench A20 Pro d'un appareil retail déballé.
- ChatGPT et Gemini sont, dans ce test, les apps officielles sur le même iPhone, pas le web bureau ni un appel API nu. On compare « comment on s'en sert dans la poche », pas un pic de labo.
Verdict d'abord : ça ne remplace rien, mais ça prend la moitié du quotidien
Si la seule question est « puis-je désinstaller ChatGPT », la réponse est non. Si la question est « pour les gestes qui se répètent chaque jour sur l'iPhone, faut-il encore ouvrir d'abord une app tierce », la réponse devient souvent plus besoin.
Une fois les 20 tâches découpées par mode d'échec, la frontière est nette :
- Siri AI gagne nettement : contexte personnel, actions inter-apps, contenu à l'écran, résumés locaux sensibles. Sur ces 8 tâches, 15/16 ; les deux autres cumulées n'ont que 6/16.
- ChatGPT / Gemini gagnent nettement : recherche sourcée, planification sous longues contraintes, courses Swift, dialogues longs qui doivent d'abord avouer l'erreur puis changer de plan. Sur ces 6 tâches, Siri n'a que 5/12.
- Les trois y arrivent, écart inférieur à 1 point : réécrire un mail, structurer des notes de réunion, résumer la boîte non lue. Les outils d'écriture sont déjà une capacité système, plus le fossé d'un seul modèle.
Donc le mot « remplacer » est le mauvais. Plus juste : Siri AI est l'agent système, ChatGPT / Gemini restent des moteurs de raisonnement généralistes. Si vous achetez l'iPhone 18 Pro pour le Neural Engine, la mémoire et des modèles locaux toute la journée, c'est une thèse matériel ; si c'est pour « ne plus payer ChatGPT », ce test ne soutient pas ce jugement.
Quelle suite « agent IA iPhone 18 Pro » nous avons testée
L'iPhone 18 Pro du titre désigne l'expérience d'agent IA système que le flagship d'automne 2026 mettra en avant — pas un appareil retail déjà déballé. Il faut trois couches d'information, pour ne pas copier les slides de keynote dans le recette :
| Couche | État au 2026-09-09 | Traitement dans cet article |
|---|---|---|
| Confirmé (Apple) | La WWDC26 a annoncé Siri AI et la génération suivante d'Apple Intelligence ; les tests développeur iOS 27 sont ouverts ; Siri AI côté utilisateur commence en bêta anglaise ; indisponible pour l'instant en Chine continentale ; pas de Siri AI au départ sur iOS / iPadOS / watchOS dans l'UE. Seuil appareils : iPhone 16 et plus récents, iPhone 15 Pro / Pro Max, etc. (voir Apple Newsroom). | Baseline logicielle : tout entre dans le périmètre de test. |
| Événement confirmé, page produit non | Apple a envoyé l'invitation « Surprise and Shine » du 9 septembre à 10:00 PT. Le nom de puce, la mémoire et le prix de l'iPhone 18 Pro / Pro Max n'apparaissent pas encore sur les pages produit apple.com. | Ne pas écrire A20 Pro, 12 Go de RAM et autres chiffres presse comme résultats de labo. |
| Presse | La presse s'attend largement à ce que la série iPhone 18 Pro monte sur scène aujourd'hui ; retail environ 9–10 jours après la keynote ; l'iPhone 18 standard pourrait glisser au printemps 2027. | Repère de calendrier d'achat seulement, pas dans les scores. |
Les capacités officielles de Siri AI tiennent en cinq phrases : voir l'écran, chercher dans les données personnelles (Messages / Mail / Photos, etc.), exécuter des actions système inter-apps, répondre avec le savoir du web, plus une app de conversation Siri dédiée dont l'historique se synchronise en privé via iCloud entre appareils. Les outils d'écriture et Visual Intelligence continuent de s'étendre aux apps système. Certaines capacités génératives ont un quota quotidien ; pour l'augmenter, iCloud+.
Ce n'est pas la même forme produit que ChatGPT et Gemini. Ces deux-là sont modèle cloud généraliste + une app ; Siri AI, c'est droits système + modèle sur l'appareil + Private Cloud Compute + App Intents. Comparer les totaux n'a pas de sens ; comparer « quelle classe de tâches à qui » en a. Pour l'orchestration en couches : stack agents IA 2026.
Méthode : le même iPhone, les mêmes 20 tâches
Pour qu'un « test réel » soit reproductible, nous avons verrouillé les variables. Tout ce qui désavantage une partie est noté sur la tâche — on ne retouche pas le score après coup.
- Date et lieu : 8–9 septembre 2026, même labo, même Wi‑Fi.
- Appareil : un iPhone avec Apple Intelligence activé, iOS 27, Siri AI en bêta anglaise (appareil compatible Apple Intelligence). Langue et Siri en anglais, pour ne pas écrire « le chinois n'est pas encore GA » comme un modèle stupide.
- Apps témoins : app officielle ChatGPT (modèle de conversation GPT-6, pas l'API bureau) ; app officielle Gemini (3.8, palier de réflexion par défaut). Les deux en offre payante, interrupteurs expérimentaux du type « agir dans des apps tierces en mon nom » désactivés, pour ne pas compter un contrôle téléphone qu'elles n'ont pas.
- Même prompt : chaque tâche d'abord à l'oral, puis le même texte en cas d'échec. Voix échoue, texte réussit : 1 point.
- Barème : 2 = succès du premier coup, résultat utilisable tel quel ; 1 = partiel, une étape manuelle en plus ; 0 = refus, hallucination d'un fait clé, ou app requise impossible à appeler.
- Confidentialité : la tâche 20 utilise des résumés santé et PDF de factures simulés d'un compte labo, sans vrais numéros d'identité.
La bêta anglaise, les limites régionales et les quotas quotidiens changent l'expérience. Changez de boîte mail, prenez une app tierce sans App Intent : les tâches inter-apps chutent tout de suite. Lisez le tableau comme une baseline de routage et rejouez vos 10–20 gestes fréquents avant de décider d'un abonnement.
Tableau des 20 tâches
Le tableau note 20 tâches réelles. Siri AI 28, ChatGPT 29, Gemini 28. L'égalité ne veut pas dire interchangeables — la répartition des zéros est exactement inverse.
| # | Tâche | Siri AI | ChatGPT | Gemini |
|---|---|---|---|---|
| 1 | Trouver la confirmation de vol dans Mail et l'écrire dans le calendrier | 2 | 1 | 1 |
| 2 | Retrouver le rendez-vous « dîner jeudi » dans Messages | 2 | 0 | 0 |
| 3 | Résumer les mails non lus et rédiger 3 réponses | 2 | 2 | 2 |
| 4 | Trouver les photos de tableau du mois dernier et extraire les to-dos | 2 | 1 | 2 |
| 5 | 10 minutes de retard, prévenir la personne du rendez-vous de 15 h | 2 | 0 | 0 |
| 6 | Extraire l'échéance d'une facture PDF et créer un rappel | 2 | 1 | 1 |
| 7 | Identifier le produit à l'écran et trouver des modèles similaires | 2 | 1 | 2 |
| 8 | Traduire une photo de menu et recommander selon les allergènes | 1 | 2 | 2 |
| 9 | Expliquer une capture d'erreur Xcode et donner la suite | 1 | 2 | 2 |
| 10 | Identifier un panneau / une plante et ajouter des précautions | 2 | 1 | 2 |
| 11 | Raccourcir un mail support et le rendre plus oral | 2 | 2 | 2 |
| 12 | Relire une clause de contrat bilingue ZH/EN | 1 | 2 | 1 |
| 13 | Transformer des notes de réunion en actions | 2 | 2 | 2 |
| 14 | Comparer Foundation Models et l'API ChatGPT | 1 | 2 | 2 |
| 15 | Expliquer une actu du jour avec sources | 1 | 2 | 2 |
| 16 | Itinéraire 3 jours sous contraintes (végétarien, sans correspondance, budget) | 1 | 2 | 2 |
| 17 | Diagnostiquer une course Swift concurrency et corriger le code | 0 | 2 | 1 |
| 18 | Réserver + calendrier + message de groupe | 1 | 0 | 0 |
| 19 | Correction longue : d'abord de mauvaises contraintes, puis correction | 1 | 2 | 2 |
| 20 | Résumé santé / facture en local, observer s'il quitte l'appareil | 2 | 0 | 0 |
| Total | 28 | 29 | 28 |
Contexte personnel et actions inter-apps
Les tâches 1–6 sont le terrain de Siri AI. La formule WWDC d'Apple « personal context + systemwide app actions » n'était pas une slide de démo en labo.
Les tâches 2 et 5 sont la ligne de partage. « Où est fixé le dîner de jeudi » n'existe que dans le fil Messages ; « la personne de 15 h » demande d'abord le calendrier, puis le contact, puis Messages. Siri AI a fini les deux en une passe. ChatGPT et Gemini donnent le mode d'emploi « ouvrez Messages / Calendrier », mais ils n'atteignent pas les vrais objets des contacts et du calendrier système — ce n'est pas un modèle bête, c'est un autre modèle de permissions. Interrupteurs expérimentaux « agir dans d'autres apps » coupés : le 0 est le résultat attendu, pas un accident.
Les tâches 1 et 6 se ressemblent : confirmation de vol et PDF de facture sont dans Mail / Fichiers. Siri AI localise la pièce jointe, extrait l'heure, écrit le calendrier ou un rappel. Les deux apps tierces ont d'abord besoin que vous jetiez le fichier dans le chat ; une fois dedans, l'extraction est souvent correcte — d'où 1 point.
Tâche 3 : 2 partout. Résumer la boîte non lue et rédiger des réponses, les modèles d'écriture le font déjà bien ; l'avantage Siri AI est seulement l'absence de l'étape manuelle « exporter les mails ».
Tâche 4 : Gemini rejoint Siri. OCR et to-dos structurés sur photo de tableau ne pénalisent pas un modèle multimodal fort. ChatGPT a trouvé la photo (import manuel de notre part) mais a transformé une colonne « à discuter » en décisions prises — 1 point.
Perception de l'écran et Visual Intelligence
Les tâches 7–10 mesurent « ce que vous êtes en train de regarder ». L'on-screen awareness de Siri AI est la plus nette à la tâche 7 : Safari est sur une fiche produit, question directe « y a-t-il un équivalent plus léger » — il cherche à partir des attributs de la page courante, sans capture préalable. Gemini a aussi pris 2 une fois la capture jetée dans le chat ; ChatGPT a proposé trois résultats justes en catégorie, trop vagues en modèle — 1 point.
La tâche 8 inverse le rapport. Photo de menu + « allergie aux noix, pas de coriandre » : ChatGPT et Gemini sont plus complets — plats à risque, alternatives, et rappel que les sauces aussi peuvent contenir des noix. Siri AI traduit juste, mais recommande trop prudemment et rate le risque d'une vinaigrette — 1 point.
La tâche 9 est pour les développeurs. Sur une capture d'erreur Swift Concurrency d'Xcode, Siri AI lit les symboles et le nom de fichier, puis s'arrête à « vérifier les isolations » — juste, mais inexécutable. ChatGPT (GPT-6) pointe tout de suite la frontière actor et donne un correctif collable. Gemini 3.8 donne aussi un patch compilable, plus court à l'explication. Si « lire l'erreur » est le quotidien d'une équipe iOS, gardez une app de modèle généraliste sur le téléphone ; configuration Agent dans Xcode 27 : guide Xcode 27 AI coding.
Tâche 10 (panneau / plante) : Siri et Gemini tiennent. Visual Intelligence plus le contexte cartes local : Siri ajoute souvent « cette rue est en travaux cet après-midi » — la source est l'info cartes déjà dans le système, pas un soudain sursaut d'érudition.
Outils d'écriture système
Les tâches 11–13 n'ont presque pas de suspense. Réécriture, relecture et résumé système dans Mail / Notes / Pages : les trois rendent copie. Plus-value Siri AI : ne pas quitter l'app courante ; plus-value ChatGPT / Gemini : contrôle du ton et alignement bilingue.
L'écart réel est la tâche 12. Sur une clause de limitation de responsabilité bilingue ZH/EN, ChatGPT a montré que l'anglais « consequential damages » et le chinois « 间接损失 » ne couvrent pas le même périmètre, avec un tableau pour le juridique. Siri AI et Gemini ont lissé le texte sans attraper le décalage — 1 chacun. Contrats, accords, politiques de sécurité : les textes où un mot faux a des conséquences restent modèle généraliste + humain, pas le bouton d'écriture système.
Savoir ouvert, actualité et code
Les tâches 14–17 sont le terrain de ChatGPT / Gemini, et l'endroit où la thèse « Siri remplace tout » casse le plus vite.
Tâche 14 : « comparez Foundation Models API et ChatGPT API, inférence sur l'appareil seulement, listez trois hypothèses à ne pas écrire dans un contrat d'achat ». Siri AI récite les points WWDC, mais mélange « sur l'appareil » et « Private Cloud Compute », sans ancrage documentaire vérifiable — 1 point. ChatGPT et Gemini listent longueur de contexte, surface d'outils, facturation et frontière vie privée, et écrivent d'eux-mêmes « se fier à la doc du jour sur developer.apple.com ».
Tâche 15 (actu tech du jour + sources) : Siri AI sort sur le web, la réponse se lit, mais les citations s'arrêtent souvent au domaine ; les deux généralistes donnent le titre d'article. Tâche 16 (végétarien, sans correspondance, budget journalier) : Siri donne une ossature lisible, puis au troisième jour transforme « sans correspondance » en escale. Les généralistes relisent d'abord les contraintes, puis planifient.
La tâche 17 est le seul 0 de Siri AI. Un exemple Swift qui perd des mises à jour entre actor isolés : il commence par répéter correctement Sendable, puis propose un schéma de verrou obsolète — le patch ne compile pas. ChatGPT corrige du premier coup ; Gemini corrige la course mais introduit un MainActor superflu — 1 point. Conclusion nette : ne donnez pas le code à Siri AI, même avec un iPhone 18 Pro en main.
Agent multi-étapes : réservation, correction, confidentialité
Les tâches 18–20 répondent à « est-ce un agent, ou seulement une boîte de chat ».
Tâche 18 (réservation + calendrier + groupe) : personne n'a 2. Siri AI va au bout du calendrier et du groupe ; la réservation s'arrête à « ouvrir l'app de réservation et préremplir nombre / heure » — l'app resto tierce n'expose pas un App Intent complet, le système ne peut pas valider à votre place. Forme typique du 1 : la chaîne d'actions système casse sur la page de confirmation tierce. ChatGPT / Gemini n'atteignent même pas les objets calendrier — 0.
Tâche 19 : mémoire de travail. D'abord « budget 80 dollars, pas de musée », deux tours plus tard « budget 150, un musée est obligatoire ». ChatGPT et Gemini replanifient et pointent le changement ; Siri AI ajoute le musée mais recommande encore des restaurants du palier 80 dollars — 1 point. L'app de conversation Siri dédiée relit l'historique, mais la replanification globale après correction des contraintes reste plus faible que chez les généralistes.
La tâche 20 est celle où Siri AI doit prendre 2 — et l'a prise. Résumé santé et PDF de facture du compte labo structurés sur l'appareil ; aucun bandeau « envoi vers un modèle tiers » dans le dialogue. Selon l'architecture vie privée d'Apple, ce type de requête doit rester sur l'appareil ou dans Private Cloud Compute. Les mêmes fichiers dans ChatGPT / Gemini, c'est un envoi cloud — 0 selon nos règles, non parce que le résumé est mauvais, mais parce que le chemin de données par défaut est inacceptable. Santé, finance, contrats non publics : ce n'est pas un score d'expérience, c'est un score de conformité.
En une phrase
- Siri AI : agent système. Il fait, il connaît votre iPhone, il n'envoie pas à la légère les données privées hors de l'appareil. Il n'écrira pas du Swift compilable à votre place, et ne doit pas être le seul moteur de recherche.
- ChatGPT (GPT-6) : le raisonnement profond et le correctif code les plus stables. Sans les contacts système, ce n'est pas un agent téléphone.
- Gemini 3.8 : le plus équilibré en vision et en recherche. Il ne peut pas non plus « écrire à la personne de 15 h ».
Siri AI peut-il remplacer ChatGPT et Gemini ?
Remplacer = « désinstaller l'une des apps sans perdre une capacité clé au quotidien » : réponse non.
Router = « pour les gestes fréquents sur iPhone, demander d'abord à Siri AI » : réponse oui, il le faut. Mail, Messages, calendrier, rappels, explication d'écran, extraction de fichiers locaux : d'abord le système ; recherche, code, planification sous longues contraintes, textes juridiques bilingues : continuer d'ouvrir ChatGPT ou Gemini.
Trois erreurs fréquentes à rayer :
- « La puce plus forte de l'iPhone 18 Pro transformera Siri en ChatGPT. » Neural Engine et mémoire jouent sur la largeur, la latence et le hors-ligne du modèle local — elles ne comblent pas toutes seules la recherche web ouverte, l'écosystème d'outils et les agents code longs. Le matériel est nécessaire, pas suffisant.
- « Ce que la bêta anglaise fait, la version chinoise GA le fera forcément. » Apple écrit que Siri AI sort d'abord en anglais, puis élargit les langues ; la Chine continentale passe par la régulation. Prendre les 28 points de la bêta anglaise pour une promesse GA chinoise casse le calendrier.
- « Les totaux sont proches, donc n'importe lequel. » 28 et 29 sont proches parce que les forces s'annulent. Choisir au hasard une seule entrée, c'est enchaîner les zéros sur la recherche dans Messages ou sur le code.
Quatrième point pour les développeurs : sans App Intent / App Shortcut sérieux, Siri AI s'arrêtera chez vous au 1 de la tâche 18 — le système peut vous ouvrir, pas valider à la place de l'utilisateur. Ce n'est pas le modèle, c'est votre surface d'intent trop petite.
Routage : que garder sur l'iPhone, que garder sur le Mac
Inutile de payer le palier max chez les trois. Un défaut par type de tâche coûte moins cher que le débat « qui est plus fort ».
| Type de tâche | Défaut sur iPhone | Quand monter vers ChatGPT / Gemini |
|---|---|---|
| Calendrier, Messages, Mail, rappels, fichiers locaux | Siri AI | Stratégie longue ou comparaison de plusieurs options |
| Explication d'écran, Visual Intelligence, traduction de menu | Siri AI, contraintes dures ensuite Gemini | Contraintes allergie / médicales, ou plusieurs images à croiser |
| Réécriture, résumé, compte rendu de réunion | Outils d'écriture système | Contrats, politiques, textes juridiques externes |
| Recherche, actualité, voyages, enquête | Pas seulement Siri | Défaut ChatGPT ou Gemini, et vérifier les sources |
| Écrire du code, lire un crash, corriger de la concurrence | Pas Siri AI | ChatGPT ; ou revenir à Xcode / Claude Code sur Mac |
| Santé, factures, contrats non publics | Siri AI / sur l'appareil | Seulement si vous acceptez clairement l'envoi cloud |
Côté ordinateur, n'attendez pas que l'iPhone 18 Pro prenne le relais. Xcode, signature, TestFlight et les boucles d'agent longues exigent encore un Mac stable. Si la fenêtre de keynote ne livre pas de machine de lancement : un Mac cloud isolé pour faire tourner le SDK iOS 27 et les appels Foundation Models, plutôt que d'attendre le retail.
Trois points à valider pour les développeurs
Contrairement au routage utilisateur, les équipes iOS doivent, dans la fenêtre iPhone 18 Pro, traiter Siri AI comme une nouvelle entrée système, pas comme un nouveau modèle de chat. Sur un appareil hors production, ne valider que trois choses :
- App Intent couvre les actions clés. Créer, interroger, mettre à jour, annuler doivent être découvrables par le système ; sans « confirmer / payer » comme action irréversible, l'utilisateur s'arrête au 1 de notre tâche 18.
- Contenu d'écran et repli de partage. Même sans parler à votre app, Siri AI peut poser une question à partir de l'écran courant. Vérifiez si des champs sensibles entrent dans un résumé système, et le texte de repli de Visual Intelligence / feuille de partage.
- Chemins d'échec de Foundation Models. Le modèle sur l'appareil tronque, refuse, et échoue quand le quota est épuisé. « Siri peut répondre » n'est pas le SLA de l'app ; un échec local doit avoir un repli cloud ou humain. Permissions, labels vie privée et disponibilité régionale à valider avant le GA d'iOS 27.
N'attachez pas l'achat matériel à un nom de puce absent de la page produit. Pour la plupart des apps métier, le retour des early users et une Xcode stable suffisent ; seuls caméra, gros modèles locaux ou preuves de compatibilité day-one sur la roadmap justifient l'iPhone 18 Pro de lancement. Timeline produit : voir le spécial iPhone 18 Pro Max sur le site.
FAQ
Siri AI peut-il déjà remplacer ChatGPT ?
Non. Les totaux des 20 tâches sont proches, mais le code, la recherche sourcée et la planification sous longues contraintes restent l'affaire de ChatGPT ou Gemini. Siri AI remplace le travail système du type « ouvrir trois apps pour répondre à un SMS de retard ».
Faut-il un iPhone 18 Pro pour ces capacités ?
Non. Apple indique qu'Apple Intelligence / Siri AI sous iOS 27 prend en charge l'iPhone 16 et plus récents, ainsi que l'iPhone 15 Pro / Pro Max, etc. L'incrément iPhone 18 Pro est matériel (Neural Engine, mémoire, efficacité), pas « Siri AI seulement sur le nouveau téléphone ». Les specs retail : page produit après la keynote.
Quand la même Siri AI arrivera-t-elle en environnement chinois ?
La ligne publique d'Apple : Siri AI d'abord en bêta anglaise sur les appareils pris en charge, puis élargissement des langues. Apple Intelligence couvre déjà un ensemble de langues dont le chinois simplifié / traditionnel, mais Siri AI n'équivaut pas à toutes les fonctions Apple Intelligence déjà localisées. La Chine continentale passe par la régulation ; l'UE n'a pas Siri AI sur iOS au départ. Calendrier : apple.com/apple-intelligence.
Avez-vous testé sur un iPhone 18 Pro retail ?
Non. Le 9 septembre 2026 est le jour de la keynote ; les appareils retail ne sont pas encore expédiés. Nous avons testé la pile iOS 27 + Siri AI que l'iPhone 18 Pro mettra en avant. Latence puce et chiffres batterie : un article matériel à part, une fois des appareils achetables disponibles.
Router l'agent sur l'iPhone, construire encore sur Mac
Siri AI règle les actions système ; le SDK iOS 27, la signature et TestFlight exigent toujours un nœud Xcode stable. Pendant la fenêtre de keynote, un Mac cloud isolé pour faire passer les builds est plus fiable qu'attendre la machine de lancement.
Valider le modèle et la machine séparément. — Voir les offres Mac cloud