WWDC26 : Foundation Models, LLM externes et agentic coding pour devs indie

Réponse courte : Apple a ouvert le framework Foundation Models, ajouté l'entrée image, branché un modèle serveur sur Private Cloud Compute, et standardisé l'accès aux modèles externes derrière un protocole Swift. Pour un studio indie, les trois nouveautés qui comptent vraiment sont le modèle serveur gratuit sous le seuil de 2 millions de téléchargements, les Dynamic Profiles pour les apps agentiques, et le framework d'évaluations qui remplace le pifomètre.

Comment j'ai vérifié ce qui suit
J'ai regardé la keynote et le Platforms State of the Union du 8 juin 2026, puis j'ai relu trois sessions techniques avant d'écrire une ligne : « What's new in the Foundation Models framework », « Build agentic app experiences with the Foundation Models framework » et « Build with the new Apple Foundation Model on Private Cloud Compute ». Chaque chiffre de cet article vient d'une de ces sources, et je le dis quand une information manque. Aucun benchmark maison, aucun prix inventé : quand Apple ne publie pas de chiffre, je n'en donne pas.
Ce que je n'ai pas fait : mesurer ces APIs sur mes propres apps. Les bêtas développeur sont sorties le 8 juin 2026, et un retour d'usage sérieux demande plusieurs semaines de production. Ce que tu lis ici est une lecture de sources officielles, pas un retour terrain.
Qu'est-ce qui change vraiment dans Foundation Models ?
Le framework Foundation Models passe d'une API sur l'appareil à un socle unique pour plusieurs modèles. Selon l'annonce développeur d'Apple du 8 juin 2026, le framework devient « une API Swift native unique » qui prend désormais en charge des modèles plus puissants sur l'appareil, l'entrée image, les modèles serveur et la construction de compétences personnalisées. La même annonce précise que la nouvelle génération de modèles Apple a été « conçue sur mesure en collaboration avec Google et ses modèles Gemini ».
La session What's new in the Foundation Models framework détaille le reste : le framework et un nouveau paquet d'utilitaires passent en open source, le modèle sur l'appareil accepte des pièces jointes image de n'importe quelle taille, et un protocole LanguageModel permet à un modèle local ou serveur d'alimenter la même session. Anthropic et Google publient leurs propres paquets Swift pour leurs modèles frontière, avec un suivi de consommation via response.usage.
Ce que ça change pour ton prochain projet
- Tu n'as plus à choisir entre « tout local » et « tout cloud » : la même session peut basculer de modèle.
- Tu peux envoyer une image dans le prompt sans passer par un service tiers.
- Tu peux lire le code du framework, puisqu'il est ouvert, au lieu de deviner son comportement.
Le modèle serveur sur Private Cloud Compute vaut-il le coup pour un indie ?
Le modèle serveur vaut le coup pour un studio indie pour une raison précise : le coût. Selon la session dédiée à Private Cloud Compute, l'accès se fait sans clé d'API, sans authentification et sans coût de jetons pour le développeur ; chaque utilisateur dispose d'une limite d'usage quotidienne, relevable via iCloud+. L'annonce Apple ajoute la condition d'éligibilité : les développeurs du Small Business Program totalisant moins de 2 millions de premiers téléchargements sur l'App Store y accèdent sans frais d'API cloud.
Le basculement tient en une ligne : tu remplaces le modèle par défaut par PrivateCloudComputeLanguageModel() dans l'initialisation de la session, et le reste du code (sorties structurées, appels d'outils) ne change pas.
Le compromis honnête
| Critère | Modèle sur l'appareil | Private Cloud Compute |
|---|---|---|
| Fonctionne hors ligne | Oui | Non |
| Limite d'usage | Aucune | Limite quotidienne par utilisateur |
| Fenêtre de contexte | 4 096 jetons, 8 192 sur les appareils récents | 32 768 jetons |
| Raisonnement | Non | Oui, trois niveaux réglables |
Traduction produit : le modèle sur l'appareil reste ton chemin par défaut, et le modèle serveur sert les cas qui demandent un long contexte ou un vrai raisonnement. Ton interface doit gérer le moment où le quota tombe, et la session PCC expose justement l'état de consommation pour afficher un message utile plutôt qu'une alerte brutale.
Comment fonctionnent les modèles externes comme Claude et Gemini ?
Les modèles externes passent par le même protocole que les modèles Apple. La session 241 décrit un protocole LanguageModel qui permet à n'importe quel modèle, local ou distant, d'alimenter une LanguageModelSession. Apple publie deux implémentations open source, CoreAILanguageModel et MLXLanguageModel, et Anthropic comme Google publient des paquets Swift pour leurs propres modèles.
Concrètement, tu changes de fournisseur en changeant l'objet passé à la session, pas ton code métier. Ce que je ne peux pas te dire, parce qu'Apple ne l'a pas publié : le prix exact d'un appel à un modèle tiers, ni la manière dont la facturation transite. Méfie-toi de tout article qui te donne un tarif au millier de requêtes pour ces modèles ; à la date de publication, cette information n'existe pas dans les sources officielles.
Dynamic Profiles : à quoi ça sert concrètement ?
Un Dynamic Profile décrit un agent : des instructions, des outils, un modèle et un niveau de raisonnement, regroupés dans un objet que la session peut changer en cours de route. La session Build agentic app experiences with the Foundation Models framework montre le protocole LanguageModelSession.DynamicProfile, les instructions composables via DynamicInstructions, et deux patrons d'orchestration : le passage de relais entre profils qui partagent l'historique, et l'appel d'un profil enfant à transcription isolée.
La même session introduit ToolCallingMode pour autoriser, interdire ou imposer l'appel d'outils, et une politique de transcription qui décide si une erreur d'outil annule ou conserve l'historique. Pour un studio indie, l'intérêt est simple : tu peux découper une fonctionnalité en phases (brainstorm, plan, relecture) avec un modèle différent par phase, sans écrire ton propre orchestrateur.
Le piège : chaque réécriture d'historique invalide le cache et augmente la latence. Ajouter à la transcription reste peu coûteux ; la réécrire ne l'est pas.
Agentic coding dans Xcode 27 : est-ce que ça change le métier ?
Xcode 27 intègre le travail agentique dans l'éditeur. Selon l'annonce Apple, Xcode 27 s'intègre en profondeur avec des modèles et agents d'Anthropic, Google et OpenAI, propose une interface conversationnelle avec planification interactive et un canevas qui rend le Markdown et les aperçus de code, et laisse les agents valider leur propre travail via les tests, les Playgrounds, les aperçus et le nouveau Device Hub. L'extension passe par le Model Context Protocol et l'Agent Client Protocol, avec GitHub et Figma comme partenaires de lancement.
Deux détails matériels comptent pour un studio : Xcode 27 devient exclusif à Apple silicon et pèse 30 % de moins, et Xcode Cloud annonce des builds jusqu'à deux fois plus rapides avec la prise en charge de Metal et de visionOS.
Ce que ça change pour un indie : la vitesse de prototypage, pas la qualité de la décision produit. Un agent écrit une intégration en une soirée. Il ne te dira pas si l'utilisateur en avait besoin, et il ne portera pas le coût de maintenance annuel.
Comment mesurer si ta fonctionnalité IA marche ?
Tu mesures avec le framework d'évaluations introduit à la WWDC26, pas à l'œil. Les sessions 241 et 319 le présentent comme le moyen de quantifier la qualité et la précision d'une fonctionnalité fondée sur un modèle, et de choisir modèle et niveau de raisonnement sur des données plutôt qu'à l'intuition. C'est la nouveauté la plus ennuyeuse de l'année, et probablement la plus utile pour une petite équipe : elle transforme « ça a l'air mieux » en un chiffre que tu peux suivre entre deux versions.
Ce qu'un studio indie peut prototyper cette semaine
- Un résumé sur l'appareil : une session Foundation Models sur le modèle local, avec une sortie structurée typée. Une journée de travail, zéro coût d'infrastructure, fonctionne hors ligne.
- Une lecture d'image : la nouvelle entrée image du modèle local remplace un service d'analyse tiers pour les cas simples. Une à deux journées.
- Un agent à deux phases : un Dynamic Profile qui brainstorme sur le modèle serveur avec raisonnement, puis rédige sur le modèle local. Trois journées, à condition d'avoir déjà écrit le chemin sans IA.
Dans les trois cas, écris d'abord le comportement quand le modèle n'est pas disponible. C'est ce chemin-là que la moitié de tes utilisateurs verront le premier jour.
Marketing ou vraiment utile ?
- Vraiment utile : le modèle serveur sans coût d'API sous le seuil de 2 millions de téléchargements, l'entrée image sur l'appareil, le framework d'évaluations, l'ouverture du code.
- À tempérer : les démos d'agents autonomes. Elles supposent un contexte long, donc le modèle serveur, donc une connexion et un quota. Ton utilisateur dans le métro n'a ni l'un ni l'autre.
- À ignorer pour l'instant : tout chiffre de performance ou de prix qui ne figure pas dans une source Apple publique.
Les trois sessions WWDC26 à regarder
- What's new in the Foundation Models framework — le panorama complet : ouverture du code, entrée image, protocole de modèle, outils système, Dynamic Profiles.
- Build agentic app experiences with the Foundation Models framework — l'orchestration, la gestion de la transcription et les modes d'appel d'outils.
- Build with the new Apple Foundation Model on Private Cloud Compute — le modèle serveur, les limites d'usage, les niveaux de raisonnement et l'interface à prévoir quand le quota tombe.
Le récapitulatif court se trouve dans les 5 points à retenir du Platforms State of the Union.
Conclusion : le bon pari pour 2026-2027
Le bon pari n'est pas l'app « tout IA ». C'est l'IA discrète, sur l'appareil, qui raccourcit un geste que l'utilisateur fait déjà, avec un chemin de secours qui marche sans connexion. Apple a livré les briques ; la décision produit reste la partie que personne ne peut automatiser à ta place.
Pour la suite pratique, lis la checklist App Intents iOS, la checklist privacy pour l'IA locale, et le budget de prototype App Intents.
FAQ
Le modèle serveur Private Cloud Compute est-il vraiment gratuit ?
Il est sans coût d'API cloud pour les développeurs du Small Business Program qui totalisent moins de 2 millions de premiers téléchargements, selon l'annonce d'Apple. Chaque utilisateur dispose en revanche d'une limite quotidienne, relevable via iCloud+.
Foundation Models fonctionne-t-il sur Apple Watch ?
Oui, la session 241 indique que le modèle Private Cloud Compute est accessible depuis watchOS 27.
Quelle est la taille de contexte disponible ?
Le modèle sur l'appareil expose 4 096 jetons, 8 192 sur les appareils récents ; le modèle Private Cloud Compute expose 32 768 jetons, selon la session 319.
Puis-je utiliser Claude ou Gemini depuis une app iOS ?
Oui, via les paquets Swift publiés par Anthropic et Google, branchés sur le même protocole LanguageModel que les modèles Apple. Apple n'a pas publié de grille tarifaire pour ces appels, et je n'en invente pas.
Que faire quand le modèle n'est pas disponible ?
Vérifie la disponibilité avant d'afficher l'interface, puis bascule sur le chemin sans IA. La session 319 montre aussi comment lire l'état du quota pour afficher un message persistant plutôt qu'une alerte bloquante.
Portfolio Doved Studio
Chez Doved Studio, je construis des apps iOS où l'IA sert un geste précis : une analyse de mouvement dans Titan's Grip, une capture transformée en tâche dans Glean. Tu peux voir les produits dans le portfolio du studio.

