Intel Crescent Island : 160 Go pour l'inférence LLM
Crescent Island est un GPU de centre de données annoncé par Intel le 14 octobre 2025, doté de 160 Go de mémoire LPDDR5X en configuration de référence (jusqu'à 480 Go chez certains partenaires), pensé pour l'inférence dans des serveurs d'entreprise refroidis par air. Ce n'est ni un produit grand public, ni une carte à installer dans un PC personnel : les échantillons ne sont attendus qu'au second semestre 2026, sans prix ni date de vente commerciale annoncés.
Crescent Island est le nom de code du GPU d'inférence pour centres de données qu'Intel a dévoilé fin 2025, avec un argument principal : beaucoup de mémoire, moins chère et moins gourmande que la HBM des accélérateurs concurrents. Ce dossier explique ce qui est confirmé par Intel, ce qui reste à vérifier, et pourquoi ce n'est pas un GPU pour son PC personnel.
#Ce qu'Intel a annoncé
Intel a présenté Crescent Island le 14 octobre 2025 lors de l'OCP Global Summit : un GPU de centre de données doté de 160 Go de mémoire LPDDR5X, construit sur une microarchitecture Xe3P optimisée pour le rendement par watt. Intel indique cibler explicitement les fournisseurs de « tokens-as-a-service » et les charges d'inférence, dans des serveurs d'entreprise refroidis par air plutôt que par liquide.
Les échantillons destinés aux clients sont attendus au second semestre 2026. Intel ne communique aucun prix, aucune date de disponibilité commerciale grand public, ni de partenaire OEM confirmé à ce stade.
#Capacité mémoire n'est pas débit
160 Go (jusqu'à 480 Go selon certains partenaires cités par Tom's Hardware) permettent de charger des modèles volumineux entièrement en mémoire GPU, sans découpage sur plusieurs cartes. Mais la capacité ne dit rien de la bande passante mémoire, qui est le facteur qui limite réellement le débit de génération token par token. La LPDDR5X est structurellement plus lente en bande passante que la HBM utilisée par les accélérateurs haut de gamme : Intel fait un compromis assumé entre capacité/coût et débit maximal.
#Crescent Island : l'état des lieux
| Point | Statut | Source |
|---|---|---|
| 160 Go de LPDDR5X, architecture Xe3P | Confirmé par Intel | Communiqué Intel, 14/10/2025 |
| Cible : inférence, serveurs air-cooled, tokens-as-a-service | Confirmé par Intel | Communiqué Intel |
| Échantillons clients au second semestre 2026 | Confirmé par Intel | Communiqué Intel |
| Configurations jusqu'à 480 Go chez certains partenaires | Rapporté par la presse technique | Tom's Hardware |
| Bande passante mémoire réelle, tokens/s | Non mesuré | Premiers benchmarks indépendants |
| Prix, date de vente, disponibilité OEM | Inconnu | À ne pas anticiper |
#Pour qui, et pour quel usage
Crescent Island vise des opérateurs de centres de données et des fournisseurs de service d'inférence, pas les particuliers ni les petites équipes montant une machine de développement. Le format serveur, le refroidissement par air visé pour la densité, et le ciblage explicite « tokens-as-a-service » signalent un produit d'infrastructure, comparable dans son rôle à une carte destinée à du service LLM à grande échelle plutôt qu'à un poste de travail.
Pour une entreprise qui envisage de l'inférence LLM interne à moyen terme, l'intérêt tiendra à un ratio coût par Go de mémoire et par watt meilleur que les GPU HBM actuels — un calcul qui ne peut se faire qu'une fois le prix et les performances réelles publiés.
Ce positionnement rappelle une tendance plus large observée chez plusieurs fabricants : proposer de la mémoire abondante mais moins rapide (LPDDR) plutôt que de la mémoire rare mais très rapide (HBM), pour des charges d'inférence où charger le modèle entier compte plus que le débit de pointe. C'est le même arbitrage que l'on retrouve, à une échelle différente, sur les APU grand public à mémoire unifiée.
#Pilotes et frameworks : ce qui manque encore
Aucune source consultée ne confirme, à ce jour, un support certifié de vLLM, SGLang ou d'un runtime d'inférence LLM populaire pour Crescent Island. Intel maintient déjà un backend OpenVINO pour llama.cpp sur ses GPU actuels, ce qui suggère une trajectoire logicielle cohérente, mais la maturité réelle des pilotes pour une toute nouvelle puce ne s'évalue qu'après la mise à disposition d'échantillons aux développeurs.
#Acheter maintenant ou attendre ?
- Besoin d'inférence LLM en entreprise aujourd'hui
- Les GPU HBM actuels ou des solutions multi-GPU existantes restent les seules options mesurables ; Crescent Island n'est pas disponible et n'a pas de prix.
- Projet d'infrastructure à horizon 2027
- Suivre les premiers benchmarks indépendants de Crescent Island une fois les échantillons sortis, en particulier sur le tokens/s réel et le coût par Go.
- Usage personnel ou petite équipe
- Ce GPU ne concerne pas ce cas d'usage : privilégier une configuration GPU grand public ou un APU à mémoire unifiée déjà documenté sur ce site.
- Décision basée sur les 480 Go annoncés
- Ce chiffre correspond à une configuration maximale rapportée par la presse pour certains partenaires, pas à la configuration de référence à 160 Go confirmée par Intel.
- Alternative disponible : LLM multi-GPU avec llama.cpp
- Choisir un GPU pour un LLM local
- Source : communiqué Intel sur Crescent Island
- Source : Tom's Hardware sur Crescent Island
Crescent Island est-il disponible à l'achat ?+
Crescent Island peut-il remplacer un GPU grand public pour l'IA locale ?+
160 Go de LPDDR5X, ça veut dire des modèles plus rapides ?+
Crescent Island va-t-il jusqu'à 480 Go ?+
Crescent Island sera-t-il compatible avec vLLM ou llama.cpp ?+
Un retour, une erreur, une précision ? Faites-nous signe, ça améliore le guide pour tout le monde.