Vue normale

Il y a de nouveaux articles disponibles, cliquez pour rafraîchir la page.
À partir d’avant-hierFlux principal

Apple : les premiers MacBook Pro équipés de puces M4 seraient prévus pour la fin de l’année

17 avril 2024 à 14:00

Fin octobre dernier, Apple présentait le même jour trois puces destinées à ses ordinateurs, les M3, M3 Pro et M3 Max. Alors qu’elle a débuté le lancement des premiers Mac équipés de ces puces, elle s’apprêterait, selon le journaliste Mark Gurman de Bloomberg, à produire les M4 destinées à équiper l’ensemble de sa gamme.

Apple a commencé à produire ses propres puces, les M1, en 2020, délaissant les processeurs d’Intel. Les M3 ont été les premières puces d’ordinateur personnel élaborées à partir du procédé de gravure en 3 nanomètres de TSMC, ce qui leur permet de renfermer davantage de transistors dans un format plus petit pour une rapidité et une efficacité accrues. Leur Neural Engine était présenté par Apple comme “un moteur sur mesure pour l’IA et la vidéo”.

Johny Srouji, Senior Vice President of Hardware Technologies d’Apple, déclarait lors de leur annonce :

“La puce Apple a complètement redéfini l’expérience Mac. Chaque aspect de son architecture est conçu pour optimiser les performances et l’efficacité énergétique. Avec la technologie en 3 nanomètres, une architecture GPU de nouvelle génération, un CPU plus performant, un Neural Engine plus rapide, et plus de mémoire unifiée, les puces M3, M3 Pro et M3 Max sont les plus avancées à ce jour pour un ordinateur personnel”.

Elles équipent le MacBook Pro, le MacBook Air et l’iMac.

La prochaine génération de puces d’APPLE

Selon Mark Gurman, la puce M4 disposera d’un Neural Engine encore plus rapide et de plus de mémoire pour les tâches d’IA et de machine learning. Elle se déclinera en 4 versions : celle de base, appelée en interne Donan, la M4 Pro baptisée Brava, la M4 Max plus performante et pour finir, encore plus puissante, Hidra, la M4 Ultra qui équipera l’ordinateur de bureau haut de gamme d’Apple, le Mac Pro, fin 2025. Celui-ci pourrait ainsi bénéficier d’une RAM de 512 Go.

Les premiers Mac à être livrés avec la puce M4 seront le MacBook Pro 14 pouces bas de gamme et l’iMac 24 pouces, prévus pour la fin de cette année. Les nouveaux MacBook Pro haut de gamme 14 pouces et 16 pouces intégrant les puces M4 Max sont attendus entre fin 2024 et début 2025 tout comme le Mac mini. Les nouveaux MacBook Air 13 pouces et 15 pouces sont quant à eux prévus pour le printemps 2025.

Ce calendrier peut évidemment évoluer, Apple apportera plus de précisions sur sa puce M4 lors de sa conférence annuelle, la Worldwide Developers Conference (WWDC) le 10 juin prochain. L’IA y tiendra une place centrale non seulement pour les Mac mais également pour ses iphones puisque Mark Gurman dans sa newsletter d’hier, évoquant la mise à jour d’iOS 18, écrit : “alors que le monde entier attend la grande présentation de l’IA d’Apple le 10 juin, il semble que la première vague de fonctionnalités fonctionnera entièrement sur l’appareil”.

Apple les premiers MacBook Pro équipés de puces M4 seraient prévus pour la fin de l'année

Les géants de la tech, portés par la GenAI : Google franchit de nouveau la barre des 2 billions de dollars

16 avril 2024 à 12:30

Les GAFAM ou GAMAM (Google, Apple, Facebook (Meta), Amazon, Microsoft) portés par l’essor de l’IA générative, connaissent une croissance importante de leur capitalisation boursière tout comme NVIDIA. Alphabet, la maison mère de Google, a ce vendredi 12 avril franchi pour la seconde fois de son existence le cap des 2 billions de dollars, se retrouvant ainsi la 4ème entreprise la plus valorisée au monde.

Alors que la valorisation de NVIDIA portée par la demande de puces ne cesse de grimper, les 5 GAFAM ont également vu la leur augmenter significativement  l’an passé et en ce début 2024.

En mai 2023, Apple était l’entreprise la plus valorisée devant Microsoft, suivie par Saudi Aramco, une société pétrolière saoudienne, Alphabet et Amazon. Alors que l’inflation leur était favorable, l’appétit des investisseurs pour la GenAI et la demande de puces avaient quelque peu modifié ce classement : Microsoft, principal investisseur d’OpenAI, s’est installé en 1ère place et NVIDIA est venu s’immiscer en 3ème position devant Saudi Aramco.

Vendredi dernier, le classement a de nouveau évolué : Saudi Aramco s’est vu relégué à la sixième place par Alphabet et Amazon. Si Microsoft semblait inatteignable avec une valorisation de plus de 3 billions (3000 milliards de dollars), celle d’Apple était de 2,7 billions.

Les perspectives optimistes d’août 2023 pour NVIDIA, boosté par les ventes du H100, son GPU pour datacenters, se sont avérées justes : l’entreprise s’est retrouvée en 3ème place du top 5 avec une valorisation de plus de 2,2 billions. Alphabet, qui, pendant un moment a lui aussi dépassé le seuil des 2 000 milliards de dollars comme il l’avait éphémèrement fait en novembre 2021, est redescendu aux alentours de 1,990 billions tandis qu’Amazon était valorisé à plus de 1,966 billions.

Google (Alphabet) avait quelque peu raté la présentation de son modèle phare Gemini fin décembre dernier et vu ses actions chuter rapidement. La société a cependant su regagner la confiance des investisseurs la semaine dernière lors de Google Cloud Next où elle a notamment dévoilé son CPU Axion.

geants-tech-portes-GenAI-Google

GTC 2024 : NVIDIA dévoile le GPU Blackwell B200 et la super puce GB200

20 mars 2024 à 11:30

Les puces de NVIDIA, notamment le GPU H100, sont les plus utilisées que ce soit pour les datacenters, les supercalculateurs, l’entraînement ou l’inférence des LLM. Lors de la GTC 2024, qui a réuni Jensen Huang, fondateur et PDG de NVIDIA, a présenté des GPU qui devraient apporter encore plus de puissance de calcul : la puce “la plus puissante au monde pour l’IA” Blackwell B200 basée sur une nouvelle architecture et la super puce GB200, qui combinera les architectures Grace et Blackwell.

Nommée en l’honneur de David Harold Blackwell, mathématicien de l’Université de Californie à Berkeley spécialisé dans la théorie des jeux et les statistiques, et premier chercheur noir intronisé à l’Académie nationale des sciences, la nouvelle architecture succède à l’architecture NVIDIA Hopper, lancée il y a deux ans.

Elle comprend, selon NVIDIA, six technologies transformatrices pour l’informatique accélérée, qui contribueront à débloquer des percées dans le traitement des données, la simulation d’ingénierie, l’automatisation de la conception électronique, la conception de médicaments assistée par ordinateur, l’informatique quantique et l’IA générative, autant d’opportunités industrielles émergentes pour NVIDIA.

Outre les puces Blackwell, elle dispose notamment d’un moteur de transformateur de deuxième génération : alimentée par une nouvelle prise en charge de la mise à l’échelle des micro-tenseurs et les algorithmes avancés de gestion de la plage dynamique de NVIDIA intégrés aux frameworks NVIDIA TensorRT-LLM et NeMo Megatron, Blackwell prendra en charge le double de la taille des calculs et des modèles avec de nouvelles capacités d’inférence IA en virgule flottante 4 bits.

Un NVLink de cinquième génération permet d’accélérer les performances des modèles d’IA de plusieurs billions de paramètres grâce à un débit bidirectionnel de 1,8 To/s par GPU, garantissant une communication haut débit transparente entre jusqu’à 576 GPU pour les LLM les plus complexes.

Crédit Nvidia

Blackwell multiplie les performances de Hopper par 2,5 en FP8 pour l’entraînement, par puce et par 5 avec FP4 pour l’inférence.

Lors de son discours d’ouverture, Jensen Huang affirmait:

“Pendant trois décennies, nous avons poursuivi l’informatique accélérée, dans le but de permettre des percées transformatrices telles que l’apprentissage profond et l’IA. L’IA générative est la technologie déterminante de notre époque. Blackwell est le moteur de cette nouvelle révolution industrielle. En travaillant avec les entreprises les plus dynamiques au monde, nous réaliserons les promesses de l’IA pour tous les secteurs”.

Le GPU B200 et la superpuce GB200

Comptant deux cœurs de processeur, chacun comportant 104 milliards de transistors, les GPU d’architecture Blackwell sont fabriqués à l’aide d’un processus TSMC 4NP sur mesure avec des puces GPU limitées à deux réticules connectées par une liaison puce à puce de 10 To/seconde formant ainsi un seul GPU unifié. Tout comme les GH200 Grace Hopper, les B200 sont dotés de mémoire HBM3e, (192 pour ces derniers contre 282 Go pour le GH200),qui permet de gérer les charges de travail d’IA générative les plus complexes, allant des grands modèles linguistiques aux systèmes de recommandation et aux bases de données vectorielles. La bande passante mémoire est de 8 To/s.

Crédit NVIDIA : à gauche GB200, à droite le gpu H100

La superpuce GB200 connecte deux de ces GPU B200 à un processeur Grace, via une interconnexion puce-puce NVLink ultra-basse consommation de 900 Go/s, pour offrir des performances 30 fois supérieures pour les calculs d’inférence. Selon Jensen Huang, la formation d’un modèle de 1 800 milliards de paramètres aurait auparavant nécessité 8 000 GPU Hopper et 15 mégawatts de puissance, 2 000 GPU Blackwell permettent de le faire en ne consommant que quatre mégawatts.

Le GB200 serait également 25 fois plus performant en matière d’efficacité énergétique que le H 100.

Crédit NVIDIA Le GB200 NVL72

Le GB200 est un composant clé du NVIDIA GB200 NVL72, un système multi-nœuds, refroidi par liquide et à l’échelle du rack pour les charges de travail les plus gourmandes en ressources de calcul. Il combine 36 superpuces Grace Blackwell, dont 72 GPU Blackwell et 36 CPU Grace interconnectés par le NVLink de cinquième génération. Grâce à lui, l’inférence d’un LLM  de mille milliards de paramètres serait 30 fois plus rapide.

GTC 2024 NVIDIA dévoile le GPU Blackwell B200 et la super puce GB200

SoftBank, à la recherche d’investisseurs pour se lancer dans la fabrication de puces d’IA

21 février 2024 à 10:30

Après Sam Altman, c’est au tour de Masayoshi Son, fondateur et PDG de SoftBank de partir à la recherche de fonds pour créer sa propre entreprise de fabrication de puces de pointe nécessaires à l’IA générative, un marché très lucratif dominé par NVIDIA, qu’AMD s’efforce de rattraper avec l’Instinct MI300X. Pour ce projet baptisé Izanagi d’un montant de 100 milliards de dollars, Masayoshi Son en cherche 70 auprès d’investisseurs du Moyen-Orient.

Après des pertes de 27,4 milliards de dollars annoncés en 2022, Masayoshi Son, s’était quelque peu retranché dans le silence. Le Vision Fund qu’il a créé en 2017 a réduit considérablement ses investissements, des actions d’Alibaba qui lui a permis de faire fortune ont été revendues et, malgré des pertes de 32 milliards affichées en 2023, le milliardaire se disait en juin dernier prêt à rebondir et à investir dans l’IA.

Il déclarait :

“Nous sommes prêts à passer en mode offensif, je veux que SoftBank mène la révolution de l’IA”. 

Durant la période en mode défense, durant laquelle la société a amassé plus de 35 milliards de dollars de liquidités, il s’était consacré à la réintroduction en bourse d’ARM, société acquise par SoftBank en 2016 pour 32 milliards de dollars. Entrée en bourse le 14 septembre dernier réussie puisque la société de semi-conducteurs a vu sa valeur grimper à 65 milliards de dollars et plus que doubler depuis.

SoftBank était d’ailleurs prêt en 2020 à céder Arm à Nvidia mais ce dernier a dû renoncer à l’acquisition en 2022 face aux obstacles réglementaires et à l’opposition de la concurrence. Il a toutefois annoncé en décembre dernier un investissement de 147,3 millions de dollars dans le fabricant des processeurs qui complètent ses puces dans les centres de données.

SoftBank a pour projet aujourd’hui de fabriquer lui aussi des puces d’IA en collaboration avec sa filiale Arm. Il va y consacrer 30 des milliards de dollars engrangés et espère collecter le reste afin de se tailler une place de choix dans ce marché des puces estimé à plus de 1000 milliards de dollars à l’horizon 2030.

SoftBank, à la recherche d'investisseurs pour se lancer dans la fabrication de puces d'IA

❌
❌