Développement de l'industrie de l'IA et les dynamiques réglementaires

Couvrir les lancements de modèles de fondation, les libérations de produits, les développements majeurs des entreprises, l’activité de financement, la réglementation, la conformité et les tendances des infrastructures de calcul qui façonnent le paysage mondial de l’IA.
Tout
Agent IA
Actualités de l’industrie de l’IA
Tokens IA
Outils et apps IA

L’action de Williams Companies progresse de 6,3 % en séance ; Morgan Stanley la classe parmi ses choix privilégiés pour l’infrastructure de l’IA

Selon Morgan Stanley, l’action de Williams Companies (WMB) a progressé de 6,3 % en séance le 26 août, enregistrant sa plus forte hausse en une journée depuis 2020. La banque d’investissement a désigné cette entreprise énergétique du secteur intermédiaire comme l’une de ses valeurs privilégiées pour le déploiement des infrastructures d’IA, tout en maintenant un objectif de cours de 103 dollars. L’analyste Robert Kad a indiqué que la valorisation actuelle de l’entreprise était attractive, les dépe
WMB-1,03 %
GateNews·08-26 14:28
L’action de Williams Companies progresse de 6,3 % en séance ; Morgan Stanley la classe parmi ses choix privilégiés pour l’infrastructure de l’IA

Zhipu AI publie en open source GLM-5.3-Flash : 320 milliards de paramètres, dont seulement 18 milliards sont activés, à un tarif inférieur de 90 % à celui de GLM-5.2.

Zhipu AI a officiellement rendu open source GLM-5.3-Flash, un grand modèle de langage comptant 320 milliards de paramètres, dont seulement 18 milliards sont activés à chaque inférence. Les poids du modèle sont désormais disponibles sur Hugging Face sous licence MIT. Le modèle prend nativement en charge le texte, les images et les vidéos : il s’agit du premier modèle multimodal de la série GLM-5. L’entreprise a déclaré que GLM-5.3-Flash surpasse globalement GLM-5.2, avec des performances sur les
GateNews·08-26 14:17
Zhipu AI publie en open source GLM-5.3-Flash : 320 milliards de paramètres, dont seulement 18 milliards sont activés, à un tarif inférieur de 90 % à celui de GLM-5.2.

OpenAI achemine environ 3 % des requêtes ChatGPT Pro et Thinking vers le modèle GPT-5.5-mini en raison d’un bug de routage

Selon Adam Fry, responsable produit de ChatGPT chez OpenAI, un bug de routage a récemment dirigé environ 3 % des requêtes Pro et Thinking vers GPT-5.5-mini au lieu du modèle GPT-5.6 sélectionné. Le problème a été corrigé. Des utilisateurs ont signalé une augmentation de la vitesse des réponses ainsi qu’une baisse de leur qualité. L’inspection des requêtes réseau a confirmé que, tandis que l’interface front-end demandait GPT-5.6, le serveur renvoyait des réponses générées par gpt-5-5-mini.
GateNews·08-26 14:01
OpenAI achemine environ 3 % des requêtes ChatGPT Pro et Thinking vers le modèle GPT-5.5-mini en raison d’un bug de routage

Les actions liées à l’IA chutent globalement à l’ouverture des marchés américains ; SAP recule de 3,08 %

Selon les données de MSX.COM, le marché boursier américain a ouvert en baisse le 26 août : le Dow Jones reculait de 0,12 %, le S&P 500 de 0,14 % et le Nasdaq Composite de 0,17 %. L’indice de volatilité VIX progressait de 1,75 %. Les actions liées à l’IA étaient globalement en baisse, SAP cédant 3,08 %, Palo Alto Networks 2,94 %, ServiceNow 2,88 %, Snowflake 2,62 % et EPAM 2,6 %.
SAP-1,14 %
PANW0,12 %
NOW-1,45 %
SNOW2,55 %
GateNews·08-26 14:01
Les actions liées à l’IA chutent globalement à l’ouverture des marchés américains ; SAP recule de 3,08 %

L’activité B2B de MiniMax représente désormais 80 % de l’ARR, contre 30 % un an plus tôt.

Selon Odaily, l’activité B2B de MiniMax représente désormais environ 80 % de son revenu récurrent annualisé (ARR), contre environ 30 % il y a un an, tandis que l’activité B2C est passée de 70 % à 20 %. Cette évolution reflète l’adoption accélérée de ses solutions par les entreprises et les développeurs. MiniMax l’a attribuée aux mises à niveau continues de sa série M2 ainsi qu’au lancement des modèles M3 et H3, qui ont amélioré à la fois les capacités des modèles et le débit d’inférence, faisant
GateNews·08-26 14:01
L’activité B2B de MiniMax représente désormais 80 % de l’ARR, contre 30 % un an plus tôt.

Google Cloud lance Gemini Enterprise avec une tarification à l’usage et des remises de 10 à 50 %.

Selon Google Cloud, Gemini Enterprise proposera désormais un modèle tarifaire à l’usage, permettant aux entreprises d’éviter les frais d’abonnement fixes et de définir des plafonds de dépenses mensuels. Une fois le budget épuisé, les agents d’IA suspendront leurs opérations. Les clients s’engageant sur le long terme bénéficieront de remises de 10 % à 20 %, tandis que les tâches planifiées pendant les heures creuses pourront bénéficier de remises allant jusqu’à 50 %. L’entreprise vise à réduire l
GateNews·08-26 14:00
Google Cloud lance Gemini Enterprise avec une tarification à l’usage et des remises de 10 à 50 %.

La startup d’infrastructure de test pour agents d’IA Arga Labs lève $10M lors d’un tour d’amorçage mené par General Catalyst

Selon TechCrunch, Arga Labs, une startup spécialisée dans l’infrastructure de test pour les agents d’IA, a levé aujourd’hui 10 millions de dollars lors d’un tour de financement d’amorçage mené par General Catalyst. BoxGroup, Emergence Capital, Gradient Ventures et SV Angel ont également participé à ce tour. L’entreprise fournit une infrastructure de test et de formation pour le déploiement d’agents d’IA en entreprise grâce à des environnements de jumeaux numériques qui reproduisent les systèmes,
GateNews·08-26 13:41
La startup d’infrastructure de test pour agents d’IA Arga Labs lève $10M  lors d’un tour d’amorçage mené par General Catalyst

MiniMax porte le nombre de paramètres de M3Pro à environ 3 000 milliards le 26 août.

Selon PANews, MiniMax a révélé lors de sa conférence téléphonique consacrée à ses résultats, le 26 août, que le modèle M3Pro compterait environ 3 000 milliards de paramètres. L’entreprise étendrait également l’apprentissage par renforcement ainsi que l’entraînement sur des tâches impliquant de longs contextes, afin d’améliorer la généralisation et les capacités d’intelligence du modèle. Le PDG Yan Junjie a indiqué que l’entreprise continuerait à faire progresser l’intelligence des modèles, l’eff
GateNews·08-26 13:41
MiniMax porte le nombre de paramètres de M3Pro à environ 3 000 milliards le 26 août.

OpenAI dévoile sa puce d’IA Jalapeño, à l’efficacité de pointe dans l’industrie

OpenAI a annoncé mardi sa première puce d’IA, la Jalapeño, affirmant qu’elle offre une vitesse et une efficacité de pointe dans le secteur pour les charges de travail d’inférence. La puce est développée avec Broadcom et sera déployée au sein de l’infrastructure informatique d’OpenAI d’ici la fin de l’année. Des analystes du secteur ont déclaré à CNBC que les semi-conducteurs conçus sur mesure par OpenAI et d’autres géants de la technologie menacent le quasi-monopole de Nvidia sur les puces d’IA
OliverGrant·08-26 13:37
OpenAI dévoile sa puce d’IA Jalapeño, à l’efficacité de pointe dans l’industrie

OpenAI dévoile sa puce d’IA Jalapeño, menaçant l’efficacité des systèmes d’inférence de Nvidia

Selon plusieurs analystes interrogés par CNBC, OpenAI a dévoilé mardi sa puce d’IA Jalapeño, marquant une première étape vers la réduction de sa dépendance aux GPU de NVIDIA. Cette puce conçue sur mesure, destinée aux charges de travail d’inférence, offre une vitesse et une efficacité de pointe comparables à celles des GPU de la gamme Blackwell de NVIDIA. Adrien Sanchez, analyste technologique chez Yole Group, a déclaré à CNBC que Jalapeño représente « une menace pour les marges de NVIDIA dans l
NVDA0,81 %
AVGO0,11 %
GateNews·08-26 13:35
OpenAI dévoile sa puce d’IA Jalapeño, menaçant l’efficacité des systèmes d’inférence de Nvidia

Broadcom obtient une recommandation de surperformance de la part de BMO, avec un objectif de cours de 455 dollars.

Selon BMO Capital Markets, Broadcom a reçu une recommandation « Surperformance » et un objectif de cours de 455 dollars après l’initiation de la couverture par la banque d’investissement. Par ailleurs, Broadcom est en discussions pour lever plus de 60 milliards de dollars de financement par emprunt afin de proposer des puces d’IA à des clients, dont Anthropic, le financement potentiel pouvant atteindre 100 milliards de dollars.
AVGO0,11 %
BMO-0,63 %
GateNews·08-26 13:31
Broadcom obtient une recommandation de surperformance de la part de BMO, avec un objectif de cours de 455 dollars.

MiniMax accélère l’adaptation des puces nationales M3 et H3 ; un cluster de GPU de grande envergure sera bientôt mis en service.

Selon PANews, qui cite la conférence téléphonique de MiniMax sur ses résultats du premier semestre, tenue le 26 août, l’entreprise accélère l’adaptation de ses modèles M3 et H3 aux puces chinoises. Un vaste cluster de GPU chinois sera bientôt déployé et prendra progressivement en charge le trafic de production réel.
GateNews·08-26 13:30
MiniMax accélère l’adaptation des puces nationales M3 et H3 ; un cluster de GPU de grande envergure sera bientôt mis en service.

Le nombre d’utilisateurs quotidiens de l’API B.AI atteint 23 432, tandis que le débit de tokens bondit à 594,71 milliards le 25 août, établissant dans les deux cas de nouveaux plus hauts historiques.

Selon B.AI, le 25 août, le nombre quotidien de nouveaux utilisateurs de l’API de la plateforme a atteint 23 432, un record historique, tandis que le volume quotidien de tokens a bondi à 594,71 milliards, établissant lui aussi un nouveau record. Au cours de la même période, B.AI a enregistré 79 500 nouveaux utilisateurs de l’API, traité 74,108 millions d’appels de tokens et géré plus de 3 000 milliards de tokens cumulés sur sa plateforme d’infrastructure AGI tout-en-un.
GateNews·08-26 13:16
Le nombre d’utilisateurs quotidiens de l’API B.AI atteint 23 432, tandis que le débit de tokens bondit à 594,71 milliards le 25 août, établissant dans les deux cas de nouveaux plus hauts historiques.

Musk révèle que la puce AI5 de Tesla offre une efficacité énergétique 2 à 3 fois supérieure à celle de NVIDIA, pour seulement 10 % du coût.

Selon Wccftech, le PDG de Tesla, Elon Musk, a récemment partagé des informations sur l’évolution de la puce AI5 de l’entreprise, destinée à l’inférence IA, lors d’une discussion avec le gestionnaire de fonds spéculatifs Ron Baron. La conception de l’AI5 a été finalisée en avril et sa production est désormais assurée par Samsung Electronics. Elle offre, pour les charges de travail d’inférence automobile et robotique, des performances par watt 2 à 3 fois supérieures à celles des puces de NVIDIA, t
TSLA0,40 %
NVDA0,81 %
GateNews·08-26 13:13
Musk révèle que la puce AI5 de Tesla offre une efficacité énergétique 2 à 3 fois supérieure à celle de NVIDIA, pour seulement 10 % du coût.

Moonshot AI discute avec Microsoft, Amazon et Google du partage des revenus générés par Kimi K3

La start-up chinoise spécialisée dans l’IA Moonshot AI est en discussions préliminaires avec Microsoft, Amazon et Google au sujet d’accords de partage des revenus pour son modèle Kimi K3. La start-up soutenue par Alibaba cherche à obtenir jusqu’à 30 % des revenus générés par les services liés à K3 fonctionnant sur Microsoft Azure, Amazon Web Services et Google Cloud, selon Reuters. Les discussions restent préliminaires, et la répartition des revenus, l’accès aux données ainsi que l’audit de l’ut
MSFT-1,36 %
AMZN-1,02 %
NVDA0,81 %
BABA-1,90 %
OliverGrant·08-26 12:51
Moonshot AI discute avec Microsoft, Amazon et Google du partage des revenus générés par Kimi K3

Samsung Electro-Mechanics arrive en tête de l’ETF TIGER AI, avec une pondération de 23,96 %, alors que les prix des MLCC augmentent de plus de 30 %

L’ETF TIGER AI Semiconductor Core Process de Mirae Asset Asset Management détient 23,96 % de Samsung Electro-Mechanics, soit la plus forte pondération de ce fabricant de composants parmi les ETF coréens de la chaîne d’approvisionnement des semi-conducteurs, selon les données au 19. Jeong Eui-hyeon, responsable de la division ETF de Mirae Asset, a déclaré lors d’un webinaire diffusé sur YouTube le 26 que la marge opérationnelle des entreprises de matériaux, de composants et d’équipements devrait
LucasBennett·08-26 12:45
Samsung Electro-Mechanics arrive en tête de l’ETF TIGER AI, avec une pondération de 23,96 %, alors que les prix des MLCC augmentent de plus de 30 %

Samsung Electro-Mechanics atteint une pondération de 23,96 % dans l’ETF TIGER AI Semiconductor ; les prix des MLCC augmentent de 30 % en août

Selon Yonhap Infomax, au 26 août, l’ETF TIGER AI Semiconductor Core de Mirae Asset détenait Samsung Electro-Mechanics (23,96 %) comme principale position, suivi de LG Innotek (17,03 %) et d’I.S. WIS (16,75 %). Le gestionnaire de l’ETF a indiqué que les prix des MLCC avaient augmenté d’environ 10 % en juin, avant de bondir de plus de 30 % supplémentaires en août, sous l’effet de la demande croissante des serveurs d’IA. Mirae Asset prévoit que les entreprises de la chaîne d’approvisionnement des s
GateNews·08-26 12:44
Samsung Electro-Mechanics atteint une pondération de 23,96 % dans l’ETF TIGER AI Semiconductor ; les prix des MLCC augmentent de 30 % en août

Qwen, la division IA d’Alibaba, lance le modèle Qwen3.8-Flash doté de 125 milliards de paramètres, au tarif de 0,16 dollar par million de tokens d’entrée.

Selon PANews, Qwen, le modèle d’Alibaba, a lancé aujourd’hui Qwen3.8-Flash, un aperçu préliminaire de l’architecture Qwen4. Ce modèle multimodal à architecture de mélange d’experts comprend 125 milliards de paramètres, dont 51 milliards de paramètres d’intégration de n-grammes, tandis que seuls 6 milliards de paramètres sont activés pour chaque token, ce qui lui confère une grande rentabilité. La version de production sera disponible via l’API Qwen Cloud au tarif de 0,16 dollar par million de to
GateNews·08-26 12:42
Qwen, la division IA d’Alibaba, lance le modèle Qwen3.8-Flash doté de 125 milliards de paramètres, au tarif de 0,16 dollar par million de tokens d’entrée.

Alibaba lance Qwen3.8-Flash, doté de 6 milliards de paramètres actifs, qui surpasse Opus 4.6 dans plusieurs benchmarks d’agents.

Selon Beating AI, Alibaba a lancé aujourd’hui Qwen3.8-Flash, dont les poids open source sont également disponibles sous le nom Qwen3.8-Flash-Next, avec l’architecture Qwen4 de nouvelle génération. Ce modèle MoE multimodal compte au total 125 milliards de paramètres, dont seulement 6 milliards sont activés, ainsi que 51 milliards d’embeddings N-gram destinés à optimiser l’utilisation de la mémoire. Dans les benchmarks officiels, Qwen3.8-Flash a obtenu 9,1 points de plus que Claude Opus 4.6 sur SW
BABA-1,90 %
GateNews·08-26 12:41
Alibaba lance Qwen3.8-Flash, doté de 6 milliards de paramètres actifs, qui surpasse Opus 4.6 dans plusieurs benchmarks d’agents.