PucesPuces
NVIDIA publie Switchyard, un proxy Rust pour le trafic des modèles de langage
NVIDIA a présenté un projet Rust précoce pour le routage et la traduction des requêtes entre les API OpenAI et Anthropic.
Sujet
Compute hardware for AI: accelerators, processors, memory and networking. We follow vendor announcements, data-centre deployments and how hardware constraints shape the economics of training and inference.
Sujet
Sujet principal dans 55 articles sur 55
PucesPuces
NVIDIA a présenté un projet Rust précoce pour le routage et la traduction des requêtes entre les API OpenAI et Anthropic.
PucesPuces
NVIDIA décrit TensorRT Model Connect comme un ensemble de références visant à simplifier le parcours allant du point de contrôle d'un modèle ouvert jusqu'à l'inférence.
PucesPuces
NVIDIA décrit une approche pour la cybersécurité adaptative, mais les données disponibles ne dévoilent pas ses résultats et les détails de mise en œuvre.
PucesPuces
NVIDIA décrit le lancement d’outils pour la prévision de la structure des protéines dans Claude Science, mais les données disponibles ne révèlent pas les résultats et les conditions d’utilisation.
PucesPuces
CXMT lance pour la première fois des puces HBM3E en petites séries, mais l'ampleur et la readiness des livraisons ne sont pas encore révélées.
PucesPuces
Nvidia injectera 3,5 milliards de dollars dans MediaTek alors que les grandes entreprises technologiques développent leurs propres puces d'IA.
PucesPuces
La nouvelle efficacité des systèmes pour les centres de données est liée à la gestion des flux de données, et non uniquement à la puissance de calcul.
PucesPuces
Neocloud Lambda dirigera les fonds empruntés vers l'achat de puces Nvidia pour les louer à Microsoft.
PucesPuces
Databricks décrit une approche d'entraînement PyTorch conçue pour des pannes régulières dans des environnements GPU.
PucesPuces
OpenAI et MHESI ont lancé en Thaïlande un programme de huit semaines pour 10 startups dans les domaines de la santé, du bien-être et de l’éducation.
PucesPuces
Nvidia achète Hugging Face pour 12,9 milliards de dollars sur fond de concurrence autour des modèles d’IA ouverts
PucesPuces
TechCrunch AI rapporte l'achat consenti d'une plateforme d'IA open source pour 12,9 milliards de dollars, mais aucune confirmation primaire n’existe.
PucesPuces
NVIDIA a associé l'extension de NVLink Fusion à la mémoire personnalisée NVHBM face à la croissance des exigences en matière d'infrastructure d'IA.
PucesPuces
NVIDIA a décrit Shadow Engine Recovery pour restaurer la capacité d'inférence après une défaillance du processus LLM, mais les données techniques détaillées ne sont pas encore disponibles.
PucesPuces
La puce personnalisée d'OpenAI a montré de meilleurs résultats que les puces Nvidia Blackwell et Rubin lors de tests rapportés par The Decoder.
PucesPuces
NVIDIA associe Vera Rubin et Blackwell à une nouvelle norme d'efficacité énergétique pour les systèmes d'IA agentiques, mais les mesures ne sont pas divulguées.
PucesPuces
TechCrunch AI a associé la nouvelle puce d'OpenAI aux résultats du test InferenceX, mais les détails de la méthodologie font encore défaut.
PucesPuces
NVIDIA relie l'économie des usines d'IA à l'efficacité de l'ensemble de l'infrastructure
PucesPuces
NVIDIA revendique un avantage significatif en matière d'efficacité pour le système Vera Rubin NVL72, mais la méthodologie de comparaison n'est pas divulguée dans les données disponibles.
PucesPuces
NVIDIA a lié l'efficacité des parcs informatiques pour les tâches agentiques au rôle des processeurs centraux et à la variabilité des charges.
PucesPuces
NVIDIA décrit Groq 3 LPX comme un accélérateur d'inférence IA interactive pour la plateforme Vera Rubin, mais aucune mesure ni confirmation indépendante n'est présentée.
PucesPuces
Intel a associé trois architectures à la mise à l'échelle de l'IA agentive, des baies de serveurs aux périphériques.
PucesPuces
Nvidia a montré le rôle du pré-entraînement dans le fonctionnement des systèmes d'IA
PucesPuces
NVIDIA Developer Blog indique l’importance croissante de la sécurité et de la confiance dans les applications qui utilisent des IA plus puissantes.