PucesPuces
Perplexity a dévoilé une pile GPU pour les embeddings pplx-embed
MarkTechPost a lié les trois composants nommés au service pplx-embed, mais les détails de mise en œuvre ne sont pas encore confirmés.
Sujet
Compute hardware for AI: accelerators, processors, memory and networking. We follow vendor announcements, data-centre deployments and how hardware constraints shape the economics of training and inference.
Sujet
Sujet principal dans 67 articles sur 67
PucesPuces
MarkTechPost a lié les trois composants nommés au service pplx-embed, mais les détails de mise en œuvre ne sont pas encore confirmés.
PucesPuces
Hermes Desktop automatise la sélection, le téléchargement et l'installation de base du modèle local pour la carte graphique de l'utilisateur.
PucesPuces
NVIDIA Developer Blog a lié NemoClaw à la tâche de travailler avec un contexte d'entreprise en évolution.
PucesPuces
NVIDIA a annoncé un document concernant le déploiement et l'optimisation de modèles sur les appareils périphériques Jetson.
PucesPuces
AWS décrit un pipeline pour le Physical AI sur SageMaker HyperPod et Amazon EKS avec une évaluation du rendement utile des GPU.
PucesPuces
John Ternus a pris la tête d'Apple suite au départ de Tim Cook et se retrouve immédiatement confronté à la préparation d'un lancement majeur.
PucesPuces
DeepSeek prévoit un important cluster Huawei pour l'inférence, mais les livraisons pourraient être retardées de plus d'un an.
PucesPuces
NVIDIA a annoncé une collaboration avec Microsoft et des partenaires pour le lancement local de l'IA sur le matériel NVIDIA.
PucesPuces
Nvidia a présenté un outil logiciel open source permettant de regrouper des ordinateurs domestiques compatibles en une ressource de calcul locale pour l'IA.
PucesPuces
NVIDIA associe le Virtual Inference Router à la répartition de charge sur le réseau local, mais les détails techniques ne sont pas encore révélés.
Puces
Nvidia prévoit d'acheter Hugging Face pour $12,9 milliards
PucesPuces
NVIDIA a présenté un projet Rust précoce pour le routage et la traduction des requêtes entre les API OpenAI et Anthropic.
PucesPuces
NVIDIA Developer Blog présente un matériel sur l'application pratique de CUDA, mais les détails d'optimisation dans l'extrait disponible ne sont pas révélés.
PucesPuces
NVIDIA décrit TensorRT Model Connect comme un ensemble de références visant à simplifier le parcours allant du point de contrôle d'un modèle ouvert jusqu'à l'inférence.
PucesPuces
NVIDIA décrit une approche pour la cybersécurité adaptative, mais les données disponibles ne dévoilent pas ses résultats et les détails de mise en œuvre.
PucesPuces
NVIDIA décrit le lancement d’outils pour la prévision de la structure des protéines dans Claude Science, mais les données disponibles ne révèlent pas les résultats et les conditions d’utilisation.
PucesPuces
CXMT lance pour la première fois des puces HBM3E en petites séries, mais l'ampleur et la readiness des livraisons ne sont pas encore révélées.
PucesPuces
Nvidia injectera 3,5 milliards de dollars dans MediaTek alors que les grandes entreprises technologiques développent leurs propres puces d'IA.
PucesPuces
La nouvelle efficacité des systèmes pour les centres de données est liée à la gestion des flux de données, et non uniquement à la puissance de calcul.
PucesPuces
Neocloud Lambda dirigera les fonds empruntés vers l'achat de puces Nvidia pour les louer à Microsoft.
PucesPuces
Databricks décrit une approche d'entraînement PyTorch conçue pour des pannes régulières dans des environnements GPU.
PucesPuces
OpenAI et MHESI ont lancé en Thaïlande un programme de huit semaines pour 10 startups dans les domaines de la santé, du bien-être et de l’éducation.
PucesPuces
Nvidia achète Hugging Face pour 12,9 milliards de dollars sur fond de concurrence autour des modèles d’IA ouverts
PucesPuces
TechCrunch AI rapporte l'achat consenti d'une plateforme d'IA open source pour 12,9 milliards de dollars, mais aucune confirmation primaire n’existe.