← Volver al ranking

Similares a Performance Optimization and Software/Hardware Co-design across PyTorch, CUDA, and NVIDIA GPUs

20 vecinos (text_768) · 669 views · MLOps.community · Reino Unido

★Performance Optimization and Software/Hardware Co-design across PyTorch, CUDA, and NVIDIA GPUs

MLOps.community

@mlops

669Reino Unido
10Let's Build Pipeline Parallelism from Scratch – Tutorial

freeCodeCamp.org

@freecodecamp

—Estados Unidos88
13Coordinating Secure GPU-Accelerated Agents with Foundry Control Plane on Azure [APAC]

Microsoft Reactor

@microsoftreactor

——88
1Lessons From Training Composer At Cursor And Building Meta/Nvidia Compute Clusters | YC Paper Club

Y Combinator

@ycombinator

68.6KEstados Unidos90
19Optimizing the Full Stack for Generative Image and Video Models

MIT OpenCourseWare

@mitocw

12.1KEstados Unidos87
9Every AI Company Runs on NVIDIA Because of One Decision Made in 2006!

Manav

@manavgolecha

6.0KEstados Unidos88
15WWDC26: Optimize custom machine learning operations with Metal tensors | Apple

Apple Developer

@appledeveloper

4.7K—88
4Stanford CS25: Transformers United V6 I The Ultra-Scale Talk: Scaling Training to Thousands of GPUs

Stanford Online

@stanfordonline

4.6KEstados Unidos89
20Data Science Gamechanger?

Rob Mulla

@robmulla

2.5KEstados Unidos87
18Passer à la vitesse supérieure : Optimisation avancée de l'apprentissage (épisode 18)

CNRS - Formation FIDLE

@cnrs-fidle

1.2KFrancia87
17How We Cut LLM Latency 70% With TensorRT in Production

MLOps.community

@mlops

697Reino Unido87
2Fixing GPU Starvation in Large-Scale Distributed Training

MLOps.community

@mlops

321Reino Unido89
7The MATH of Running Humanity on GPUs (It's Cheap!)

Finxter AI Nuggets

@finxter

138Alemania88
14Edge Driven Generative AI Hardware Poised to Redefine Real Time Design

new technology insights

@newtechnologyinsights-i9o

135—88
11Quantum Gradient Descent Accelerating Machine Learning Beyond Classical Computational Hardware Limit

NobleX Infinity Labs®️

@noblexinfinitylabs

108India88
8LOCA series: TuRTLe: Artificial Intelligence for Chip Design research at BSC

BSC CNS

@bsccns

73España88
6The Real AI Bottleneck It’s Not GPUs It’s Memory Design and Math

NextGen Science

@thenextgenscience

67Estados Unidos88
5Optimize GPU Geometry with meshoptimizer: Complete Pipeline Explained

Alex Hitt

@alexander-hitt

57Estados Unidos88
12LOCA series: Optimal Silicon Efficiency in Servers

BSC CNS

@bsccns

43España88
16Understanding GPUs, TPUs, NPUs, and specialized AI chips (10 Minutes)

Microlearning Daily

@microlearningdaily

31Singapur87
3Showcasing WASM GPU Offload APIs

Intel Open Source

@intelopensource

4Estados Unidos89