Volver al ranking

Similares a Hyperparameter Tuning Tips that 99% of Data Scientists Overlook

20 vecinos (text_768) · 5.7K views · Rob Mulla · Estados Unidos

Hyperparameter Tuning Tips that 99% of Data Scientists Overlook

Rob Mulla

@robmulla

5.7KEstados Unidos
13What is a Supercomputer for AI? How GPUs Drive Machine Learning

IBM Technology

@ibmtechnology

77.3KEstados Unidos85
155 tips for OpenClaw

Greg Isenberg

@gregisenberg

65.6KEstados Unidos84
17Analyzing Deepseek's "undefined" NVIDIA PTX optimizations (with benchmarks!)

LaurieWired

@lauriewired

24.1KEstados Unidos84
14I built a GPT model in 10 hours

Looking Glass Universe

@lookingglassuniverse

18.1K84
10Let’s Train YOLO26 Locally on NVIDIA DGX Spark

Nicolai Nielsen

@nicolaiai

7.4KDinamarca85
8Lec 07. Scaling Rules for Optimization

MIT OpenCourseWare

@mitocw

5.9KEstados Unidos85
7Stanford CS25: Transformers United V6 I The Ultra-Scale Talk: Scaling Training to Thousands of GPUs

Stanford Online

@stanfordonline

4.6KEstados Unidos85
11Understanding Model Predictions with SHAP - XGBoost vs Neural Networks (375)

DigitalSreeni

@digitalsreeni

3.1KEstados Unidos85
19Keras 3 Distributed Training: Scaling Models with JAX using DataParallel, and ModelParallel

Google for Developers

@googledevelopers

3.1KEstados Unidos84
2Data Science Gamechanger?

Rob Mulla

@robmulla

2.5KEstados Unidos86
1μTransfer: Tuning GPT-3 hyperparameters on one GPU | Explained by the inventor

Edward Hu

@edwardjhu

1.6K88
5LoRA - Explained!

CodeEmporium

@codeemporium

1.3KEstados Unidos85
16120 Billion Parameters: The Model Size Debate Explained! #shorts

Pew Moments

@pewmoments90210

1.1K84
3Performance Optimization and Software/Hardware Co-design across PyTorch, CUDA, and NVIDIA GPUs

MLOps.community

@mlops

669Reino Unido86
4NVIDIA DGX Spark™ Review: Better Than Renting an H100? (2026)

Savage Reviews

@savagereviewsofficial

563Estados Unidos86
18LLM (Parameter Efficient) Fine Tuning - Explained!

CodeEmporium

@codeemporium

558Estados Unidos84
20Fixing GPU Starvation in Large-Scale Distributed Training

MLOps.community

@mlops

321Reino Unido84
6Track robotics training dynamics in Weights & Biases

Weights & Biases

@weightsbiases

284Estados Unidos85
9Boost Your GPU Performance with These HIDDEN Tips! #shorts #windows10

Tech Bytes

@techbytes-13-v4b

194India85
12Optimize GPU Geometry with meshoptimizer: Complete Pipeline Explained

Alex Hitt

@alexander-hitt

57Estados Unidos85