GPU Kernel Engineering for LLM Inference: CUDA, Triton, and Flash Attention Optimization High-Throughput AI Production Systems

Prix à partir de
9,25

En vedette

COMPARER TOUS LES MAGASINS EN LIGNE (2)

Description

GPU Kernel Engineering for LLM Inference: CUDA, Triton, and Flash Attention Optimization High-Throughput AI Production Systems

Comparer les boutiques en ligne (2)

Trier par:

9,25 € Livraison gratuite

9,25 € Livraison gratuite

Description (0)

GPU Kernel Engineering for LLM Inference: CUDA, Triton, and Flash Attention Optimization High-Throughput AI Production Systems


Spécifications du produit

Marque Independently Published
EAN
  • 9798185800379

Choix en vedette
9,25 €
Voir l’offre