vLLM and High-Performance Inference: Memory Optimization, Parallel Execution, Token Streaming, Scalable Model Serving (Large Language Refinement Inference Series, Band 2)

Preise von
16,90

Hervorgehoben

ALLE WEBSHOPS VERGLEICHEN (2)

Beschreibung

Amazon vLLM and High-Performance Inference: Memory Optimization, Parallel Execution, Token Streaming, and Scalable Model Serving (Large Language Model Refinement and Inference Series, Band 2)

Webshops vergleichen (2)

Shop
Preis
Versandkosten
Total price
16,90 
Gratis
16,90 
Zum Shop
Gratis Shipping Costs
16,90 
Gratis
16,90 
Zum Shop
Gratis Shipping Costs
Beschreibung (1)

vLLM and High-Performance Inference: Memory Optimization, Parallel Execution, Token Streaming, and Scalable Model Serving (Large Language Model Refinement and Inference Series, Band 2)


Produktspezifikationen

Marken Independently Published
EAN
  • 9798195860981

Hervorgehobene Wahl
16,90 
Zum Shop