ایبوک دات آی آر
پرفروش‌ترین کتاب‌ها
دانلود کتاب Hands-On LLM Serving and Optimization 2026 به زبان انگلیسی

دانلود کتاب Hands-On LLM Serving and Optimization 2026

180,000 تومان

موضوع

نوع فایل
PDF

حجم فایل : 13 مگابایت

مصور
بلی

زبان
انگلیسی

تعداد صفحات
۳۰۰ الی ۴۰۰

تاریخ انتشار

انتشارات

کتاب‌های اصل

بدون تغییر

دانلود آنی

پس از پرداخت

پرداخت امن

درگاه‌های معتبر

ضمانت برگشت

در صورت مغایرت

تجربه خرید آسان

حتی بدون عضویت

اطمینان در خرید

ما عاشق کتابیم

تخفیف‌های ویژه

به عاشقان کتاب

دانلود کتاب Hands-On LLM Serving and Optimization 2026 به زبان انگلیسی

دانلود کتاب Hands-On LLM Serving and Optimization 2026 به زبان انگلیسی

دانلود کتاب Hands-On LLM Serving and Optimization 2026 به زبان انگلیسی

نویسنده: Chi Wang (چی وانگ) و همکاران

موضوع: آموزشی، پردازش زبان طبیعی، هوش مصنوعی، توسعه نرم‌افزار، عملیات یادگیری ماشین (MLOps)

صفحات: 378 صفحه

فرمت: PDF

سال انتشار: 2026

انتشارات: O’Reilly Media

ایبوک

=========================

 

خلاصه فارسی کتاب Hands-On LLM Serving and Optimization 2026

این کتاب یک راهنمای جامع و مهندسی‌محور برای استقرار و بهینه‌سازی مدل‌های زبانی بزرگ (LLM) در مقیاس سازمانی است. با ورود به «عصر استنتاج» (Inference Era)، کتاب به چالش‌های هزینه و کندی سرویس‌دهی LLMها می‌پردازد و استراتژی‌های عملی و همراه با کد برای ساخت سیستم‌های مقرون‌به‌صرفه و با کارایی بالا (AI token factories) ارائه می‌دهد.

مباحث کلیدی شامل مبانی سرویس‌دهی مدل، ایجاد تعادل بین تاخیر (Latency) و توان عملیاتی (Throughput)، و به‌کارگیری تکنیک‌های بهینه‌سازی پیشرفته مانند Quantization، Kernel Fusion، Continuous Batching، Prefix Caching و Speculative Decoding است. این کتاب برای مهندسان ML/AI، توسعه‌دهندگان بک‌اند و معماران سیستمی که وظیفه مدیریت زیرساخت‌های استنتاج یا پلتفرم‌های RAG و عامل‌های هوشمند را بر عهده دارند، ایده‌آل است1. ایبوک

=========================

خلاصه انگلیسی کتاب Hands-On LLM Serving and Optimization 2026

A comprehensive, engineering-focused guide to deploying and optimizing Large Language Models (LLMs) at scale. Emphasizing the “inference era,” the book tackles the cost and latency complexities of LLM hosting, providing practical, code-backed strategies for building robust, performant, and cost-efficient “AI token factories.”

Key topics include the foundations of model serving, balancing latency and throughput, and applying core optimization techniques such as batching, quantization, kernel fusion, continuous batching, prefix caching, and speculative decoding. It is designed for ML/AI engineers, backend developers, and system architects responsible for building or scaling inference infrastructures, RAG pipelines, and agentic platforms1. ایبوک

✔️کتاب‌های اصل و باکیفیت : تمامی کتاب‌ها اورجینال و بدون هیچگونه تغییرات می‌باشند.

✔️ضمانت بازگشت وجه : درصورت هرگونه مغایرتی وظیفه ما در ابتدا تهیه و جایگزینی نسخه صحیح است. در غیر اینصورت کل مبلغ بدون قید و شرط و بلافاصله عودت داده می‌شود.

✔️تفاوت تعداد صفحات : تفاوت تعداد صفحات بدلیل اندازه فونت و حاشیه صفحات بوده و تمامی کتاب‌ها اصل و بدون هیچگونه تغییری در اختیار شما قرار می‌گیرند.

دیدگاهها

هیچ دیدگاهی برای این محصول نوشته نشده است.

اولین نفری باشید که دیدگاهی را ارسال می کنید برای “دانلود کتاب Hands-On LLM Serving and Optimization 2026”

۳۰٪ تخفیف اولین خرید! کد: NEWUSER