<?xml version="1.0" encoding="utf-8" standalone="yes"?>
<rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom">
  <channel>
    <title>Квантизация on Digitable courses</title>
    <link>https://courses.digitable.life/tags/%D0%BA%D0%B2%D0%B0%D0%BD%D1%82%D0%B8%D0%B7%D0%B0%D1%86%D0%B8%D1%8F/</link>
    <description>Recent content in Квантизация on Digitable courses</description>
    <generator>Hugo</generator>
    <language>ru-RU</language>
    <lastBuildDate>Sat, 01 Aug 2026 00:12:59 +0300</lastBuildDate>
    <atom:link href="https://courses.digitable.life/tags/%D0%BA%D0%B2%D0%B0%D0%BD%D1%82%D0%B8%D0%B7%D0%B0%D1%86%D0%B8%D1%8F/index.xml" rel="self" type="application/rss+xml" />
    <item>
      <title>Инференс и деплой: квантизация, дистилляция, сервинг</title>
      <link>https://courses.digitable.life/post/neural-networks/10-inference-and-deployment/</link>
      <pubDate>Thu, 16 Jul 2026 10:00:00 +0300</pubDate>
      <guid>https://courses.digitable.life/post/neural-networks/10-inference-and-deployment/</guid>
      <description>Как превратить обученную модель в дешёвый и предсказуемый сервис: roofline-анализ узких мест, квантизация от математики до INT4, дистилляция, прунинг, компиляция графа, архитектура сервинга и безопасный роллаут.</description>
    </item>
    <item>
      <title>Локальные модели: llama.cpp, Ollama, vLLM, LM Studio, квантизация, требования к железу</title>
      <link>https://courses.digitable.life/post/ai-engineering/11-local-models/</link>
      <pubDate>Thu, 16 Jul 2026 10:00:00 +0300</pubDate>
      <guid>https://courses.digitable.life/post/ai-engineering/11-local-models/</guid>
      <description>Арифметика VRAM и пропускной способности памяти, честная экономика своего GPU против API, как устроена квантизация и что она ломает, четыре рантайма и их ниши, продакшн-конфиги и замеры.</description>
    </item>
  </channel>
</rss>
