<?xml version="1.0" encoding="UTF-8"?>
<urlset xmlns:xsi="http://www.w3.org/2001/XMLSchema-instance"
        xsi:schemaLocation="http://www.sitemaps.org/schemas/sitemap/0.9 http://www.sitemaps.org/schemas/sitemap/0.9/sitemap.xsd"
        xmlns="http://www.sitemaps.org/schemas/sitemap/0.9"
        xmlns:image="http://www.google.com/schemas/sitemap-image/1.1"
        xmlns:video="http://www.google.com/schemas/sitemap-video/1.1"
        xmlns:news="http://www.google.com/schemas/sitemap-news/0.9"
        xmlns:mobile="http://www.google.com/schemas/sitemap-mobile/1.0"
        xmlns:pagemap="http://www.google.com/schemas/sitemap-pagemap/1.0" xmlns:xhtml="http://www.w3.org/1999/xhtml">
  <url><loc>https://intale.github.io/learn_llm/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/en/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/en/course/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/en/course/00-llm-parts/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/en/course/01-text-units/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/en/course/02-corpus-partitions/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/en/course/03-learn-bpe-merges/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/en/course/04-apply-bpe-tokenizer/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/en/course/05-autoregressive-examples/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/en/course/06-bigram-baseline/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/en/course/07-language-model-metrics/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/en/course/08-tensor-storage/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/en/course/09-tensor-views/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/en/course/10-broadcasting-reductions/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/en/course/11-matrix-multiplication/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/en/course/12-stable-softmax/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/en/course/13-gradient-checking/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/en/course/14-scalar-autodiff/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/en/course/15-tensor-autodiff-core/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/en/course/16-model-autodiff-ops/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/en/course/17-parameter-initialization/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/en/course/18-token-embeddings/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/en/course/19-linear-layers/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/en/course/20-swiglu-feed-forward/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/en/course/21-mini-batches/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/en/course/22-adamw/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/en/course/23-neural-ngram/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/en/course/24-residual-connections/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/en/course/25-rmsnorm/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/en/course/26-qkv-projections/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/en/course/27-self-attention/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/en/course/28-causal-masking/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/en/course/29-rope/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/en/course/30-multi-head-attention/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/en/course/31-decoder-block/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/en/course/32-decoder-model/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/en/course/33-training-selection/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/en/course/34-final-evaluation/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/en/course/35-checkpoints/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/en/course/36-temperature-top-k/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/en/course/37-incremental-attention/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/en/course/38-cached-generation/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/en/course/39-end-to-end-llm/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/ru/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/ru/course/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/ru/course/00-llm-parts/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/ru/course/01-text-units/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/ru/course/02-corpus-partitions/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/ru/course/03-learn-bpe-merges/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/ru/course/04-apply-bpe-tokenizer/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/ru/course/05-autoregressive-examples/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/ru/course/06-bigram-baseline/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/ru/course/07-language-model-metrics/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/ru/course/08-tensor-storage/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/ru/course/09-tensor-views/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/ru/course/10-broadcasting-reductions/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/ru/course/11-matrix-multiplication/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/ru/course/12-stable-softmax/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/ru/course/13-gradient-checking/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/ru/course/14-scalar-autodiff/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/ru/course/15-tensor-autodiff-core/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/ru/course/16-model-autodiff-ops/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/ru/course/17-parameter-initialization/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/ru/course/18-token-embeddings/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/ru/course/19-linear-layers/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/ru/course/20-swiglu-feed-forward/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/ru/course/21-mini-batches/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/ru/course/22-adamw/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/ru/course/23-neural-ngram/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/ru/course/24-residual-connections/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/ru/course/25-rmsnorm/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/ru/course/26-qkv-projections/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/ru/course/27-self-attention/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/ru/course/28-causal-masking/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/ru/course/29-rope/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/ru/course/30-multi-head-attention/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/ru/course/31-decoder-block/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/ru/course/32-decoder-model/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/ru/course/33-training-selection/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/ru/course/34-final-evaluation/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/ru/course/35-checkpoints/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/ru/course/36-temperature-top-k/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/ru/course/37-incremental-attention/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/ru/course/38-cached-generation/</loc></url>
  <url><loc>https://intale.github.io/learn_llm/ru/course/39-end-to-end-llm/</loc></url>
</urlset>
