<?xml version="1.0" encoding="utf-8" standalone="yes"?>
<rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom">
  <channel>
    <title>Batching on Nalar</title>
    <link>https://nalar.dev/id/tags/batching/</link>
    <description>Recent content in Batching on Nalar</description>
    <generator>Hugo</generator>
    <language>id-id</language>
    <lastBuildDate>Wed, 16 Sep 2026 00:00:00 +0000</lastBuildDate>
    <atom:link href="https://nalar.dev/id/tags/batching/index.xml" rel="self" type="application/rss+xml" />
    <item>
      <title>Kelompokkan Panjang Sequence untuk Mengurangi Padding yang Terbuang</title>
      <link>https://nalar.dev/id/kelompokkan-panjang-sequence-untuk-mengurangi-padding-yang-terbuang/</link>
      <pubDate>Wed, 16 Sep 2026 00:00:00 +0000</pubDate>
      <guid>https://nalar.dev/id/kelompokkan-panjang-sequence-untuk-mengurangi-padding-yang-terbuang/</guid>
      <description>&lt;p&gt;Batch berpadding dibentuk oleh sequence terpanjang, bukan panjang rata-ratanya. Jika sebuah batch berisi jumlah token &lt;code&gt;120&lt;/code&gt;, &lt;code&gt;124&lt;/code&gt;, &lt;code&gt;131&lt;/code&gt;, dan &lt;code&gt;900&lt;/code&gt;, setiap sequence dapat direpresentasikan dengan panjang &lt;code&gt;900&lt;/code&gt;. Sebagian besar posisi pada tiga baris pertama kemudian berisi padding, bukan token input.&lt;/p&gt;&#xA;&lt;p&gt;Length bucketing mengubah komposisi batch tanpa mengubah model. Contoh dengan jumlah token serupa ditempatkan berdekatan sebelum batch dibentuk. Panjang maksimum dalam setiap batch menjadi lebih dekat dengan panjang anggotanya, sehingga jumlah posisi padding yang diproses oleh operasi yang masih memakai bentuk batch persegi panjang berkurang.&lt;/p&gt;</description>
    </item>
  </channel>
</rss>
