<?xml version="1.0" encoding="utf-8" standalone="yes"?>
<rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom">
  <channel>
    <title>RAG on Nalar</title>
    <link>https://nalar.dev/id/tags/rag/</link>
    <description>Recent content in RAG on Nalar</description>
    <generator>Hugo</generator>
    <language>id-id</language>
    <lastBuildDate>Wed, 02 Sep 2026 00:00:00 +0000</lastBuildDate>
    <atom:link href="https://nalar.dev/id/tags/rag/index.xml" rel="self" type="application/rss+xml" />
    <item>
      <title>Atur Anggaran Context Window LLM Tanpa Kehilangan Instruksi Penting</title>
      <link>https://nalar.dev/id/atur-anggaran-context-window-llm-tanpa-kehilangan-instruksi-penting/</link>
      <pubDate>Wed, 02 Sep 2026 00:00:00 +0000</pubDate>
      <guid>https://nalar.dev/id/atur-anggaran-context-window-llm-tanpa-kehilangan-instruksi-penting/</guid>
      <description>&lt;p&gt;Aplikasi large language model jarang gagal hanya karena prompt kelebihan satu token. Kegagalan biasanya terjadi karena pertumbuhan context ditangani tanpa prioritas. Riwayat chat membesar, retrieval mengembalikan lebih banyak passage, hasil tool menjadi panjang, dan pada akhirnya aplikasi memangkas teks mana pun yang paling mudah dipotong.&lt;/p&gt;&#xA;&lt;p&gt;Desain yang lebih aman memperlakukan context window sebagai anggaran dengan alokasi eksplisit. Tujuannya bukan mengisi setiap token yang tersedia, melainkan mempertahankan informasi yang mengendalikan perilaku sekaligus menyisakan ruang yang cukup untuk jawaban lengkap.&lt;/p&gt;</description>
    </item>
  </channel>
</rss>
