<?xml version="1.0" encoding="utf-8" standalone="yes"?>
<rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom">
  <channel>
    <title>Quantization on KAD</title>
    <link>https://www.kad8.com/tags/quantization/</link>
    <description>Recent content in Quantization on KAD</description>
    <generator>Hugo -- gohugo.io</generator>
    <language>en</language>
    <copyright>© 2026 </copyright>
    <lastBuildDate>Sat, 16 May 2026 23:58:20 +0800</lastBuildDate><atom:link href="https://www.kad8.com/tags/quantization/index.xml" rel="self" type="application/rss+xml" />
    <item>
      <title>Tencent Hunyuan Launches Offline Smartphone Translation Model Hy-MT1.5</title>
      <link>https://www.kad8.com/ai/tencent-hunyuan-launches-offline-smartphone-translation-model-hy-mt1.5/</link>
      <pubDate>Sat, 16 May 2026 23:58:20 +0800</pubDate>
      
      <guid>https://www.kad8.com/ai/tencent-hunyuan-launches-offline-smartphone-translation-model-hy-mt1.5/</guid>
      <description>&lt;blockquote&gt;
&lt;p&gt;Tencent Hunyuan Launches Offline Smartphone Translation Model Hy-MT1.5&lt;/p&gt;&lt;/blockquote&gt;


&lt;h2 class=&#34;relative group&#34;&gt;📱 High-Performance Offline Translation for Smartphones 
    &lt;div id=&#34;-high-performance-offline-translation-for-smartphones&#34; class=&#34;anchor&#34;&gt;&lt;/div&gt;
    
    &lt;span
        class=&#34;absolute top-0 w-6 transition-opacity opacity-0 ltr:-left-6 rtl:-right-6 not-prose group-hover:opacity-100&#34;&gt;
        &lt;a class=&#34;group-hover:text-primary-300 dark:group-hover:text-neutral-700&#34;
            style=&#34;text-decoration-line: none !important;&#34; href=&#34;#-high-performance-offline-translation-for-smartphones&#34; aria-label=&#34;Anchor&#34;&gt;#&lt;/a&gt;
    &lt;/span&gt;        
    
&lt;/h2&gt;
&lt;p&gt;Most translation tools require internet connectivity, leaving users vulnerable in critical situations. Tencent Hunyuan addresses this limitation with &lt;strong&gt;Hy-MT1.5-1.8B-1.25bit&lt;/strong&gt;, a highly compressed translation model supporting 33 languages. At just 440MB, it runs entirely offline on mobile devices, delivering translation quality surpassing Google Translate.&lt;/p&gt;</description>
      <media:content xmlns:media="http://search.yahoo.com/mrss/" url="https://www.kad8.com/ai/tencent-hunyuan-launches-offline-smartphone-translation-model-hy-mt1.5/featured-Tencent-Hunyuan-launches-off-line-smartphone-translation-model.jpeg" />
    </item>
    
    <item>
      <title>TurboQuant Explained: Google’s Breakthrough in AI Memory Compression</title>
      <link>https://www.kad8.com/ai/turboquant-explained-googles-breakthrough-in-ai-memory-compression/</link>
      <pubDate>Tue, 14 Apr 2026 23:36:43 +0800</pubDate>
      
      <guid>https://www.kad8.com/ai/turboquant-explained-googles-breakthrough-in-ai-memory-compression/</guid>
      <description>&lt;blockquote&gt;
&lt;p&gt;TurboQuant Explained: Google’s Breakthrough in AI Memory Compression&lt;/p&gt;&lt;/blockquote&gt;
&lt;p&gt;Google’s &lt;strong&gt;TurboQuant&lt;/strong&gt; introduces a fundamentally new approach to one of the biggest bottlenecks in modern AI systems: the &lt;strong&gt;KV Cache (Key-Value Cache)&lt;/strong&gt;.&lt;/p&gt;</description>
      <media:content xmlns:media="http://search.yahoo.com/mrss/" url="https://www.kad8.com/ai/turboquant-explained-googles-breakthrough-in-ai-memory-compression/featured-TurboQuant_compresses_KV.jpeg" />
    </item>
    
  </channel>
</rss>
