<?xml version="1.0" encoding="utf-8" standalone="yes"?>
<rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom">
  <channel>
    <title>Computer Vision on KAD</title>
    <link>https://www.kad8.com/tags/computer-vision/</link>
    <description>Recent content in Computer Vision on KAD</description>
    <generator>Hugo -- gohugo.io</generator>
    <language>en</language>
    <copyright>© 2026 </copyright>
    <lastBuildDate>Fri, 21 Aug 2026 22:09:13 +0800</lastBuildDate><atom:link href="https://www.kad8.com/tags/computer-vision/index.xml" rel="self" type="application/rss+xml" />
    <item>
      <title>DeepSeek-V4 Flash Vision Exp Brings Multimodal Agents to Life</title>
      <link>https://www.kad8.com/ai/deepseek-v4-flash-vision-exp-brings-multimodal-agents-to-life/</link>
      <pubDate>Fri, 21 Aug 2026 22:09:13 +0800</pubDate>
      
      <guid>https://www.kad8.com/ai/deepseek-v4-flash-vision-exp-brings-multimodal-agents-to-life/</guid>
      <description>&lt;blockquote&gt;
&lt;p&gt;DeepSeek-V4 Flash Vision Exp Brings Multimodal Agents to Life&lt;/p&gt;&lt;/blockquote&gt;
&lt;p&gt;DeepSeek has officially introduced its experimental multimodal model, &lt;strong&gt;DeepSeek-V4-Flash-Vision-Exp&lt;/strong&gt;, adding visual understanding capabilities designed specifically for Agent workflows.&lt;/p&gt;</description>
      <media:content xmlns:media="http://search.yahoo.com/mrss/" url="https://www.kad8.com/ai/deepseek-v4-flash-vision-exp-brings-multimodal-agents-to-life/featured-AI_agent_interacting_with_hologram.jpeg" />
    </item>
    
    <item>
      <title>Breaking the AI Glasses Chip &#39;Impossible Trinity&#39;: Architecture and Industry Analysis</title>
      <link>https://www.kad8.com/ai/breaking-the-ai-glasses-chip-impossible-trinity-architecture-and-industry-analysis/</link>
      <pubDate>Mon, 06 Jul 2026 23:24:56 +0800</pubDate>
      
      <guid>https://www.kad8.com/ai/breaking-the-ai-glasses-chip-impossible-trinity-architecture-and-industry-analysis/</guid>
      <description>&lt;blockquote&gt;
&lt;p&gt;Breaking the AI Glasses Chip &amp;ldquo;Impossible Trinity&amp;rdquo;: Architecture and Industry Analysis&lt;/p&gt;&lt;/blockquote&gt;
&lt;p&gt;The global AI glasses market is entering a new phase of growth. As consumer interest shifts from early adopters toward mainstream adoption, hardware has become the industry&amp;rsquo;s biggest bottleneck.&lt;/p&gt;</description>
      <media:content xmlns:media="http://search.yahoo.com/mrss/" url="https://www.kad8.com/ai/breaking-the-ai-glasses-chip-impossible-trinity-architecture-and-industry-analysis/featured-AI_glasses_exploded_view.jpeg" />
    </item>
    
    <item>
      <title>Apple&#39;s PICO AI Codec Shrinks Images to One-Third the Size</title>
      <link>https://www.kad8.com/ai/apples-pico-ai-codec-shrinks-images-to-one-third-the-size/</link>
      <pubDate>Sat, 30 May 2026 13:16:20 +0800</pubDate>
      
      <guid>https://www.kad8.com/ai/apples-pico-ai-codec-shrinks-images-to-one-third-the-size/</guid>
      <description>&lt;blockquote&gt;
&lt;p&gt;Apple&amp;rsquo;s PICO AI Codec Shrinks Images to One-Third the Size&lt;/p&gt;&lt;/blockquote&gt;
&lt;p&gt;For more than three decades, image compression technology has followed a familiar path: reduce file size while preserving mathematical measures of image fidelity. From JPEG to HEVC, AV1, and VVC, generations of codecs have focused on optimizing numerical metrics such as Peak Signal-to-Noise Ratio (PSNR) and Structural Similarity Index (SSIM).&lt;/p&gt;</description>
      <media:content xmlns:media="http://search.yahoo.com/mrss/" url="https://www.kad8.com/ai/apples-pico-ai-codec-shrinks-images-to-one-third-the-size/featured-Apple_researchers_unveil_PICO_AI.jpeg" />
    </item>
    
    <item>
      <title>Fei-Fei Li&#39;s GPIC: The Open Dataset Built to Replace ImageNet</title>
      <link>https://www.kad8.com/ai/fei-fei-lis-gpic-the-open-dataset-built-to-replace-imagenet/</link>
      <pubDate>Sat, 30 May 2026 13:08:12 +0800</pubDate>
      
      <guid>https://www.kad8.com/ai/fei-fei-lis-gpic-the-open-dataset-built-to-replace-imagenet/</guid>
      <description>&lt;blockquote&gt;
&lt;p&gt;Fei-Fei Li&amp;rsquo;s GPIC: The Open Dataset Built to Replace ImageNet&lt;/p&gt;&lt;/blockquote&gt;
&lt;p&gt;For more than a decade, ImageNet served as the defining benchmark of computer vision research. From AlexNet and VGG to ResNet and Vision Transformers, nearly every major breakthrough in visual recognition was measured against the same dataset.&lt;/p&gt;</description>
      <media:content xmlns:media="http://search.yahoo.com/mrss/" url="https://www.kad8.com/ai/fei-fei-lis-gpic-the-open-dataset-built-to-replace-imagenet/featured-Stanford_GPIC_dataset_introduction.jpeg" />
    </item>
    
    <item>
      <title>Scenethesis: NVIDIA and Purdue Advance Agentic Text-to-3D Generation</title>
      <link>https://www.kad8.com/ai/scenethesis-nvidia-and-purdue-advance-agentic-text-to-3d-generation/</link>
      <pubDate>Fri, 08 May 2026 22:39:34 +0800</pubDate>
      
      <guid>https://www.kad8.com/ai/scenethesis-nvidia-and-purdue-advance-agentic-text-to-3d-generation/</guid>
      <description>&lt;blockquote&gt;
&lt;p&gt;Scenethesis: NVIDIA and Purdue Advance Agentic Text-to-3D Generation&lt;/p&gt;&lt;/blockquote&gt;
&lt;p&gt;The evolution of large language models is rapidly shifting from static content generation toward autonomous planning, reasoning, and iterative execution. This transition is especially important in the field of Embodied AI, where intelligent systems must operate inside physically realistic environments rather than purely symbolic text spaces.&lt;/p&gt;</description>
      <media:content xmlns:media="http://search.yahoo.com/mrss/" url="https://www.kad8.com/ai/scenethesis-nvidia-and-purdue-advance-agentic-text-to-3d-generation/featured-Scenethesis_text-to-3D_scene_generation.jpeg" />
    </item>
    
    <item>
      <title>SentiAvatar: AI-Driven 3D Digital Humans With Real Emotion</title>
      <link>https://www.kad8.com/ai/sentiavatar-ai-driven-3d-digital-humans-with-real-emotion/</link>
      <pubDate>Thu, 09 Apr 2026 13:41:02 +0800</pubDate>
      
      <guid>https://www.kad8.com/ai/sentiavatar-ai-driven-3d-digital-humans-with-real-emotion/</guid>
      <description>&lt;blockquote&gt;
&lt;p&gt;SentiAvatar: AI-Driven 3D Digital Humans With Real Emotion&lt;/p&gt;&lt;/blockquote&gt;
&lt;p&gt;The introduction of &lt;strong&gt;SentiAvatar&lt;/strong&gt; marks a major breakthrough in 3D digital human generation. Developed by SentiPulse in collaboration with leading academic researchers, this framework moves beyond traditional animation techniques to create avatars that exhibit &lt;strong&gt;semantic awareness, emotional expression, and rhythmically aligned motion&lt;/strong&gt;.&lt;/p&gt;</description>
      <media:content xmlns:media="http://search.yahoo.com/mrss/" url="https://www.kad8.com/ai/sentiavatar-ai-driven-3d-digital-humans-with-real-emotion/featured-SentiAvatar_AI_3D.jpeg" />
    </item>
    
    <item>
      <title>4D Spatial Intelligence: From 3D Reconstruction to Physics</title>
      <link>https://www.kad8.com/ai/4d-spatial-intelligence-how-ai-learns-to-understand-space-and-time/</link>
      <pubDate>Sun, 17 Aug 2025 11:03:11 +0800</pubDate>
      
      <guid>https://www.kad8.com/ai/4d-spatial-intelligence-how-ai-learns-to-understand-space-and-time/</guid>
      <description>&lt;blockquote&gt;
&lt;p&gt;4D Spatial Intelligence: From 3D Reconstruction to Physics&lt;/p&gt;&lt;/blockquote&gt;
&lt;p&gt;4D spatial intelligence is emerging as a foundational capability for AI systems that need to understand not only what exists in an environment, but also how that environment changes over time and responds to physical interactions.&lt;/p&gt;</description>
      <media:content xmlns:media="http://search.yahoo.com/mrss/" url="https://www.kad8.com/ai/4d-spatial-intelligence-how-ai-learns-to-understand-space-and-time/featured-Spatial-intelligence-in-AI.jpeg" />
    </item>
    
  </channel>
</rss>
