<?xml version="1.0" encoding="utf-8" standalone="yes"?>
<rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom" xmlns:content="http://purl.org/rss/1.0/modules/content/">
  <channel>
    <title>大模型 on zz.blog</title>
    <link>https://kairosxy.cn/tags/%E5%A4%A7%E6%A8%A1%E5%9E%8B/</link>
    <description>Recent content in 大模型 on zz.blog</description>
    <generator>Hugo</generator>
    <language>zh-CN</language>
    <lastBuildDate>Wed, 29 Jul 2026 00:00:00 +0000</lastBuildDate>
    <atom:link href="https://kairosxy.cn/tags/%E5%A4%A7%E6%A8%A1%E5%9E%8B/index.xml" rel="self" type="application/rss+xml" />
    <item>
      <title>大模型精度：从定点数到浮点数</title>
      <link>https://kairosxy.cn/posts/llm-precision/</link>
      <pubDate>Wed, 29 Jul 2026 00:00:00 +0000</pubDate>
      <guid>https://kairosxy.cn/posts/llm-precision/</guid>
      <description>&lt;h2 id=&#34;一定点数-与-浮点数核心区别&#34;&gt;一、定点数 与 浮点数（核心区别）&lt;/h2&gt;
&lt;h3 id=&#34;1-什么是定点数fixed-point&#34;&gt;1. 什么是定点数（Fixed Point）&lt;/h3&gt;
&lt;p&gt;&lt;strong&gt;定义&lt;/strong&gt;
定点数表示方式的核心特点是：&lt;/p&gt;
&lt;blockquote&gt;
&lt;p&gt;&lt;strong&gt;小数点位置是固定的&lt;/strong&gt;&lt;/p&gt;&lt;/blockquote&gt;
&lt;p&gt;计算机内部存的是一个整数，而真实数值由一个&lt;strong&gt;固定的比例关系&lt;/strong&gt;解释。&lt;/p&gt;
&lt;p&gt;&lt;strong&gt;表示方式（直觉）&lt;/strong&gt;&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; class=&#34;chroma&#34;&gt;&lt;code class=&#34;language-fallback&#34; data-lang=&#34;fallback&#34;&gt;&lt;span class=&#34;line&#34;&gt;&lt;span class=&#34;cl&#34;&gt;真实值 = 存储的整数 × 缩放因子
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;p&gt;例如规定：&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;
&lt;p&gt;缩放因子 = 0.1&lt;/p&gt;
&lt;/li&gt;
&lt;li&gt;
&lt;p&gt;那么：&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;存 15 → 表示 1.5&lt;/li&gt;
&lt;li&gt;存 1 → 表示 0.1&lt;/li&gt;
&lt;/ul&gt;
&lt;/li&gt;
&lt;/ul&gt;
&lt;p&gt;INT8 / INT16 / INT32 都属于定点数体系。&lt;/p&gt;
&lt;p&gt;&lt;strong&gt;本质特点&lt;/strong&gt;&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;所有数共用一个尺度&lt;/li&gt;
&lt;li&gt;精度和范围无法同时兼顾&lt;/li&gt;
&lt;li&gt;数值分布一旦变化就容易失真&lt;/li&gt;
&lt;/ul&gt;
&lt;p&gt;&lt;strong&gt;在神经网络中的问题&lt;/strong&gt;&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;
&lt;p&gt;神经网络中同一 tensor 内：&lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;可能同时存在非常小的数和非常大的数&lt;/li&gt;
&lt;/ul&gt;
&lt;/li&gt;
&lt;li&gt;
&lt;p&gt;固定尺度无法适配这种变化&lt;/p&gt;
&lt;/li&gt;
&lt;/ul&gt;
&lt;hr&gt;
&lt;h3 id=&#34;2-什么是浮点数floating-point&#34;&gt;2. 什么是浮点数（Floating Point）&lt;/h3&gt;
&lt;p&gt;&lt;strong&gt;定义&lt;/strong&gt;
浮点数的核心思想是：&lt;/p&gt;
&lt;blockquote&gt;
&lt;p&gt;&lt;strong&gt;允许小数点“浮动”，让数值大小和精细程度分开表示&lt;/strong&gt;&lt;/p&gt;&lt;/blockquote&gt;
&lt;p&gt;&lt;strong&gt;基本结构&lt;/strong&gt;&lt;/p&gt;
&lt;div class=&#34;highlight&#34;&gt;&lt;pre tabindex=&#34;0&#34; class=&#34;chroma&#34;&gt;&lt;code class=&#34;language-fallback&#34; data-lang=&#34;fallback&#34;&gt;&lt;span class=&#34;line&#34;&gt;&lt;span class=&#34;cl&#34;&gt;[ 符号位 ][ 指数位 ][ 尾数位 ]
&lt;/span&gt;&lt;/span&gt;&lt;/code&gt;&lt;/pre&gt;&lt;/div&gt;&lt;ul&gt;
&lt;li&gt;符号位：正 / 负&lt;/li&gt;
&lt;li&gt;指数位：数量级（决定“有多大”）&lt;/li&gt;
&lt;li&gt;尾数位：有效数字（决定“有多准”）&lt;/li&gt;
&lt;/ul&gt;
&lt;p&gt;&lt;strong&gt;直觉理解&lt;/strong&gt;
浮点数本质等价于科学计数法：&lt;/p&gt;</description>
    </item>
  </channel>
</rss>
