程序员必看:浮点数精度问题全解析

原创 typedef 2024-11-25 08:21

目录

  • 0、导读
  • 1、引言
  • 2、浮点数存储格式
  • 3、转换流程
    • 3.1、将整数部分转换为二进制
    • 3.2、将小数部分转为二进制
    • 3.3、规范化
    • 3.4、调整阶码
    • 3.5、尾数舍入
    • 3.6、组三元素
  • 4、单/双精度浮点数比较
    • 4.1、存储格式
    • 4.2、精度
    • 4.3、浮点数范围
    • 4.4、浮点数比较
  • 5、阶码相关问题探索
    • 5.1、什么是移码
    • 5.2、如何计算移码
    • 5.3、为什么要用移码表示
  • 6、指数e
    • 6.1、指数范围
    • 6.2、特殊值
  • 7、文中问题解答
  • 8、参考链接
  • 9、总结

0、导读

这篇文章主要探讨了浮点数在计算机中的表示、存储和精度问题。通过详细的解释和示例,您将了解浮点数误差的根源。文章内容较多,大约3700余字,阅读时间约为10分钟,建议先收藏,待有空时再细细品读。

1、引言

0.1 + 0.2 为什么不等于 0.3 ?

当被问及浮点数为何存在误差时,你将如何回答?

没看完这篇文章之前你可能会回答:"哼,反正我就知道有误差..."

阅读完这篇文章后,你将能够更准确地回答这类问题,让我们开始这段学习之旅吧!

2、浮点数存储格式

浮点型在内存中的存储不是像整形那样直接存储的,而是用一种二进制的科学计数法来表示的,具体的数学表达式为

V = (-1) s × M × 2 e

其中,e = E - 127

在计算机科学领域,IEEE 754 是一种标准,用于定义浮点数的表示方法,浮点型数据的存储格式如下

请务必记住,尾数存储用原码,阶码存储用移码

  • S(符号位):0代表正数,1代表负数。
  • E(阶码):指数字段需要同时表示正指数和负指数。为了得到存储的指数,在实际指数上加一个偏置,其中e=E-127
  • M(尾数):一个规范化尾数就是小数点左边只有一个1,然后是小数点后面的尾数部分。

注意本文后续使用的e表示科学计数法中的指数部分,E表示存储格式中的阶码,默认的对象都指单精度的浮点数。

3、转换流程

接下来我选择了一个恋爱脑的数字,将1314.520转换到32位单精度IEEE 754二进制浮点表示标准。

3.1、将整数部分转换为二进制

将整数部分反复除以2,并记录每次的余数,直到商为0为止。

division = quotient + remainder;
1314 ÷ 2 = 657 + 0;
657  ÷ 2 = 328 + 1;
328  ÷ 2 = 164 + 0;
164  ÷ 2 = 82  + 0;
82   ÷ 2 = 41  + 0;
41   ÷ 2 = 20  + 1;
20   ÷ 2 = 10  + 0;
10   ÷ 2 = 5   + 0;
5    ÷ 2 = 2   + 1;
2    ÷ 2 = 1   + 0;
1    ÷ 2 = 0   + 1;

从上面构造的列表的底部开始取所有余数,即为整数部分的二进制表示。131410=101 0010 00102

3.2、将小数部分转为二进制

将小数部分不断乘以2,并记录每次的整数部分,直到小数部分为0或达到所需的精度为止

#) multiplying = integer + fractional part;
1) 0.52 × 2 = 1 + 0.04;
2) 0.04 × 2 = 0 + 0.08;
3) 0.08 × 2 = 0 + 0.16;
4) 0.16 × 2 = 0 + 0.32;
5) 0.32 × 2 = 0 + 0.64;
6) 0.64 × 2 = 1 + 0.28;
7) 0.28 × 2 = 0 + 0.56;
8) 0.56 × 2 = 1 + 0.12;
9) 0.12 × 2 = 0 + 0.24;
10) 0.24 × 2 = 0 + 0.48;
11) 0.48 × 2 = 0 + 0.96;
12) 0.96 × 2 = 1 + 0.92;
13) 0.92 × 2 = 1 + 0.84;
14) 0.84 × 2 = 1 + 0.68;
15) 0.68 × 2 = 1 + 0.36;
16) 0.36 × 2 = 0 + 0.72;
17) 0.72 × 2 = 1 + 0.44;
18) 0.44 × 2 = 0 + 0.88;
19) 0.88 × 2 = 1 + 0.76;
20) 0.76 × 2 = 1 + 0.52;
21) 0.52 × 2 = 1 + 0.04;
22) 0.04 × 2 = 0 + 0.08;
23) 0.08 × 2 = 0 + 0.16;
24) 0.16 × 2 = 0 + 0.32;

虽然我们没有得到任何等于0的小数部分,但是我们有足够的迭代(超过尾数限制)。

从顶部开始依次取乘法运算的所有整数部分,即为小数部分的二进制:0.5210=0.1000 0101 0001 1110 1011 10002

3.3、规范化

前面得出了整数以及小数部分的二进制表示,合并以后即:

1314.5210= 101 0010 0010.1000 0101 0001 1110 1011 10002

将小数点向左移动 10 位,使其左边只剩下一位非零的数字

1314.5210= 101 0010 0010.1000 0101 0001 1110 1011 10002= 101 0010 0010.1000 0101 0001 1110 1011 10002 ×2 0= 1.0100 1000 1010 0001 0100 0111 1010 1110 002 ×2 10

再回顾一下浮点数的数学表达式 V = (-1) s × M × 2 e 由此可知

s = 0
M = 1.0100 1000 1010 0001 0100 0111 1010 1110 00
e = 10

3.4、调整阶码

根据规范化得知指数 e = 10,又根据公式 e = E - 127 可得知道 E=137,所以八位阶码的二进制表示如下所示:

E = 13710 = 1000 10012

3.5、尾数舍入

由第三步规范化得出的尾数M有34位,但是存储格式中尾数只有23位,下面划线的是多出的部分,所以需要对尾数按照一定的方式进行四舍五入。

M = 1. 0100 1000 1010 0001 0100 011 1 1010 1110 00

一共有四种舍入方式,

  • 向偶数舍入,就近舍入(默认)。
  • 朝0舍入:即朝数轴零点方向舍入,即直接截尾。
  • 朝正无穷舍入:对正数而言,只要多余位不全为0则向最低有效位进1;负数则直接截尾。
  • 朝负无穷舍入:对负数而言,向最低有效位进1;正数若多余位不全部为0则简单截尾。

向偶数舍入,简单理解就要让尾数的最后一位为0,让其保持偶数,能够被2整除。当尾数的最低位为0时,已经是属于偶数了,无需处理。当尾数最低位为1时,需要加1,使其保持偶数。

因为本例计算出尾数的最后一位为1,按照就近舍入(向偶舍入)原则需要加1使其保持偶数。

所以经过调整后的M为

M = 0100 1000 1010 0001 0100 011 + 1
M = 0100 1000 1010 0001 0100 100

3.6、组三元素

根据前面的步骤可以得知

s = 0
E = 1000 1001 2
M = 0100 1000 1010 0001 0100 100 2

1324.5210 = 0-1000 1001-0100 1000 1010 0001 0100 1002

我们去一个转换网站上验证一下转换结果,网站链接放在文章末尾了。

floatConverterIEEE754

可以看到,跟我们转换的结果是相同的,说明网站转换也是选择向偶数舍入的。

4、单/双精度浮点数比较

4.1、存储格式

类型符号位指数长度(Bit)尾数长度(Bit)
float1823
double11152

4.2、精度

浮点数的精度是由尾数的位数来决定的。

对于float型浮点数,尾数部分23位,换算成十进制就是 2^23=8388608,所以十进制精度只有6 ~ 7位;

这里的数字6和7可能会引起疑问,如何理解它们呢?

由于浮点数尾数的舍入问题,最后一位可能存在舍入误差,因此不完全准确。因此,可以准确表示的是后六位,而第七位则可能含有误差。

对于double型浮点数,尾数部分52位,换算成十进制就是 2^52 = 4503599627370496,所以十进制精度只有15 ~ 16位

类型有效位字节数
float6 - 74
double15 - 168

4.3、浮点数范围

类型最小值最大值
float1.175494351 E - 383.402823466 E + 38
double2.2250738585072014 E - 3081.7976931348623158 E + 308

4.4、浮点数比较

浮点数的比较通常用两数之差的绝对值小于一个自定义的数值时,代表两者相等,如下所示:

/**
 *Author:(公众号:typedef)
 */

#define FLOAT_EPSILON (0.000001) //Define your own tolerance
#define FloatIsEqual(a, b) ((fabs((a)-(b)))<(FLOAT_EPSILON))

另外一种方法是将浮点数同时放大一个倍数,然后转成整数之间的比较,比如同时放大10000倍等。

5、阶码相关问题探索

首先阶码E是用移码表示的,那么问题来了,什么叫移码?移码怎么计算?移码的含义是?浮点数为什么要用移码表示?

在解答这些知识点时,我们需要下面两点需要达成一致

  • 阶码使用的是非标准移码
  • 阶码是一个无符号的整数

5.1、什么是移码

移码是补码表示中最高符号位取反的结果。举个例子,上面计算1314.52时,指数是为10的。

+1010 = 0000 10102(真值)

原码:0000 1010
反码:0000 1010
补码:0000 1010
移码:1000 1010

所以10对应标准的移码 1000 1010

5.2、如何计算移码

注意浮点数中移码的计算是非标准的,仅偏移2n-1-1=127。所以移码的计算公式如下所示,其中n为阶码的位数:

E = e + 2 n-1 - 1
E = e + 127

所以10对应的移码为137。

5.3、为什么要用移码表示

它通过将数值加上一个固定的偏移量,使得原本可能是负数的数值变为非负数,从而简化了计算机中有符号数的表示和比较操作。使得计算机能够直接使用整数运算来比较浮点数的大小

6、指数e

6.1、指数范围

浮点数指数部分的实际取值范围是 [-2(e-1)+2, 2(e-1)-1],其中 e 为指数所占位数。32位浮点数,指数占8位,实际取值范围是 [-126, 127]。

-127用作表示0,128 用作表示无穷大和 NaN。NaN 是 "Not a Number" 的缩写,中文意思是“非数字”,通常用于表示一个未定义或不可表示的值。

换言之,8位阶码的表示范围是[0, 255],其中0和255用于表示特殊值。因此,根据公式推导,指数e的实际取值范围是[-126, 127]。

6.2、特殊值

形式指数(e)阶码(E)小数部分
-12700
无穷1282e-1 = 2550
NaN(非数)1282e-1 = 255非0

7、文中问题解答

此时再来回答文中引言提出的问题, 0.1 + 0.2 为什么不等于 0.3 ?

/**
 * Author:(公众号:typedef)
 */

#include 

int main() {
  double a = 0.1 + 0.2;
  printf("%.17f", a);
}

输出为0.30000000000000004,由于在尾数舍入时会带来一定的误差,所以并不完全相等。

当在被问及浮点数为何存在误差时,你将如何回答?欢迎文章留言说出你的看法。

如果不从技术的角度回答这个问题,可以这样回答:整数是离散的,有限的并能够被计算机表示的,小数部分是连续的,包含无穷多的数,数量之多是无法被计算机存储的,只能存储计算机能够表示的最接近这个数值的小数部分,所以可能会不相等。

8、参考链接

  • https://www.cnblogs.com/gyunf/p/12816817.html
  • https://www.h-schmidt.net/FloatConverter/IEEE754.html
  • https://zh.wikipedia.org/wiki/IEEE_754
  • https://docs.pingcode.com/ask/304021.html

9、总结

本篇文章深入分析了浮点数的存储格式到转换流程,再到指数e以及阶码E的探索,大家应该对浮点数有了更全面的理解。

码字不易,如果您觉得有收获,欢迎点赞、转发,加关注!

END

点赞、转发加关注,一键三连,好运年年

关注公众号后台回复数字688或668可获取嵌入式相关资料

往期推荐

C语言编程新手:如何判断结构体(struct)相等?

避免内存陷阱:掌握memcpy和memmove的正确用法

揭秘难以复现Bug的解决之道:堆栈分析实战

加个变量,程序崩了

typedef 主要用于记录个人学习、总结、分享的一个平台。 教学相长,共同进步。同时并建立技术交流群,欢迎加入。期待您的关注。
评论 (0)
  • 文/郭楚妤编辑/cc孙聪颖‍相较于一众措辞谨慎、毫无掌舵者个人风格的上市公司财报,利亚德的财报显得尤为另类。利亚德光电集团成立于1995年,是一家以LED显示、液晶显示产品设计、生产、销售及服务为主业的高新技术企业。自2016年年报起,无论业绩优劣,董事长李军每年都会在财报末尾附上一首七言打油诗,抒发其对公司当年业绩的感悟。从“三年翻番顺大势”“智能显示我第一”“披荆斩棘幸从容”等词句中,不难窥见李军的雄心壮志。2012年,利亚德(300296.SZ)在深交所创业板上市。成立以来,该公司在细分领
    华尔街科技眼 2025-05-07 19:25 426浏览
  • 二位半 5线数码管的驱动方法这个2位半的7段数码管只用5个管脚驱动。如果用常规的7段+共阳/阴则需要用10个管脚。如果把每个段看成独立的灯。5个管脚来点亮,任选其中一个作为COM端时,另外4条线可以单独各控制一个灯。所以实际上最多能驱动5*4 = 20个段。但是这里会有一个小问题。如果想点亮B1,可以让第3条线(P3)置高,P4 置低,其它阳极连P3的灯对应阴极P2 P1都应置高,此时会发现C1也会点亮。实际操作时,可以把COM端线P3设置为PP输出,其它线为OD输出。就可以单独控制了。实际的驱
    southcreek 2025-05-07 15:06 522浏览
  • 飞凌嵌入式作为龙芯合作伙伴,隆重推出FET-2K0300i-S全国产自主可控工业级核心板!FET-2K0300i-S核心板基于龙芯2K0300i工业级处理器开发设计,集成1个64位LA264处理器,主频1GHz,提供高效的计算能力;支持硬件ECC;2K0300i还具备丰富的连接接口USB、SDIO、UART、SPI、CAN-FD、Ethernet、ADC等一应俱全,龙芯2K0300i支持四路CAN-FD接口,具备良好的可靠性、实时性和灵活性,可满足用户多路CAN需求。除性价比超高的国产处理器外,
    飞凌嵌入式 2025-05-07 11:54 87浏览
  • 后摄像头是长这个样子,如下图。5孔(D-,D+,5V,12V,GND),说的是连接线的个数,如下图。4LED,+12V驱动4颗LED灯珠,给摄像头补光用的,如下图。打开后盖,发现里面有透明白胶(防水)和白色硬胶(固定),用合适的工具,清理其中的胶状物。BOT层,AN3860,Panasonic Semiconductor (松下电器)制造的,Cylinder Motor Driver IC for Video Camera,如下图。TOP层,感光芯片和广角聚焦镜头组合,如下图。感光芯片,看着是玻
    liweicheng 2025-05-07 23:55 418浏览
  • 温度传感器的工作原理依据其类型可分为以下几种主要形式:一、热电阻温度传感器利用金属或半导体材料的电阻值随温度变化的特性实现测温:l ‌金属热电阻‌(如铂电阻 Pt100、Pt1000):高温下电阻值呈线性增长,稳定性高,适用于工业精密测温。l ‌热敏电阻‌(NTC/PTC):NTC 热敏电阻阻值随温度升高而下降,PTC 则相反;灵敏度高但线性范围较窄,常用于电子设备温控。二、热电偶传感器基于‌塞贝克效应‌(Seebeck effect):两种不同
    锦正茂科技 2025-05-09 13:31 217浏览
  • 硅二极管温度传感器是一种基于硅半导体材料特性的测温装置,其核心原理是利用硅二极管的电学参数(如正向压降或电阻)随温度变化的特性实现温度检测。以下是其工作原理、技术特点及典型应用:一、工作原理1、‌PN结温度特性‌硅二极管由PN结构成,当温度变化时,其正向电压 VF与温度呈线性负相关关系。例如,温度每升高1℃,VF约下降2 mV。2、‌电压—温度关系‌通过jing确测量正向电压的微小变化,可推算出环境温度值。部分型号(如SI410)在宽温域内(如1.4 K至475 K)仍能保持高线性度。
    锦正茂科技 2025-05-09 13:52 224浏览
  • Matter协议是一个由Amazon Alexa、Apple HomeKit、Google Home和Samsung SmartThings等全球科技巨头与CSA联盟共同制定的开放性标准,它就像一份“共生契约”,能让原本相互独立的家居生态在应用层上握手共存,同时它并非另起炉灶,而是以IP(互联网协议)为基础框架,将不同通信协议下的家居设备统一到同一套“语义规则”之下。作为应用层上的互通标准,Matter协议正在重新定义智能家居行业的运行逻辑,它不仅能向下屏蔽家居设备制造商的生态和系统,让设备、平
    华普微HOPERF 2025-05-08 11:40 367浏览
  • 在过去的很长一段时间里,外卖市场呈现出美团和饿了么双寡头垄断的局面。美团凭借先发优势、强大的地推团队以及精细化的运营策略,在市场份额上长期占据领先地位。数据显示,截至2024年上半年,美团外卖以68.2%的市场份额领跑外卖行业,成为当之无愧的行业老大。其业务广泛覆盖,从一线城市的繁华商圈到二三线城市的大街小巷,几乎无处不在,为无数消费者提供便捷的外卖服务。饿了么作为阿里本地生活服务的重要一环,依托阿里强大的资金和技术支持,也在市场中站稳脚跟,以25.4%的份额位居第二。尽管市场份额上与美团有一定
    用户1742991715177 2025-05-06 19:43 102浏览
  • UNISOC Miracle Gaming奇迹手游引擎亮点:• 高帧稳帧:支持《王者荣耀》等主流手游90帧高画质模式,连续丢帧率最高降低85%;• 丝滑操控:游戏冷启动速度提升50%,《和平精英》开镜开枪操作延迟降低80%;• 极速网络:专属游戏网络引擎,使《王者荣耀》平均延迟降低80%;• 智感语音:与腾讯GVoice联合,弱网环境仍能保持清晰通话;• 超高画质:游戏画质增强、超级HDR画质、游戏超分技术,优化游戏视效。全球手游市场规模日益壮大,游戏玩家对极致体验的追求愈发苛刻。紫光展锐全新U
    紫光展锐 2025-05-07 17:07 324浏览
  • 这款无线入耳式蓝牙耳机是长这个样子的,如下图。侧面特写,如下图。充电接口来个特写,用的是卡座卡在PCB板子上的,上下夹紧PCB的正负极,如下图。撬开耳机喇叭盖子,如下图。精致的喇叭(HY),如下图。喇叭是由电学产生声学的,具体结构如下图。电池包(AFS 451012  21 12),用黄色耐高温胶带进行包裹(安规需求),加强隔离绝缘的,如下图。451012是电池包的型号,聚合物锂电池+3.7V 35mAh,详细如下图。电路板是怎么拿出来的呢,剪断喇叭和电池包的连接线,底部抽出PCB板子
    liweicheng 2025-05-06 22:58 606浏览
  • 随着智能驾驶时代到来,汽车正转变为移动计算平台。车载AI技术对存储器提出新挑战:既要高性能,又需低功耗和车规级可靠性。贞光科技代理的紫光国芯车规级LPDDR4存储器,以其卓越性能成为国产芯片产业链中的关键一环,为智能汽车提供坚实的"记忆力"支持。作为官方授权代理商,贞光科技通过专业技术团队和完善供应链,让这款国产存储器更好地服务国内汽车厂商。本文将探讨车载AI算力需求现状及贞光科技如何通过紫光国芯LPDDR4产品满足市场需求。 车载AI算力需求激增的背景与挑战智能驾驶推动算力需求爆发式
    贞光科技 2025-05-07 16:54 212浏览
我要评论
0
0
点击右上角,分享到朋友圈 我知道啦
请使用浏览器分享功能 我知道啦