首页 >

简单明了!utf8和utf8mb4的区别

后端开发|PHP问题简单明了!utf8和utf8mb4的区别
字符编码
后端开发-PHP问题
3d柱状图源码,vscode清理内存,ubuntu tqdm,tomcat优化java,sqlite3 锁机制,织梦cms淘宝客插件,做大型网站用什么前端框架,泰兴有没有爬虫店卖,jquery 获取php,繁昌企业seo优化,如何制作一个静态网站源码,js简单网页特效,时尚服装模板lzw
A、简介
小白菜代刷源码,ubuntu 网易云课堂,tomcat 中文名图片,爬虫饲养手册,linux访问php默认网页,seo平台就找牛二娃seolzw
MySQL在5.5.3之后增加了这个utf8mb4的编码,mb4就是most bytes 4的意思,专门用来兼容四字节的unicode。utf8mb4是utf8
小程序java开发源码,vscode关闭代码检测,ubuntu开发 书,tomcat读不到,ios sqlite创建虚表,通体大红色的小爬虫,php转义斜杠,绍兴seo外贸推广,php祭祀殡葬网站源码,手机网页滑动翻页,国外美甲网站模板lzw
的超集,除了将编码改为utf8mb4外不需要做其他转换。当然,为了节省空间,一般情况下使用utf8也就够了。

B、内容描述

那上面说了既然utf8能够存下大部分中文汉字,那为什么还要使用utf8mb4呢? 原来mysql支持的 utf8 编码最大字符长度为 3 字节,如

果遇到 4 字节的宽字符就会插入异常了。三个字节的 UTF-8 最大能编码的 Unicode 字符是 0xffff,也就是 Unicode 中的基本多文种

平面(BMP)。也就是说,任何不在基本多文本平面的 Unicode字符,都无法使用 Mysql 的 utf8 字符集存储。包括 Emoji 表情(Emoji

是一种特殊的 Unicode 编码,常见于 ios 和 android 手机上),和很多不常用的汉字,以及任何新增的 Unicode 字符等等(utf8的缺

点)。

通常,计算机在存储字符时,会根据不同类型的字符以及编码方式分配存储空间。例如以下几种编码方式;

①ASCII编码中,一个英文字母(不分大小写)占用一个字节的空间,一个中文汉字占用两个字节的空间。一个二进制的数字序列,在计算机中作为一个数字单元存储时,一般为8位二进制数,换算为十进制。最小值0,最大值255。

②UTF-8编码中,一个英文字符占用一个字节的存储空间,一个中文(含繁体)占用三个字节的存储空间。

③Unicode编码中,一个英文占用两个字节的存储空间,一个中文(含繁体)占用两个字节的存储空间。

④UTF-16编码中,一个英文字母字符或一个汉字字符存储都需要占用2个字节的存储空间(Unicode扩展区的一些汉字存储需要4个字节)。

⑤UTF-32编码中,世界上任何字符的存储都需要占用4个字节的存储空间。

既然utf8能兼容绝大部分的字符,为什么要扩展utf8mb4?

随着互联网的发展,产生了许多新类型的字符,例如emoji这种类型的符号,也就是我们通常在聊天时发的小黄脸表情,这种字符的出

现不在基本多平面的Unicode字符之中,导致无法在MySQL中使用utf8存储,MySQL于是对utf8字符进行了扩展,增加了utf8mb4这个编码。

所以,设计数据库时如果想要允许用户使用特殊符号,最好使用utf8mb4编码来存储,使得数据库有更好的兼容性,但是这样设计会

导致耗费更多的存储空间。


简单明了!utf8和utf8mb4的区别
  • 解决mysql的默认字符编码和中文乱码问题
  • 解决mysql的默认字符编码和中文乱码问题 | 解决mysql的默认字符编码和中文乱码问题 ...

    简单明了!utf8和utf8mb4的区别
  • 为什么从url中直接传递"n"没办法换行?
  • 为什么从url中直接传递"n"没办法换行? | 为什么从url中直接传递"n"没办法换行? ...

    简单明了!utf8和utf8mb4的区别
  • css如何指定样式表使用的字符编码
  • css如何指定样式表使用的字符编码 | css如何指定样式表使用的字符编码 ...