0
  • 聊天消息
  • 系统消息
  • 评论与回复
登录后你可以
  • 下载海量资料
  • 学习在线课程
  • 观看技术视频
  • 写文章/发帖/加入社区
会员中心
创作中心

完善资料让更多小伙伴认识你,还能领取20积分哦,立即完善>

3天内不再提示

MySQL中utf8和utf8mb4有什么区别

汽车玩家 来源:IT生涯 作者:IT生涯 2020-04-12 19:21 次阅读

一、简介

MySQL在5.5.3之后增加了这个utf8mb4的编码,mb4就是most bytes 4的意思,专门用来兼容四字节的unicode。utf8mb4是utf8的超集,除了将编码改为utf8mb4外不需要做其他转换。当然,为了节省空间,一般情况下使用utf8也就够了。

二、内容描述

那上面说了既然utf8能够存下大部分中文汉字,那为什么还要使用utf8mb4呢? 原来mysql支持的 utf8 编码最大字符长度为 3 字节,如果遇到 4 字节的宽字符就会插入异常了。三个字节的 UTF-8 最大能编码的 Unicode 字符是 0xffff,也就是 Unicode 中的基本多文种平面(BMP)。也就是说,任何不在基本多文本平面的 Unicode字符,都无法使用 Mysql 的 utf8 字符集存储。包括 Emoji 表情(Emoji是一种特殊的 Unicode 编码,常见于 iosandroid 手机上),和很多不常用的汉字,以及任何新增的 Unicode 字符等等(utf8的缺点)。

通常,计算机在存储字符时,会根据不同类型的字符以及编码方式分配存储空间。例如以下几种编码方式;

①ASCII编码中,一个英文字母(不分大小写)占用一个字节的空间,一个中文汉字占用两个字节的空间。一个二进制的数字序列,在计算机中作为一个数字单元存储时,一般为8位二进制数,换算为十进制。最小值0,最大值255。

②UTF-8编码中,一个英文字符占用一个字节的存储空间,一个中文(含繁体)占用三个字节的存储空间。

③Unicode编码中,一个英文占用两个字节的存储空间,一个中文(含繁体)占用两个字节的存储空间。

④UTF-16编码中,一个英文字母字符或一个汉字字符存储都需要占用2个字节的存储空间(Unicode扩展区的一些汉字存储需要4个字节)。

⑤UTF-32编码中,世界上任何字符的存储都需要占用4个字节的存储空间。

既然utf8能兼容绝大部分的字符,为什么要扩展utf8mb4?

随着互联网的发展,产生了许多新类型的字符,例如emoji这种类型的符号,也就是我们通常在聊天时发的小黄脸表情,这种字符的出现不在基本多平面的Unicode字符之中,导致无法在MySQL中使用utf8存储,MySQL于是对utf8字符进行了扩展,增加了utf8mb4这个编码。

所以,设计数据库时如果想要允许用户使用特殊符号,最好使用utf8mb4编码来存储,使得数据库有更好的兼容性,但是这样设计会导致耗费更多的存储空间。

声明:本文内容及配图由入驻作者撰写或者入驻合作网站授权转载。文章观点仅代表作者本人,不代表电子发烧友网立场。文章及其配图仅供工程师学习之用,如有内容侵权或者其他违规问题,请联系本站处理。 举报投诉
  • MySQL
    +关注

    关注

    1

    文章

    816

    浏览量

    26607
收藏 人收藏

    评论

    相关推荐

    windows服务器备份mysql脚本

    一、linux备份 使用python脚本,要求python3和mysqldump #! /usr/bin/python36# -*- coding: utf-8 -*-import
    的头像 发表于 01-02 09:14 49次阅读

    RTOS与Linux到底什么区别

    很多做嵌入式开发的小伙伴都存在这样的疑惑:RTOS与Linux到底什么区别
    的头像 发表于 10-29 09:53 466次阅读

    嵌入式学习-飞凌嵌入式ElfBoard ELF 1板卡-开发环境搭建之VScode的安装及使用

    插件 Document This:快速注释 ESLint:代码检查工具 DeviceTree:设备商语法 GBK to UTF8 for vscode:GBK转UTF8插件 Vscode-icons
    发表于 10-09 15:44

    IG902如何上传数据到MQTT云平台EMQX ?

    =utf8MB4; 1 rows in set(0.00sec) MySQL主题订阅表 mqtt_sub 存储设备的主题订阅关系: DROPTABLEIFEXISTS`mqtt_sub
    发表于 07-25 07:09

    请问MB90F549GPFV-GSE1和MB90F549GPF-GE1什么区别

    MB90F549GPFV-GSE1 和 MB90F549GPF-GE1 什么区别? 第一个零件编号多了两个字母\" V\"和\"S\" ,这两个字母
    发表于 05-17 16:32

    STM8S003XX与STM8S105XX寄存器的配置上有什么区别呢?

    各位前辈,STM8S003XX与STM8S105XX寄存器的配置上有什么区别呢?
    发表于 05-10 07:08

    stm8s005与stm8s105 32管脚什么区别

    stm8s005与stm8s10532管脚的什么区别
    发表于 04-29 08:37

    stm8l151k4外部晶振和内部晶振的区别是什么?外部晶振准确点吗?

    stm8l151k4XXX这款单片机的外部晶振和内部晶振什么区别?外部晶振准确点吗? 必要使用外部晶振吗?
    发表于 04-28 06:15

    采用UTF8UTF16都无法使用中文SSID怎么解决?

    采用 UTF8UTF16都无法使用中文SSID 将wifi ssid设置为 \" test12 \",分别用了以下 3种 unicode编解码格格式,测试情况分分如下: 1.格式一:UTF-16LE 2.G格式二:
    发表于 02-29 06:36

    线路板的层和阶什么区别

    线路板的层和阶什么区别
    的头像 发表于 02-23 17:27 737次阅读

    SPI和QSPI什么区别

    SPI和QSPI什么区别
    发表于 02-06 06:12

    求助,TC275不同的STEP什么区别

    TC275不同的STEP什么区别?我看了一些芯片CA-STEP,DB-STEP,DC-STEP这几个step
    发表于 02-04 07:34

    CY8C624ABZI-D44的2M闪存和CY8C6247BZI-D54的1M闪存\"电流消耗\"什么区别吗?

    , CY8C6247BZI-D54 1MB 闪存 CY8C624ABZI-D44 2MB
    发表于 01-31 07:36

    T2G的CY8CKIT-005和CY8CKIT-005-A什么区别吗?

    你能告诉我T2G的CY8CKIT-005和CY8CKIT-005-A什么区别吗?
    发表于 01-29 08:31

    电源的EMI和EMC什么区别

    电源的EMI和EMC什么区别? 电源的EMI和EMC是与电磁干扰相关的两个概念,尽管它们一些相似之处,但它们
    的头像 发表于 01-19 11:47 1703次阅读