• mysql/Java服务端对emoji的支持


    近期在微信公众平台开发的过程中,同步微信粉丝数据的时候,当粉丝的昵称中有表情符号的时候,发生异常。 

    详细描写叙述:

    假设UTF8字符集且是Javaserver的话。当存储含有emoji表情时,会抛出类似例如以下异常:

    java.sql.SQLException: Incorrect string value: 'xF0x9Fx92x94' for column 'name' at row 1  
        at com.mysql.jdbc.SQLError.createSQLException(SQLError.java:1073)  
        at com.mysql.jdbc.MysqlIO.checkErrorPacket(MysqlIO.java:3593)  
        at com.mysql.jdbc.MysqlIO.checkErrorPacket(MysqlIO.java:3525)  
        at com.mysql.jdbc.MysqlIO.sendCommand(MysqlIO.java:1986)  
        at com.mysql.jdbc.MysqlIO.sqlQueryDirect(MysqlIO.java:2140)  
        at com.mysql.jdbc.ConnectionImpl.execSQL(ConnectionImpl.java:2620)  
        at com.mysql.jdbc.StatementImpl.executeUpdate(StatementImpl.java:1662)  
        at com.mysql.jdbc.StatementImpl.executeUpdate(StatementImpl.java:1581)

    这就是字符集不支持的异常。由于UTF-8编码有可能是两个、三个、四个字节。当中Emoji表情是4个字节,而Mysql的utf8编码最多3个字节,所以导致了数据插不进去。

    升级前须要考虑的问题:

    假设你的项目要进行移动产品的用户文本的存储,将你的DB字符集从UTF8字符集升级到utf8mb4将是势在必行。

    utf8mb4作为utf8的super set。全然向下兼容,所以不用操心字符的兼容性问题。

    升级步骤:

    1.utf8mb4的最低mysql版本号支持版本号为5.5.+,若不是,请升级到较新版本号。

    mysql版本号查看命令请看:查看mysql版本号的四种方法。mysql安装步骤请看:Linux中升级Mysql到Mysql最新版本号的方法
    2.改动database、table和column字符集。

    參考下面语句:
    ALTER DATABASE database_name CHARACTER SET = utf8mb4 COLLATE = utf8mb4_unicode_ci;
    ALTER TABLE table_name CONVERT TO CHARACTER SET utf8mb4 COLLATE utf8mb4_unicode_ci;
    ALTER TABLE table_name CHANGE column_name VARCHAR(191) CHARACTER SET utf8mb4 COLLATE utf8mb4_unicode_ci;
    3.改动mysql配置文件my.cnf(windows为my.ini)

    假设是window环境的话,mysql5.6配置文件的位置在C:ProgramDataMySQLMySQL Server 5.6

    my.cnf一般在etc/mysql/my.cnf位置。找到后请在下面三部分里加入例如以下内容:

    [client]
    default-character-set = utf8mb4

    [mysql]
    default-character-set = utf8mb4

    [mysqld]
    character-set-client-handshake = FALSE
    character-set-server = utf8mb4
    collation-server = utf8mb4_unicode_ci
    init_connect='SET NAMES utf8mb4'

    4.重新启动 MySQL Server、检查字符集

    1.)重新启动命令參考:/etc/init.d/mysql restart

    2.)输入命令:mysql,进入mysql命令行(假设提示没权限,能够尝试输入mysql -uroot -p你的password)

    3.)在mysql命令行中输入:SHOW VARIABLES WHERE Variable_name LIKE 'character_set_%' OR Variable_name LIKE 'collation%';

    检查是否例如以下:

    +--------------------------+--------------------+
    | Variable_name            | Value              |
    +--------------------------+--------------------+
    | character_set_client    | utf8mb4            |
    | character_set_connection | utf8mb4            |
    | character_set_database  | utf8mb4            |
    | character_set_filesystem | binary            |
    | character_set_results    | utf8mb4            |
    | character_set_server    | utf8mb4            |
    | character_set_system    | utf8              |
    | collation_connection    | utf8mb4_unicode_ci |
    | collation_database      | utf8mb4_unicode_ci |
    | collation_server        | utf8mb4_unicode_ci |
    +--------------------------+--------------------+
    rows in set (0.00 sec)


    5.假设你用的是javaserver,升级或确保你的mysql connector版本号高于5.1.13。否则仍然无法使用utf8mb4

    6.检查你服务端的db配置文件:

     

    jdbc.driverClassName=com.mysql.jdbc.Driver
    jdbc.url=jdbc:mysql://localhost:3306/database?

    useUnicode=true&characterEncoding=utf8&autoReconnect=true&rewriteBatchedStatements=TRUE
    jdbc.username=root
    jdbc.password=password

     

    特别说明当中的jdbc.url配置:假设你已经升级好了mysql-connector,当中的characterEncoding=utf8能够被自己主动被识别为utf8mb4(当然也兼容原来的utf8),autoReconnect配置我强烈建议配上,我之前就是忽略了这个属性,导致由于缓存缘故,没有读取到DB最新配置,导致一直无法使用utf8mb4字符集!!

  • 相关阅读:
    IO流总览图
    自己实现的一个数组排序并去重的功能
    Java常量池详解之一道比较蛋疼的面试题
    一个简单的数组去重并排序方法
    Delphi开发经验谈
    再谈Delphi vs VC++(非常精彩)
    C#根据当前时间获取,本周,本月,本季度等时间段
    delphi CopyMemory、FillMemory、MoveMemory、ZeroMemory
    DupeString 与 StringOfChar 的区别
    SQL最大值加1
  • 原文地址:https://www.cnblogs.com/mfmdaoyou/p/6930855.html
Copyright © 2020-2023  润新知