美文网首页程序员技术文
mysql/Java服务端对emoji的支持

mysql/Java服务端对emoji的支持

作者: Owater | 来源:发表于2016-09-28 17:37 被阅读1159次

    移动项目必定少不了emoji,如果你的项目有微信登陆等第三方授权,而且你的用户名是获取微信的用户名,那必须要对emoji支持。即使你的APP端没有实现发表情的功能,但是现在的输入是自带表情输入的,当然IOS是很早就支持了。

    问题描述:

    如果UTF8字符集(utf8_general_ci)且是Java服务器的话,当存储含有emoji表情时,会抛出类似如下异常:

    java.sql.SQLException: Incorrect string value: '\xF0\x9F\x92\x94' for column 'name' at row 1      
    at com.[mysql](http://www.2cto.com/database/MySQL/).jdbc.SQLError.createSQLException(SQLError.java:1073) 
    at com.mysql.jdbc.MysqlIO.checkErrorPacket(MysqlIO.java:3593)      
    at com.mysql.jdbc.MysqlIO.checkErrorPacket(MysqlIO.java:3525)      
    at com.mysql.jdbc.MysqlIO.sendCommand(MysqlIO.java:1986)      
    at com.mysql.jdbc.MysqlIO.sqlQueryDirect(MysqlIO.java:2140)      
    at com.mysql.jdbc.ConnectionImpl.execSQL(ConnectionImpl.java:2620)     
    at com.mysql.jdbc.StatementImpl.executeUpdate(StatementImpl.java:1662)     
    at com.mysql.jdbc.StatementImpl.executeUpdate(StatementImpl.java:1581)
    

    如果是PHP,服务器到时不会蹦,当时所有表情都显示成 ?

    这就是字符集不支持的异常。因为UTF-8编码有可能是两个、三个、四个字节,其中Emoji表情是4个字节,而Mysql的utf8编码最多3个字节,所以导致了数据插不进去。

    升级前需要考虑的问题:

    如果你的项目要进行移动产品的用户文本的存储,将你的DB字符集从UTF8/GBK等传统字符集升级到utf8mb4将是势在必行。你可以通过应用层面转换emoji等特殊字符,以达到原DB的兼容,我认为可行,但是你可能走了弯路。

    utf8mb4作为utf8的super set,完全向下兼容,所以不用担心字符的兼容性问题。切换中需要顾虑的主要影响是mysql需要重新启动(虽然mysql官方文档说可以动态修改配置,但是经过数次测试,还是需要重启才可生效),对于业务可用率的影响是需要考虑的大问题,这里就暂时不展开讨论了。

    升级步骤:

    1.utf8mb4的最低mysql版本支持版本为5.5.3+,若不是,请升级到较新版本。
    mysql版本查看命令请看:[查看mysql版本的四种方法(http://www.cnblogs.com/end/archive/2011/10/18/2216461.html);
    mysql安装步骤请看:Linux中升级Mysql到Mysql最新版本的方法

    .

    2.修改database、table和column字符集。参考以下语句:

    ALTER DATABASE database_name CHARACTER SET = utf8mb4 COLLATE = utf8mb4_unicode_ci;
    ALTER TABLE table_name CONVERT TO CHARACTER SET utf8mb4 COLLATE utf8mb4_unicode_ci;
    ALTER TABLE table_name CHANGE column_name VARCHAR(191) CHARACTER SET utf8mb4 COLLATE utf8mb4_unicode_ci;
    

    3.修改mysql配置文件my.cnf(windows为my.ini)
    my.cnf一般在etc/mysql/my.cnf位置。找到后请在以下三部分里添加如下内容:

    [client]
    default-character-set = utf8mb4
    [mysql]
    default-character-set = utf8mb4
    [mysqld]
    character-set-client-handshake = FALSE
    character-set-server = utf8mb4
    collation-server = utf8mb4_unicode_ci
    init_connect='SET NAMES utf8mb4'
    

    4.重启 MySQL Server、检查字符集

    .

    5.如果你用的是java服务器,升级或确保你的mysql connector版本高于5.1.13,否则仍然无法使用utf8mb4这是mysql官方release note,大家可以查看说明,并下载最新的mysql connector for java的jar包。这里为大家提供一个:mysql-connector-java-5.1.31-bin.jar同时记得修改pom配置哦~

    maven:

    <dependency>
        <groupId>mysql</groupId>
        <artifactId>mysql-connector-java</artifactId>
        <version>5.1.39</version>
    </dependency>
    

    6.检查你服务端的db配置文件:

    jdbc.driverClassName=com.mysql.jdbc.Driverjdbc.url=jdbc:mysql://localhost:3306/database?
    useUnicode=true&characterEncoding=utf8&autoReconnect=true&rewriteBatchedStatements=TRUE
    jdbc.username=root
    jdbc.password=password
    

    特别说明其中的jdbc.url配置:如果你已经升级好了mysql-connector,其中的characterEncoding=utf8可以被自动被识别为utf8mb4(当然也兼容原来的utf8),而autoReconnect配置我强烈建议配上,我之前就是忽略了这个属性,导致因为缓存缘故,没有读取到DB最新配置,导致一直无法使用utf8mb4字符集。

    相关文章

      网友评论

        本文标题:mysql/Java服务端对emoji的支持

        本文链接:https://www.haomeiwen.com/subject/ufxkyttx.html