mysql/Java服務(wù)端對emoji的支持

移動項目必定少不了emoji,如果你的項目有微信登陸等第三方授權(quán),而且你的用戶名是獲取微信的用戶名,那必須要對emoji支持。即使你的APP端沒有實現(xiàn)發(fā)表情的功能,但是現(xiàn)在的輸入是自帶表情輸入的,當(dāng)然IOS是很早就支持了。

問題描述:

如果UTF8字符集(utf8_general_ci)且是Java服務(wù)器的話,當(dāng)存儲含有emoji表情時,會拋出類似如下異常:

java.sql.SQLException: Incorrect string value: '\xF0\x9F\x92\x94' for column 'name' at row 1      
at com.[mysql](http://www.2cto.com/database/MySQL/).jdbc.SQLError.createSQLException(SQLError.java:1073) 
at com.mysql.jdbc.MysqlIO.checkErrorPacket(MysqlIO.java:3593)      
at com.mysql.jdbc.MysqlIO.checkErrorPacket(MysqlIO.java:3525)      
at com.mysql.jdbc.MysqlIO.sendCommand(MysqlIO.java:1986)      
at com.mysql.jdbc.MysqlIO.sqlQueryDirect(MysqlIO.java:2140)      
at com.mysql.jdbc.ConnectionImpl.execSQL(ConnectionImpl.java:2620)     
at com.mysql.jdbc.StatementImpl.executeUpdate(StatementImpl.java:1662)     
at com.mysql.jdbc.StatementImpl.executeUpdate(StatementImpl.java:1581)

如果是PHP,服務(wù)器到時不會蹦,當(dāng)時所有表情都顯示成 ?

這就是字符集不支持的異常。因為UTF-8編碼有可能是兩個、三個、四個字節(jié),其中Emoji表情是4個字節(jié),而Mysql的utf8編碼最多3個字節(jié),所以導(dǎo)致了數(shù)據(jù)插不進去。

升級前需要考慮的問題:

如果你的項目要進行移動產(chǎn)品的用戶文本的存儲,將你的DB字符集從UTF8/GBK等傳統(tǒng)字符集升級到utf8mb4將是勢在必行。你可以通過應(yīng)用層面轉(zhuǎn)換emoji等特殊字符,以達(dá)到原DB的兼容,我認(rèn)為可行,但是你可能走了彎路。

utf8mb4作為utf8的super set,完全向下兼容,所以不用擔(dān)心字符的兼容性問題。切換中需要顧慮的主要影響是mysql需要重新啟動(雖然mysql官方文檔說可以動態(tài)修改配置,但是經(jīng)過數(shù)次測試,還是需要重啟才可生效),對于業(yè)務(wù)可用率的影響是需要考慮的大問題,這里就暫時不展開討論了。

升級步驟:

1.utf8mb4的最低mysql版本支持版本為5.5.3+,若不是,請升級到較新版本。
mysql版本查看命令請看:[查看mysql版本的四種方法(http://www.cnblogs.com/end/archive/2011/10/18/2216461.html);
mysql安裝步驟請看:Linux中升級Mysql到Mysql最新版本的方法

.

2.修改database、table和column字符集。參考以下語句:

ALTER DATABASE database_name CHARACTER SET = utf8mb4 COLLATE = utf8mb4_unicode_ci;
ALTER TABLE table_name CONVERT TO CHARACTER SET utf8mb4 COLLATE utf8mb4_unicode_ci;
ALTER TABLE table_name CHANGE column_name VARCHAR(191) CHARACTER SET utf8mb4 COLLATE utf8mb4_unicode_ci;

3.修改mysql配置文件my.cnf(windows為my.ini)
my.cnf一般在etc/mysql/my.cnf位置。找到后請在以下三部分里添加如下內(nèi)容:

[client]
default-character-set = utf8mb4
[mysql]
default-character-set = utf8mb4
[mysqld]
character-set-client-handshake = FALSE
character-set-server = utf8mb4
collation-server = utf8mb4_unicode_ci
init_connect='SET NAMES utf8mb4'

4.重啟 MySQL Server、檢查字符集

.

5.如果你用的是java服務(wù)器,升級或確保你的mysql connector版本高于5.1.13,否則仍然無法使用utf8mb4這是mysql官方release note,大家可以查看說明,并下載最新的mysql connector for java的jar包。這里為大家提供一個:mysql-connector-java-5.1.31-bin.jar同時記得修改pom配置哦~

maven:

<dependency>
    <groupId>mysql</groupId>
    <artifactId>mysql-connector-java</artifactId>
    <version>5.1.39</version>
</dependency>

6.檢查你服務(wù)端的db配置文件:

jdbc.driverClassName=com.mysql.jdbc.Driverjdbc.url=jdbc:mysql://localhost:3306/database?
useUnicode=true&characterEncoding=utf8&autoReconnect=true&rewriteBatchedStatements=TRUE
jdbc.username=root
jdbc.password=password

特別說明其中的jdbc.url配置:如果你已經(jīng)升級好了mysql-connector,其中的characterEncoding=utf8可以被自動被識別為utf8mb4(當(dāng)然也兼容原來的utf8),而autoReconnect配置我強烈建議配上,我之前就是忽略了這個屬性,導(dǎo)致因為緩存緣故,沒有讀取到DB最新配置,導(dǎo)致一直無法使用utf8mb4字符集。

最后編輯于
?著作權(quán)歸作者所有,轉(zhuǎn)載或內(nèi)容合作請聯(lián)系作者
【社區(qū)內(nèi)容提示】社區(qū)部分內(nèi)容疑似由AI輔助生成,瀏覽時請結(jié)合常識與多方信息審慎甄別。
平臺聲明:文章內(nèi)容(如有圖片或視頻亦包括在內(nèi))由作者上傳并發(fā)布,文章內(nèi)容僅代表作者本人觀點,簡書系信息發(fā)布平臺,僅提供信息存儲服務(wù)。

相關(guān)閱讀更多精彩內(nèi)容

友情鏈接更多精彩內(nèi)容