MySQL 排序規(guī)則簡介
1. MySQL 排序規(guī)則
1.1. 什么是排序規(guī)則
在新建 MySQL 數(shù)據(jù)庫或表的時候經(jīng)常會選擇字符集和排序規(guī)則。數(shù)據(jù)庫用的字符集大家都知道是怎么回事, 那排序規(guī)則是什么呢?
排序規(guī)則: 是指對指定字符集下不同字符的比較規(guī)則。其特征有以下幾點:
兩個不同的字符集不能有相同的排序規(guī)則兩個字符集有一個默認的排序規(guī)則有一些常用的命名規(guī)則。如 _ci 結尾表示大小寫不敏感 (caseinsensitive), _cs 表示大小寫敏感 (case sensitive), _bin 表示二進制的比較 (binary).
utf-8 有默認的排序規(guī)則:
命令: SHOW CHARSET LIKE 'utf8%';
區(qū)別:
- utf8_general_ci 不區(qū)分大小寫, 這個你在注冊用戶名和郵箱的時候就要使用。
- utf8_general_cs 區(qū)分大小寫, 如果用戶名和郵箱用這個 就會照成不良后果
- utf8_bin: 字符串每個字符串用二進制數(shù)據(jù)編譯存儲。 區(qū)分大小寫, 而且可以存二進制的內(nèi)容
- utf8_general_ci 校對速度快, 但準確度稍差。
- utf8_unicode_ci 準確度高, 但校對速度稍慢。
1.2. 對比
- utf8_general_ci 不區(qū)分大小寫, utf8_general_cs 區(qū)分大小寫
- utf8_bin: compare strings by the binary value of each character in the string 將字符串每個字符串用二進制數(shù)據(jù)編譯存儲, 區(qū)分大小寫, 而且可以存二進制的內(nèi)容。
- utf8_unicode_ci 校對規(guī)則僅部分支持 Unicode 校對規(guī)則算法, 一些字符還是不能支持; utf8_unicode_ci 不能完全支持組合的記號。
說明: ci 是 case insensitive, 即 “大小寫不敏感”, a 和 A 會在字符判斷中會被當做一樣的。 bin 是二進制, a 和 A 會別區(qū)別對待。例如你運行: SELECT * FROM table WHERE txt = 'a' , 那么在 utf8_bin 中你就找不到 txt = 'A' 的那一行, 而 utf8_general_ci 則可以。 utf8_general_ci 是一個遺留的 校對規(guī)則, 不支持擴展, 它僅能夠在字符之間進行逐個比較。這意味著 utf8_general_ci 校對規(guī)則進行的比較速度很快, 但是與使用 utf8_unicode_ci 的校對規(guī)則相比, 比較正確性較差。
1.3. 應用上的差別
- 對于一種語言僅當使用 utf8_unicode_ci 排序做的不好時, 才執(zhí)行與具體語言相關的 utf8 字符集校對規(guī)則。例如, 對于德語和法語, utf8_unicode_ci 工作的很好, 因此不再需要為這兩種語言創(chuàng)建特殊的 utf8 校對規(guī)則。
- utf8_general_ci 也適用與德語和法語, 除了 ? 等于 s, 而不是 ss 之外。如果你的應用能夠接受這些, 那么應該使用 utf8_general_ci, 因為它速度快。否則, 使用 utf8_unicode_ci, 因為它比較準確。
1.4. 使用
utf8_unicode_ci 比較準確, utf8_general_ci 速度比較快。通常情況下, 新建數(shù)據(jù)庫時一般選用 utf8_general_ci 就可以了。
到此這篇關于MySQL 排序規(guī)則的文章就介紹到這了,更多相關MySQL 排序規(guī)則內(nèi)容請搜索腳本之家以前的文章或繼續(xù)瀏覽下面的相關文章希望大家以后多多支持腳本之家!
相關文章
INSERT INTO .. ON DUPLICATE KEY更新多行記錄
本文詳細的介紹了關于INSERT INTO .. ON DUPLICATE KEY更新多行記錄,有需要了解的同學可參考一下2013-08-08
mysql Key_buffer_size參數(shù)的優(yōu)化設置
mysql數(shù)據(jù)庫中有許多重要的參數(shù),其中mysql key_buffer_size是對MyISAM表性能影響最大的一個參數(shù),下面就讓我們一起來了解一下2014-12-12

