これ、おそらくUTF-8でもDB内で3バイトまでに対応していたものが4バイト(BMP外の文字)に対応が進んでいる理由の一つではないかと

ockeghemockeghem のブックマーク 2017/11/13 11:55

その他

このブックマークにはスターがありません。
最初のスターをつけてみよう!

絵文字がある種のUnicodeバグを世界から一掃しつつある件について|Rui Ueyama

    UnicodeのUTF-16エンコーディングではほとんどの文字(コードポイント)は2バイトで表現されるが、Unicodeに後から追加収録された文字の多くは4バイトで表現される。4バイト文字がうまく扱えないプログラムという...

    \ コメントが サクサク読める アプリです /

    • App Storeからダウンロード
    • Google Playで手に入れよう