Emoji, 没想到你是这样的...

趁着做项目的机会了解了一下 emoji 编码的问题。在此文中总结一下emoji 资料
P.S. 如果看不到文中的 emoji 渲染效果,请看文末的长图。

首先 unicode 标准定义了一个基本 emoji 符号集, 其中共 1182 个字符。例如 U+26A1 表示高电压 (⚡)。emoji 字符可能是以 text 风格呈现,或者以 emoji 风格呈现。具体两种风格呈现出来是什么样子往往与具体的平台有关,不过通常情况下,emoji 风格呈现的字符是彩色的,而 text 风格渲染的字符是黑白的。其中有部分 emoji 字符会默认使用 emoji 风格呈现,这部分 emoji 字符被称之为emoji_presentation。不过,我们可以通过修饰符(U+FE0F 与 U+FE0F)指定字符以 text 或 emoji 风格字符。例如, U+26A1 U+FE0F 则指定高电压符号号使用 emoji 风格渲染,而 U+26A1 U+FE0E 则指定高电压符号使用 text 风格渲染,其中 U+FE0F 与 U+FE0E 又分别被称之为 emoji 表示风格选择子与 text 表示风格选择子。具有这种变化的集合可参见这里。可以看出 emoji 除了基本字符集外,还可以通过某些控制字符组成新的 emoij 字符串展示为一个新的 emoji。这也主意味着,我们平时看到的一个 emoji 既可能是一个 unicode 字符,也可能是多个 unicode 字符组成。接下来,将依次介绍这些组合方式。

  1. Emoji_presentation_sequence 即由基本 emoji 字符加上 U+FE0F 组合而成 emoji 序列串。例如 U+26A1 U+FE0F 。

  2. Modfier_Base_Sequence 。这种是一种Modifier_Base + Modifer 修饰的方式。其中 Modifier 是用于对 Modifier_Base 进行修饰的 unicode 字符,目前定义了五种修饰字符,分别表示颜色的由深及浅,1F3FB到1F3FF (🏻..🏿) (ps, 如果看不见字符可以在手机上阅读)。那么显然,Modifier_Base 就是被能被修饰的 emoji 字符,显然不是所有的 emoji 字符都能被修饰,这里有可被修饰的 emoji 字符列表。例如,U+270D(✍️) 就是一个可以被修饰的 emoji 字符,那么它被 U+1F3FF 修饰后就会变成U+270D U+1F3FF(✍️🏿)。如果你在手机上,应该能看出不同之处了, 被修饰的 emoji 颜色变深了,PC 上该新 emoji 会被显示为两上方框。

  3. Flag Sequence。这类 emoji 串是通过两个地域指示符(regional_indicator) 组合的方式来表示一个国家的国旗。总共有 26 个地域指示符,每个指示符又对应于一个英文字母含义,例如 U+1F1E8 为地域指示符 C, U+1F1F3 为地域指示符 N。这些指示符两两组合表示一个国旗,U+1F1E8 U+1F1F3 为中国国旗(🇨🇳)。并不是 26 x 26 种组合是全部合法的,合法的 Flag Sequence 只有 256 种

  4. KeyCap Sequence。这类 emoji 序列是将数字(0-9),* 与 # 通过一个 U+20E3 字符转换为键帽的样式。由于这种样式要求必须以 emoji 风格展示,所有会在序列中添加样式限制 U+FE0F。例如 U+0023 U+FE0F U+20E3 的 emoji 样式即是 #️⃣,U+0030 U+FE0F U+20E3 的 emoji 样式即是 0️⃣。其它与此类似。

  5. ZWJ sequence。ZWJ emoji 序列即是通过 ZWJ 字符(U+200D, Zero Width Joiner)将基本 emoji 字符或Emoji_Modifier_Sequence连接起来,形成一个新的 emoji 表示样式。ZWJ 序列可参见这里。例如,U+1F468 U+200D U+1F469 U+200D U+1F467 (👨‍👩‍👧) 这个 emoji 表示家庭即由三个emoji字符,U+1F468(👨), U+1F469(👩), U+1F467(👧) 经 ZWJ 连接而成的。

  6. Tag Sequence。Tag Sequence 由 tag_base tag_spec 与 tag_term 拼接而成的 emoji 序列串。其中 tag_base 可以是基本 emoji 字符,也可以是emoji_modifier_sequence 或者 emoji_presentation_sequence。 tag_spec 允许是从 U+E0020 到 U+E007E 的所有字符,而 tag_term 为U+E007F 作为结束符。目前只有三个合法 tag sequence,这种方式主要用于未来扩展使用。

方便看到 emoji 的效果,以下是文章截图:

final.jpg
最后编辑于
©著作权归作者所有,转载或内容合作请联系作者
  • 序言:七十年代末,一起剥皮案震惊了整个滨河市,随后出现的几起案子,更是在滨河造成了极大的恐慌,老刑警刘岩,带你破解...
    沈念sama阅读 159,015评论 4 362
  • 序言:滨河连续发生了三起死亡事件,死亡现场离奇诡异,居然都是意外死亡,警方通过查阅死者的电脑和手机,发现死者居然都...
    沈念sama阅读 67,262评论 1 292
  • 文/潘晓璐 我一进店门,熙熙楼的掌柜王于贵愁眉苦脸地迎上来,“玉大人,你说我怎么就摊上这事。” “怎么了?”我有些...
    开封第一讲书人阅读 108,727评论 0 243
  • 文/不坏的土叔 我叫张陵,是天一观的道长。 经常有香客问我,道长,这世上最难降的妖魔是什么? 我笑而不...
    开封第一讲书人阅读 43,986评论 0 205
  • 正文 为了忘掉前任,我火速办了婚礼,结果婚礼上,老公的妹妹穿的比我还像新娘。我一直安慰自己,他们只是感情好,可当我...
    茶点故事阅读 52,363评论 3 287
  • 文/花漫 我一把揭开白布。 她就那样静静地躺着,像睡着了一般。 火红的嫁衣衬着肌肤如雪。 梳的纹丝不乱的头发上,一...
    开封第一讲书人阅读 40,610评论 1 219
  • 那天,我揣着相机与录音,去河边找鬼。 笑死,一个胖子当着我的面吹牛,可吹牛的内容都是我干的。 我是一名探鬼主播,决...
    沈念sama阅读 31,871评论 2 312
  • 文/苍兰香墨 我猛地睁开眼,长吁一口气:“原来是场噩梦啊……” “哼!你这毒妇竟也来了?” 一声冷哼从身侧响起,我...
    开封第一讲书人阅读 30,582评论 0 198
  • 序言:老挝万荣一对情侣失踪,失踪者是张志新(化名)和其女友刘颖,没想到半个月后,有当地人在树林里发现了一具尸体,经...
    沈念sama阅读 34,297评论 1 242
  • 正文 独居荒郊野岭守林人离奇死亡,尸身上长有42处带血的脓包…… 初始之章·张勋 以下内容为张勋视角 年9月15日...
    茶点故事阅读 30,551评论 2 246
  • 正文 我和宋清朗相恋三年,在试婚纱的时候发现自己被绿了。 大学时的朋友给我发了我未婚夫和他白月光在一起吃饭的照片。...
    茶点故事阅读 32,053评论 1 260
  • 序言:一个原本活蹦乱跳的男人离奇死亡,死状恐怖,灵堂内的尸体忽然破棺而出,到底是诈尸还是另有隐情,我是刑警宁泽,带...
    沈念sama阅读 28,385评论 2 253
  • 正文 年R本政府宣布,位于F岛的核电站,受9级特大地震影响,放射性物质发生泄漏。R本人自食恶果不足惜,却给世界环境...
    茶点故事阅读 33,035评论 3 236
  • 文/蒙蒙 一、第九天 我趴在偏房一处隐蔽的房顶上张望。 院中可真热闹,春花似锦、人声如沸。这庄子的主人今日做“春日...
    开封第一讲书人阅读 26,079评论 0 8
  • 文/苍兰香墨 我抬头看了看天上的太阳。三九已至,却和暖如春,着一层夹袄步出监牢的瞬间,已是汗流浃背。 一阵脚步声响...
    开封第一讲书人阅读 26,841评论 0 195
  • 我被黑心中介骗来泰国打工, 没想到刚下飞机就差点儿被人妖公主榨干…… 1. 我叫王不留,地道东北人。 一个月前我还...
    沈念sama阅读 35,648评论 2 274
  • 正文 我出身青楼,却偏偏与公主长得像,于是被迫代替她去往敌国和亲。 传闻我的和亲对象是个残疾皇子,可洞房花烛夜当晚...
    茶点故事阅读 35,550评论 2 270

推荐阅读更多精彩内容