drop headers and abbreviate descriptions
[unicode-sampler.git] / unicode.txt
1
2 UTF-8 encoded sample plain-text file
3 ‾‾‾‾‾‾‾‾‾‾‾‾‾‾‾‾‾‾‾‾‾‾‾‾‾‾‾‾‾‾‾‾‾‾‾‾
4
5 Markus Kuhn [ˈmaʳkʊs kuːn] <http://www.cl.cam.ac.uk/~mgk25/> — 2002-07-25
6
7
8 The ASCII compatible UTF-8 encoding used in this plain-text file
9 is defined in Unicode, ISO 10646-1, and RFC 2279.
10
11
12 Using Unicode/UTF-8, you can write in emails and source code things such as
13
14 Mathematics and sciences:
15
16   ∮ E⋅da = Q,  n → ∞, ∑ f(i) = ∏ g(i),      ⎧⎡⎛┌─────┐⎞⎤⎫
17                                             ⎪⎢⎜│a²+b³ ⎟⎥⎪
18   ∀x∈ℝ: ⌈x⌉ = −⌊−x⌋, α ∧ ¬β = ¬(¬α ∨ β),    ⎪⎢⎜│───── ⎟⎥⎪
19                                             ⎪⎢⎜⎷ c₈   ⎟⎥⎪
20   ℕ ⊆ ℕ₀ ⊂ ℤ ⊂ ℚ ⊂ ℝ ⊂ ℂ,                   ⎨⎢⎜       ⎟⎥⎬
21                                             ⎪⎢⎜ ∞     ⎟⎥⎪
22   ⊥ < a ≠ b ≡ c ≤ d ≪ ⊤ ⇒ (⟦A⟧ ⇔ ⟪B⟫),      ⎪⎢⎜ ⎲     ⎟⎥⎪
23                                             ⎪⎢⎜ ⎳aⁱ-bⁱ⎟⎥⎪
24   2H₂ + O₂ ⇌ 2H₂O, R = 4.7 kΩ, ⌀ 200 mm     ⎩⎣⎝i=1    ⎠⎦⎭
25
26 Linguistics and dictionaries:
27
28   ði ıntəˈnæʃənəl fəˈnɛtık əsoʊsiˈeıʃn
29   Y [ˈʏpsilɔn], Yen [jɛn], Yoga [ˈjoːgɑ]
30
31 APL:
32
33   ((V⍳V)=⍳⍴V)/V←,V    ⌷←⍳→⍴∆∇⊃‾⍎⍕⌈
34
35 Nicer typography in plain text files:
36
37   ╔══════════════════════════════════════════╗
38   ║                                          ║
39   ║   • ‘single’ and “double” quotes         ║
40   ║                                          ║
41   ║   • Curly apostrophes: “We’ve been here” ║
42   ║                                          ║
43   ║   • Latin-1 apostrophe and accents: '´`  ║
44   ║                                          ║
45   ║   • ‚deutsche‘ „Anführungszeichen“       ║
46   ║                                          ║
47   ║   • †, ‡, ‰, •, 3–4, —, −5/+5, ™, …      ║
48   ║                                          ║
49   ║   • ASCII safety test: 1lI|, 0OD, 8B     ║
50   ║                      ╭─────────╮         ║
51   ║   • the euro symbol: │ 14.95 € │         ║
52   ║                      ╰─────────╯         ║
53   ╚══════════════════════════════════════════╝
54
55 Combining characters:
56
57   STARGΛ̊TE SG-1, a = v̇ = r̈, a⃑ ⊥ b⃑
58
59 Greek (Polytonic):
60
61   Σὲ γνωρίζω ἀπὸ τὴν κόψη
62   τοῦ σπαθιοῦ τὴν τρομερή,
63   σὲ γνωρίζω ἀπὸ τὴν ὄψη
64   ποὺ μὲ βία μετράει τὴ γῆ.
65
66   ᾿Απ᾿ τὰ κόκκαλα βγαλμένη
67   τῶν ῾Ελλήνων τὰ ἱερά
68   καὶ σὰν πρῶτα ἀνδρειωμένη
69   χαῖρε, ὦ χαῖρε, ᾿Ελευθεριά!
70
71   Οὐχὶ ταὐτὰ παρίσταταί μοι γιγνώσκειν, ὦ ἄνδρες ᾿Αθηναῖοι,
72   ὅταν τ᾿ εἰς τὰ πράγματα ἀποβλέψω καὶ ὅταν πρὸς τοὺς
73   λόγους οὓς ἀκούω· τοὺς μὲν γὰρ λόγους περὶ τοῦ
74   τιμωρήσασθαι Φίλιππον ὁρῶ γιγνομένους, τὰ δὲ πράγματ᾿
75   εἰς τοῦτο προήκοντα,  ὥσθ᾿ ὅπως μὴ πεισόμεθ᾿ αὐτοὶ
76   πρότερον κακῶς σκέψασθαι δέον. οὐδέν οὖν ἄλλο μοι δοκοῦσιν
77   οἱ τὰ τοιαῦτα λέγοντες ἢ τὴν ὑπόθεσιν, περὶ ἧς βουλεύεσθαι,
78   οὐχὶ τὴν οὖσαν παριστάντες ὑμῖν ἁμαρτάνειν. ἐγὼ δέ, ὅτι μέν
79   ποτ᾿ ἐξῆν τῇ πόλει καὶ τὰ αὑτῆς ἔχειν ἀσφαλῶς καὶ Φίλιππον
80   τιμωρήσασθαι, καὶ μάλ᾿ ἀκριβῶς οἶδα· ἐπ᾿ ἐμοῦ γάρ, οὐ πάλαι
81   γέγονεν ταῦτ᾿ ἀμφότερα· νῦν μέντοι πέπεισμαι τοῦθ᾿ ἱκανὸν
82   προλαβεῖν ἡμῖν εἶναι τὴν πρώτην, ὅπως τοὺς συμμάχους
83   σώσομεν. ἐὰν γὰρ τοῦτο βεβαίως ὑπάρξῃ, τότε καὶ περὶ τοῦ
84   τίνα τιμωρήσεταί τις καὶ ὃν τρόπον ἐξέσται σκοπεῖν· πρὶν δὲ
85   τὴν ἀρχὴν ὀρθῶς ὑποθέσθαι, μάταιον ἡγοῦμαι περὶ τῆς
86   τελευτῆς ὁντινοῦν ποιεῖσθαι λόγον.
87                                   Δημοσθένους, Γ´ ᾿Ολυνθιακὸς
88
89 Georgian:
90
91   გთხოვთ ახლავე გაიაროთ რეგისტრაცია Unicode-ის მეათე საერთაშორისო
92   კონფერენციაზე დასასწრებად, რომელიც გაიმართება 10-12 მარტს,
93   ქ. მაინცში, გერმანიაში. კონფერენცია შეჰკრებს ერთად მსოფლიოს
94   ექსპერტებს ისეთ დარგებში როგორიცაა ინტერნეტი და Unicode-ი,
95   ინტერნაციონალიზაცია და ლოკალიზაცია, Unicode-ის გამოყენება
96   ოპერაციულ სისტემებსა, და გამოყენებით პროგრამებში, შრიფტებში,
97   ტექსტების დამუშავებასა და მრავალენოვან კომპიუტერულ სისტემებში.
98
99 Russian:
100
101   Зарегистрируйтесь сейчас на Десятую Международную Конференцию по
102   Unicode, которая состоится 10-12 марта 1997 года в Майнце в Германии.
103   Конференция соберет широкий круг экспертов по  вопросам глобального
104   Интернета и Unicode, локализации и интернационализации, воплощению и
105   применению Unicode в различных операционных системах и программных
106   приложениях, шрифтах, верстке и многоязычных компьютерных системах.
107
108 Hebrew:
109
110   כאשר העולם רוצה לדבר, הוא מדבר ב־Unicode. הירשמו כעת לכנס Unicode
111   הבינלאומי העשירי, שייערך בין התאריכים 12־10 במרץ 1997, בְּמָיְינְץ שבגרמניה.
112
113 Hindi:
114
115   हालाँकि सूर के जीवन के बारे में कई जनश्रुतियाँ प्रचलित
116   हैं, पर इन में कितनी सच्चाई है यह कहना कठिन है।
117   कहा जाता है उनका जन्म सन् १४७८
118   में दिल्ली के पास एक ग़रीब ब्राह्मीण परिवार में हुआ।
119   जनश्रुति के अनुसार सूरदास जन्म से ही अंधे थे। आजकल थी
120   अंधे आदमी अक्सर 'सूरदास' कहलाते हैं। कई लोगों ने उन्हें गुरु के
121   रूप में अपनाया और उनकी पूजा करना शुरु कर दिया ।
122
123 Thai (UCS Level 2):
124
125     ๏ แผ่นดินฮั่นเสื่อมโทรมแสนสังเวช  พระปกเกศกองบู๊กู้ขึ้นใหม่
126   สิบสองกษัตริย์ก่อนหน้าแลถัดไป       สององค์ไซร้โง่เขลาเบาปัญญา
127     ทรงนับถือขันทีเป็นที่พึ่ง           บ้านเมืองจึงวิปริตเป็นนักหนา
128   โฮจิ๋นเรียกทัพทั่วหัวเมืองมา         หมายจะฆ่ามดชั่วตัวสำคัญ
129     เหมือนขับไสไล่เสือจากเคหา      รับหมาป่าเข้ามาเลยอาสัญ
130   ฝ่ายอ้องอุ้นยุแยกให้แตกกัน          ใช้สาวนั้นเป็นชนวนชื่นชวนใจ
131     พลันลิฉุยกุยกีกลับก่อเหตุ          ช่างอาเพศจริงหนาฟ้าร้องไห้
132   ต้องรบราฆ่าฟันจนบรรลัย           ฤๅหาใครค้ำชูกู้บรรลังก์ ฯ
133   [----------------------------|------------------------]
134    (second column should align ⬏)
135
136 Ethiopian:
137
138   ሰማይ አይታረስ ንጉሥ አይከሰስ።
139   ብላ ካለኝ እንደአባቴ በቆመጠኝ።
140   ጌጥ ያለቤቱ ቁምጥና ነው።
141   ደሀ በሕልሙ ቅቤ ባይጠጣ ንጣት በገደለው።
142   የአፍ ወለምታ በቅቤ አይታሽም።
143   አይጥ በበላ ዳዋ ተመታ።
144   ሲተረጉሙ ይደረግሙ።
145   ቀስ በቀስ፥ ዕንቁላል በእግሩ ይሄዳል።
146   ድር ቢያብር አንበሳ ያስር።
147   ሰው እንደቤቱ እንጅ እንደ ጉረቤቱ አይተዳደርም።
148   እግዜር የከፈተውን ጉሮሮ ሳይዘጋው አይድርም።
149   የጎረቤት ሌባ፥ ቢያዩት ይስቅ ባያዩት ያጠልቅ።
150   ሥራ ከመፍታት ልጄን ላፋታት።
151   ዓባይ ማደሪያ የለው፥ ግንድ ይዞ ይዞራል።
152   የእስላም አገሩ መካ የአሞራ አገሩ ዋርካ።
153   ተንጋሎ ቢተፉ ተመልሶ ባፉ።
154   ወዳጅህ ማር ቢሆን ጨርስህ አትላሰው።
155   እግርህን በፍራሽህ ልክ ዘርጋ።
156
157 Ænglisc:
158
159   ᚻᛖ ᚳᚹᚫᚦ ᚦᚫᛏ ᚻᛖ ᛒᚢᛞᛖ ᚩᚾ ᚦᚫᛗ ᛚᚪᚾᛞᛖ ᚾᚩᚱᚦᚹᛖᚪᚱᛞᚢᛗ ᚹᛁᚦ ᚦᚪ ᚹᛖᛥᚫ
160
161   Hē cƿæð þæt hē būde on þǣm lande norðƿeardum ƿið þā Ƿestſǣ.
162   He said that he lived in the northern land near the Western Sea.
163
164 Braille:
165
166   ⡌⠁⠧⠑ ⠼⠁⠒  ⡍⠜⠇⠑⠹⠰⠎ ⡣⠕⠌
167
168   ⡍⠜⠇⠑⠹ ⠺⠁⠎ ⠙⠑⠁⠙⠒ ⠞⠕ ⠃⠑⠛⠔ ⠺⠊⠹⠲ ⡹⠻⠑ ⠊⠎ ⠝⠕ ⠙⠳⠃⠞
169   ⠱⠁⠞⠑⠧⠻ ⠁⠃⠳⠞ ⠹⠁⠞⠲ ⡹⠑ ⠗⠑⠛⠊⠌⠻ ⠕⠋ ⠙⠊⠎ ⠃⠥⠗⠊⠁⠇ ⠺⠁⠎
170   ⠎⠊⠛⠝⠫ ⠃⠹ ⠹⠑ ⠊⠇⠻⠛⠹⠍⠁⠝⠂ ⠹⠑ ⠊⠇⠻⠅⠂ ⠹⠑ ⠥⠝⠙⠻⠞⠁⠅⠻⠂
171   ⠁⠝⠙ ⠹⠑ ⠡⠊⠑⠋ ⠍⠳⠗⠝⠻⠲ ⡎⠊⠗⠕⠕⠛⠑ ⠎⠊⠛⠝⠫ ⠊⠞⠲ ⡁⠝⠙
172   ⡎⠊⠗⠕⠕⠛⠑⠰⠎ ⠝⠁⠍⠑ ⠺⠁⠎ ⠛⠕⠕⠙ ⠥⠏⠕⠝ ⠰⡡⠁⠝⠛⠑⠂ ⠋⠕⠗ ⠁⠝⠹⠹⠔⠛ ⠙⠑
173   ⠡⠕⠎⠑ ⠞⠕ ⠏⠥⠞ ⠙⠊⠎ ⠙⠁⠝⠙ ⠞⠕⠲
174
175   ⡕⠇⠙ ⡍⠜⠇⠑⠹ ⠺⠁⠎ ⠁⠎ ⠙⠑⠁⠙ ⠁⠎ ⠁ ⠙⠕⠕⠗⠤⠝⠁⠊⠇⠲
176
177   ⡍⠔⠙⠖ ⡊ ⠙⠕⠝⠰⠞ ⠍⠑⠁⠝ ⠞⠕ ⠎⠁⠹ ⠹⠁⠞ ⡊ ⠅⠝⠪⠂ ⠕⠋ ⠍⠹
178   ⠪⠝ ⠅⠝⠪⠇⠫⠛⠑⠂ ⠱⠁⠞ ⠹⠻⠑ ⠊⠎ ⠏⠜⠞⠊⠊⠥⠇⠜⠇⠹ ⠙⠑⠁⠙ ⠁⠃⠳⠞
179   ⠁ ⠙⠕⠕⠗⠤⠝⠁⠊⠇⠲ ⡊ ⠍⠊⠣⠞ ⠙⠁⠧⠑ ⠃⠑⠲ ⠔⠊⠇⠔⠫⠂ ⠍⠹⠎⠑⠇⠋⠂ ⠞⠕
180   ⠗⠑⠛⠜⠙ ⠁ ⠊⠕⠋⠋⠔⠤⠝⠁⠊⠇ ⠁⠎ ⠹⠑ ⠙⠑⠁⠙⠑⠌ ⠏⠊⠑⠊⠑ ⠕⠋ ⠊⠗⠕⠝⠍⠕⠝⠛⠻⠹
181   ⠔ ⠹⠑ ⠞⠗⠁⠙⠑⠲ ⡃⠥⠞ ⠹⠑ ⠺⠊⠎⠙⠕⠍ ⠕⠋ ⠳⠗ ⠁⠝⠊⠑⠌⠕⠗⠎
182   ⠊⠎ ⠔ ⠹⠑ ⠎⠊⠍⠊⠇⠑⠆ ⠁⠝⠙ ⠍⠹ ⠥⠝⠙⠁⠇⠇⠪⠫ ⠙⠁⠝⠙⠎
183   ⠩⠁⠇⠇ ⠝⠕⠞ ⠙⠊⠌⠥⠗⠃ ⠊⠞⠂ ⠕⠗ ⠹⠑ ⡊⠳⠝⠞⠗⠹⠰⠎ ⠙⠕⠝⠑ ⠋⠕⠗⠲ ⡹⠳
184   ⠺⠊⠇⠇ ⠹⠻⠑⠋⠕⠗⠑ ⠏⠻⠍⠊⠞ ⠍⠑ ⠞⠕ ⠗⠑⠏⠑⠁⠞⠂ ⠑⠍⠏⠙⠁⠞⠊⠊⠁⠇⠇⠹⠂ ⠹⠁⠞
185   ⡍⠜⠇⠑⠹ ⠺⠁⠎ ⠁⠎ ⠙⠑⠁⠙ ⠁⠎ ⠁ ⠙⠕⠕⠗⠤⠝⠁⠊⠇⠲
186
187 Compact font selection example text:
188
189   ABCDEFGHIJKLMNOPQRSTUVWXYZ /0123456789
190   abcdefghijklmnopqrstuvwxyz £©µÀÆÖÞßéöÿ
191   –—‘“”„†•…‰™œŠŸž€ ΑΒΓΔΩαβγδω АБВГДабвгд
192   ∀∂∈ℝ∧∪≡∞ ↑↗↨↻⇣ ┐┼╔╘░►☺♀ fi�⑀₂ἠḂӥẄɐː⍎אԱა
193
194 Greetings in various languages:
195
196   Hello world, Καλημέρα κόσμε, コンニチハ
197
198 Box drawing alignment tests:                                          █
199                                                                       ▉
200   ╔══╦══╗  ┌──┬──┐  ╭──┬──╮  ╭──┬──╮  ┏━━┳━━┓  ┎┒┏┑   ╷  ╻ ┏┯┓ ┌┰┐    ▊ ╱╲╱╲╳╳╳
201   ║┌─╨─┐║  │╔═╧═╗│  │╒═╪═╕│  │╓─╁─╖│  ┃┌─╂─┐┃  ┗╃╄┙  ╶┼╴╺╋╸┠┼┨ ┝╋┥    ▋ ╲╱╲╱╳╳╳
202   ║│╲ ╱│║  │║   ║│  ││ │ ││  │║ ┃ ║│  ┃│ ╿ │┃  ┍╅╆┓   ╵  ╹ ┗┷┛ └┸┘    ▌ ╱╲╱╲╳╳╳
203   ╠╡ ╳ ╞╣  ├╢   ╟┤  ├┼─┼─┼┤  ├╫─╂─╫┤  ┣┿╾┼╼┿┫  ┕┛┖┚     ┌┄┄┐ ╎ ┏┅┅┓ ┋ ▍ ╲╱╲╱╳╳╳
204   ║│╱ ╲│║  │║   ║│  ││ │ ││  │║ ┃ ║│  ┃│ ╽ │┃  ░░▒▒▓▓██ ┊  ┆ ╎ ╏  ┇ ┋ ▎
205   ║└─╥─┘║  │╚═╤═╝│  │╘═╪═╛│  │╙─╀─╜│  ┃└─╂─┘┃  ░░▒▒▓▓██ ┊  ┆ ╎ ╏  ┇ ┋ ▏
206   ╚══╩══╝  └──┴──┘  ╰──┴──╯  ╰──┴──╯  ┗━━┻━━┛  ▗▄▖▛▀▜   └╌╌┘ ╎ ┗╍╍┛ ┋  ▁▂▃▄▅▆▇█
207                                                ▝▀▘▙▄▟