Unicode Character Database

E26667

The Unicode Character Database is a comprehensive collection of machine-readable data files that define the properties, classifications, and behaviors of every character encoded in the Unicode Standard.

All labels observed (9)

How this entity was disambiguated

Statements (68)

Predicate Object
instanceOf machine-readable data collection
technical standard component
accessURL https://www.unicode.org/Public/UCD/
covers every encoded Unicode character
dataFormat machine-readable files
plain text files
defines Unicode character behaviors
Unicode character classifications
Unicode character properties
definesProperty Bidi_Class
Block
Canonical_Combining_Class
Case_Folding
Decomposition_Mapping
East_Asian_Width
General_Category
Grapheme_Cluster_Break
Line_Break
Lowercase_Mapping
Normalization_Quick_Check
Numeric_Value
Script
Sentence_Break
Titlecase_Mapping
Uppercase_Mapping
Word_Break
documentedIn Unicode Standard Annex #44
hasAbbreviation UCD
includesFile ArabicShaping.txt
BidiMirroring.txt
Blocks.txt
CaseFolding.txt
DerivedAge.txt
DerivedCoreProperties.txt
DerivedNormalizationProps.txt
EastAsianWidth.txt
HangulSyllableType.txt
IndicPositionalCategory.txt
IndicSyllabicCategory.txt
Jamo.txt
LineBreak.txt
NameAliases.txt
NormalizationProps.txt
PropList.txt
Scripts.txt
SpecialCasing.txt
UnicodeData.txt
introducedBy Unicode Consortium technical committee
license Unicode License
maintainedBy Unicode Consortium
partOf Unicode Standard
linked to: Unicode
primaryAudience font and rendering engine developers
implementers of Unicode
software developers
provides default property values for characters
stability guarantees for properties
scope all assigned Unicode code points
some unassigned code points with default properties
UAXNumber UAX #44
updatedWhen new Unicode version is released
usedFor bidirectional text algorithms
case conversion
collation
line breaking algorithms
normalization
text processing
text rendering
versionedWith Unicode Standard versions
linked to: Unicode 15.0

How these facts were elicited

Referenced by (24)

Full triples — surface form annotated when it differs from this entity's canonical label.

Unicode includesDatabase Unicode Character Database
Unicode Consortium maintainsStandard Unicode Character Database
Unicode Character Database defines Unicode character classifications
linked to: Unicode Character Database
Unicode Character Database UAXNumber UAX #44
linked to: Unicode Character Database
Unicode Technical Report #29 compatibleWith Unicode Character Database
Canadian Aboriginal syllabics hasUnicodeBlock Unified Canadian Aboriginal Syllabics
linked to: Unicode Character Database
Unicode 15.0 documentedIn Unicode Character Database
Unicode Core Specification relatedTo Unicode Character Database
UTS #10 conformsWith Unicode Character Database
Default Unicode Collation Element Table relatedTo Unicode Character Database
Mark Davis contributedTo Unicode character properties
linked to: Unicode Character Database
Mark Davis helpedStandardize Unicode character classification
linked to: Unicode Character Database
UTR #29 relatedTo Unicode Character Database
Grapheme_Cluster_Break partOf Unicode Character Database
Sentence_Break documentedIn Unicode Character Database
Unicode Standard Annexes includesTopic Unicode character database structure
linked to: Unicode Character Database
Unicode, Inc. governs Unicode Character Database
Unicode Technical Committee standardDeveloped Unicode Character Database
UCD fullName Unicode Character Database
UCD contains UnicodeData.txt
linked to: Unicode Character Database
UCD alsoKnownAs Unicode character property database
linked to: Unicode Character Database
Normalization_Quick_Check definedIn Unicode Character Database
Unicode License appliesTo Unicode Character Database
Unicode Standard code charts relatedTo Unicode Character Database