Codage de HuffmanLe codage de Huffman est un algorithme de compression de données sans perte. Le codage de Huffman utilise un code à longueur variable pour représenter un symbole de la source (par exemple un caractère dans un fichier). Le code est déterminé à partir d'une estimation des probabilités d'apparition des symboles de source, un code court étant associé aux symboles de source les plus fréquents. Un code de Huffman est optimal au sens de la plus courte longueur pour un codage par symbole, et une distribution de probabilité connue.
Code préfixeUn code préfixe (ou code instantané) est un code ayant la particularité de ne posséder aucun mot du code ayant pour préfixe un autre mot du code. Autrement dit, aucun mot du code (ou symbole) d'un code préfixe ne peut se prolonger pour donner un autre mot du code (ou symbole). C'est une propriété souvent recherchée pour les codes à longueur variable, afin de pouvoir les décoder lorsque plusieurs symboles sont concaténés les uns aux autres sans qu'il soit nécessaire d'utiliser des séparateurs (les séparateurs rendent préfixes des codes non préfixes).
Entropie de ShannonEn théorie de l'information, l'entropie de Shannon, ou plus simplement entropie, est une fonction mathématique qui, intuitivement, correspond à la quantité d'information contenue ou délivrée par une source d'information. Cette source peut être un texte écrit dans une langue donnée, un signal électrique ou encore un fichier informatique quelconque (suite d'octets). Elle a été introduite par Claude Shannon. Du point de vue d'un récepteur, plus la source émet d'informations différentes, plus l'entropie (ou incertitude sur ce que la source émet) est grande.
Korean mixed scriptKorean mixed script () is a form of writing the Korean language that uses a mixture of the Korean alphabet or Hangul () and Hanja (, ), the Korean name for Chinese characters. The distribution on how to write words usually follows that all native Korean words, including suffixes, particles, and honorific markers are generally written in hangul and never in hanja. Sino-Korean vocabulary or hanja-eo (), either words borrowed from Chinese or created from Sino-Korean roots, were generally always written in hanja, although very rare or complex characters were often substituted with hangul.
CoréenLe coréen est une langue parlée en Corée, dans les districts frontaliers de la République populaire de Chine (Yanbian) et dans les communautés émigrées (notamment au Japon, en Chine (Pékin, Shandong), en Russie, en Australie, aux États-Unis, en France, etc.), et est la langue officielle de la Corée du Nord et de la Corée du Sud. Si le coréen était anciennement considéré comme un isolat, les études les plus récentes considèrent qu'il fait partie des langues coréaniques, dont il est le seul survivant.
Afficher plus