-
Data: 2011-05-24 22:18:12
Temat: Re: Unicode powyżej BMP
Od: Zbigniew Malec <a...@i...invalid> szukaj wiadomości tego autora
[ pokaż wszystkie nagłówki ]On Tue, 24 May 2011 19:55:45 +0200, Borneq wrote:
> W takich językach jak Java czy C# znak jest dwubajtowy. Jednak nie możemy
> przyjąć że każdy kod odpowiada jednemu znakowi i że str[5] jest piątym
> licząc od zera znakiem. Chodzi mi o specjalne znaki o kodach powyżej 65535,
> składane z dwóch połówek ("surogatów")
> http://en.wikipedia.org/wiki/Plane_%28Unicode%29
> Czy warto się tym przejmować?
A jaką aplikację piszesz? Jeżeli jest tam szansa na pojawienie się znaków
powyżej 16bit, to tak, trzeba się przejmować. Jak nie, to nie trzeba.
Jeżeli chodzi o Javę, to zgadza się, znak jest tam dwubajtowy, jednak cały
czas masz możliwość równoległego operowania na code point (chociażby
String.codePointAt), więc tutaj nie ma problemów.
Generalnie z szerokimi znaczkami (szerszymi niż 7bitów) jest zawsze problem
i to nie tylko po stronie danego języka i jego wewnętrznych mechanizmów
implementacji typów napisowych, ale właściwie na każdym kroku, m.in:
- warstwa IO - w jakim kodowaniu jest plik? Jak warstwa IO radzi sobie z
konwersją między danym kodowaniem a innym?
- bazy danych - co z tego, że twój program działa doskonale dla wszystkich
możliwych kodowań, jeżeli okazuje się, że twoja baza danych przechowuje
dane w kodowaniu iso-8859-2?
- gui - zestaw kontrolek do wyświetlania szerokich znaków
- interakcja z innymi systemami
itd.
> Znaki chińskie i japońskie mieszczą się w planie podstawowym od 0x4e00 do
> 0x9fff (miejsce na ponad 20 tys. ideogramów)
> Czy używane są znaki powyżej granicy 64 Ki, jakie fonty je używają aby
> przetestować? Czy tekst złożony z dwóch surogatów podany do TextOut da w
> rezultacie wyrysowany jeden znak?
W Javie jest to łatwe do sprawdzenia (C# tak dobrze nie znam, możliwe, że
też):
int[] highCodePoint = { 0xFFFFF };
String highCodePointString = new String(highCodePoint, 0, 1 };
JOptionPane.showInputDialog(null, highCodePointString.
highCodePointString);
albo coś takiego.
--
Pozdrawiam
Zbyszek Malec
Następne wpisy z tego wątku
- 24.05.11 22:51 Borneq
- 24.05.11 23:13 Borneq
- 24.05.11 23:10 Wiktor S.
- 24.05.11 23:13 Wiktor S.
- 25.05.11 19:25 Zbigniew Malec
- 25.05.11 20:49 Zbigniew Malec
- 26.05.11 05:26 Wiktor S.
- 26.05.11 07:18 Zbigniew Malec
Najnowsze wątki z tej grupy
- Xiaomi [Chiny - przyp. JMJ] produkuje w całkowitych ciemnościach i bez ludzi
- Prezydent SZAP/USONA Trump ułaskawił prezydenta Hondurasu Hernandeza skazanego na 45 lat więzienia
- Rosjanie chwalą się prototypem komputera kwantowego. "Najważniejszy projekt naukowy Rosji"
- A Szwajcarzy kombinują tak: FinalSpark grows human neurons from stem cells and connects them to electrode arrays
- Re: Najgorszy język programowania
- NOWY: 2025-09-29 Alg., Strukt. Danych i Tech. Prog. - komentarz.pdf
- Na grupie comp.os.linux.advocacy CrudeSausage twierdzi, że Micro$lop używa SI do szyfrowania formatu dok. XML
- Błąd w Sofcie Powodem Wymiany 3 Duńskich Fregat Typu Iver Huitfeldt
- Grok zaczął nadużywać wulgaryzmów i wprost obrażać niektóre znane osoby
- Can you activate BMW 48V 10Ah Li-Ion battery, connecting to CAN-USB laptop interface ?
- We Wrocławiu ruszyła Odra 5, pierwszy w Polsce komputer kwantowy z nadprzewodzącymi kubitami
- Ada-Europe - AEiC 2025 early registration deadline imminent
- John Carmack twierdzi, że gdyby gry były optymalizowane, to wystarczyły by stare kompy
- Ada-Europe Int.Conf. Reliable Software Technologies, AEiC 2025
- Linuks od wer. 6.15 przestanie wspierać procesory 486 i będzie wymagać min. Pentium
Najnowsze wątki
- 2026-01-29 KSeF - 13 wątpliwości
- 2026-01-29 A ja się pochwalę
- 2026-01-29 Warszawa => Mid/Senior IT Recruiter <=
- 2026-01-29 Warszawa => Senior Java Developer <=
- 2026-01-29 Warszawa => IT Recruiter <=
- 2026-01-28 Degradacja
- 2026-01-28 Wysoki Sąd poinstruował czego unikać wyzywając Owsiaka "Równiejszego"
- 2026-01-28 Białystok => Solution Architect (Workday) - Legal Systems <=
- 2026-01-28 Białystok => Preseles Inżynier (background baz danych) <=
- 2026-01-28 Wrocław => Konsultant wdrożeniowy ERP <=
- 2026-01-28 Łódź => Microsoft Engineer <=
- 2026-01-28 Białystok => Tester manualny <=
- 2026-01-27 Tradycja ciągania posłów po sądach za wystąpienia w Sejmie będzie kontynuowana [Lepper 2]
- 2026-01-27 Pierwszy raz sprzedano więcej samochodów zeeletryfikowanych niż ice
- 2026-01-27 Elektryczny Kałasznikow




Ceny mieszkań stabilne a zdolność kredytowa rośnie. O ile nie masz dzieci