
Новые сообщения [новые:0]
Дайджест
Горячие темы
Избранное [новые:0]
Форумы
Пользователи
Статистика
Статистика нагрузки
Мод. лог
Поиск
|
|
03.03.2013, 15:53:21
|
|||
|---|---|---|---|
|
|||
Удалить кроказябры из строки |
|||
|
#18+
Добрый день! Скажите, пожалуйста, есть ли функция, которая принимает на вход строку, на выходе дает строку, из которой убраны все символы неправильной кодировки? Мне это нужно в задаче, где сначала строка в ANSI, затем - UTF-8. Т.е. в итоге должен быть валидный юникод ... |
|||
|
:
Нравится:
Не нравится:
|
|||
|
|
|
03.03.2013, 20:29:04
|
|||
|---|---|---|---|
Удалить кроказябры из строки |
|||
|
#18+
antake...Мне это нужно в задаче, где сначала строка в ANSI, затем - UTF-8. Т.е. в итоге должен быть валидный юникод Дык, юникод или утф-8? Нифига не понял. ... |
|||
|
:
Нравится:
Не нравится:
|
|||
|
|
|
03.03.2013, 22:02:29
|
|||
|---|---|---|---|
|
|||
Удалить кроказябры из строки |
|||
|
#18+
antakeСкажите, пожалуйста, есть ли функция, которая принимает на вход строку, на выходе дает строку, из которой убраны все символы неправильной кодировки? Мне это нужно в задаче, где сначала строка в ANSI, затем - UTF-8. Т.е. в итоге должен быть валидный юникод Все символы, которые есть в кодеровке ANSI также есть и в UTF-8. Не думаю, что такой критерий правильности символов уместен. У класса Character есть методы isLetter, isDigit, isISOControl и т.д. Или нужно просто перекодировать файл из ANSI в UTF-8? ... |
|||
|
:
Нравится:
Не нравится:
|
|||
|
|
|
04.03.2013, 16:24:33
|
|||
|---|---|---|---|
|
|||
Удалить кроказябры из строки |
|||
|
#18+
antakeМне это нужно в задаче, где сначала строка в ANSI, затем - UTF-8. Т.е. в итоге должен быть валидный юникодANSI-кодировки являются подмножеством utf8. Поэтому, если исключить тривиальную ошибку, не очень понятно, как вы собрались получить "вопросики" в utf8. ... |
|||
|
:
Нравится:
Не нравится:
|
|||
|
|
|
04.03.2013, 17:00:23
|
|||
|---|---|---|---|
Удалить кроказябры из строки |
|||
|
#18+
Полагаю, вам надо, руководствуясь этой http://ru.wikipedia.org/wiki/UTF-8 статьей, перевести строку в байты Unicode, затем удалить побайтово последовательности, которые "не используется в Unicode". Или удалить какие-нибудь ещё символы, которые у вас считаются кракозябликами. ... |
|||
|
:
Нравится:
Не нравится:
|
|||
|
|
|

start [/forum/topic.php?fid=59&tablet=1&tid=2129856]: |
0ms |
get settings: |
13ms |
get forum list: |
16ms |
check forum access: |
4ms |
check topic access: |
4ms |
track hit: |
43ms |
get topic data: |
13ms |
get forum data: |
4ms |
get page messages: |
50ms |
get tp. blocked users: |
2ms |
| others: | 284ms |
| total: | 433ms |

| 0 / 0 |
