|
|
|
Парсинг на слова via String.split(), шаблон для игнора задвоенных CR/LF. Какой ?
|
|||
|---|---|---|---|
|
#18+
hi Необходимо прочесть входной файл и вытряхнуть из него только слова, отослав в игнор все переводы строки и знаки препинания. В следующем коде проблема в row.split(ptn): для строки, содержащей только разделитель из шаблона, возвращается массимв длины 1, а не 0. Код: java 1. 2. 3. 4. 5. 6. 7. 8. 9. 10. 11. 12. 13. 14. 15. 16. 17. 18. 19. 20. 21. 22. 23. 24. 25. 26. 27. 28. 29. Входной файл: Код: plaintext 1. 2. 3. 4. 5. 6. Output: Код: plaintext 1. 2. 3. 4. 5. 6. Надо что-то подсунуть в шаблон ptn, чтобы для row=>< (а на самом деле это перевод строки) row.split(ptn).length был = 0. Понятно, что можно предварительно проверять строку "на непусто", но хотелось бы обойтись без лишних операторов. Подскажите, плз, можно ли это сделать. ... |
|||
|
:
Нравится:
Не нравится:
|
|||
| 15.09.2013, 19:50:53 |
|
||
|
Парсинг на слова via String.split(), шаблон для игнора задвоенных CR/LF. Какой ?
|
|||
|---|---|---|---|
|
#18+
... вроде бы не получится :( http://docs.oracle.com/javase/1.4.2/docs/api/java/lang/String.html#split(java.lang.String, int) If the expression does not match any part of the input then the resulting array has just one element, namely this string . ... |
|||
|
:
Нравится:
Не нравится:
|
|||
| 15.09.2013, 23:54:28 |
|
||
|
Парсинг на слова via String.split(), шаблон для игнора задвоенных CR/LF. Какой ?
|
|||
|---|---|---|---|
|
#18+
ozzmosis Код: java 1. С этим паттерном все работает ... |
|||
|
:
Нравится:
Не нравится:
|
|||
| 16.09.2013, 04:16:32 |
|
||
|
Парсинг на слова via String.split(), шаблон для игнора задвоенных CR/LF. Какой ?
|
|||
|---|---|---|---|
|
#18+
UsmanС этим паттерном все работаетНет. Множественные переводы строк не схлопываются в одинарный: Код: java 1. 2. 3. 4. 5. 6. 7. 8. 9. 10. 11. 12. 13. 14. 15. 16. 17. 18. 19. 20. 21. 22. 23. 24. 25. 26. 27. 28. 29. 30. 31. 32. 33. 34. 35. 36. 37. 38. Код: plaintext 1. 2. 3. 4. 5. 6. 7. 8. 9. 10. 11. 12. 13. 14. 15. 16. 17. 18. 19. 20. 21. 22. ... |
|||
|
:
Нравится:
Не нравится:
|
|||
| 16.09.2013, 13:33:27 |
|
||
|
Парсинг на слова via String.split(), шаблон для игнора задвоенных CR/LF. Какой ?
|
|||
|---|---|---|---|
|
#18+
ozzmosisМножественные переводы строк не схлопываются в одинарныйВсмысле, подряд идущих? Если так, то все схлопывается за раз: Код: java 1. 2. ... |
|||
|
:
Нравится:
Не нравится:
|
|||
| 16.09.2013, 18:44:53 |
|
||
|
Парсинг на слова via String.split(), шаблон для игнора задвоенных CR/LF. Какой ?
|
|||
|---|---|---|---|
|
#18+
Usman, ну так почему тогда при чтении файла не схлопываются ? (при таком же паттерне, "\\W+"). Файлик - в аттаче. ... |
|||
|
:
Нравится:
Не нравится:
|
|||
| 16.09.2013, 19:04:55 |
|
||
|
Парсинг на слова via String.split(), шаблон для игнора задвоенных CR/LF. Какой ?
|
|||
|---|---|---|---|
|
#18+
ozzmosis, Вы неправильно схлопывали. Нужно было так: ;) Код: java 1. 2. 3. 4. 5. 6. 7. Или - для построчного считывания из файла: Код: java 1. 2. 3. 4. 5. 6. 7. 8. 9. 10. ... |
|||
|
:
Нравится:
Не нравится:
|
|||
| 16.09.2013, 19:33:33 |
|
||
|
|

start [/forum/topic.php?fid=59&msg=38398046&tid=2128589]: |
0ms |
get settings: |
18ms |
get forum list: |
21ms |
check forum access: |
5ms |
check topic access: |
5ms |
track hit: |
88ms |
get topic data: |
17ms |
get forum data: |
4ms |
get page messages: |
81ms |
get tp. blocked users: |
3ms |
| others: | 315ms |
| total: | 557ms |

| 0 / 0 |
