|
|
|
извлечь часть текста
|
|||
|---|---|---|---|
|
#18+
Здравствуйте! помогите записать часть текста в новый файл. Знаю, что править нужно что-то в цикле. Есть html-файл. в нем содержится фрагмент Код: html 1. 2. . Нужно из всего файла вытащить только этот фрагмент и записать в новый файл. Код: java 1. 2. 3. 4. 5. 6. 7. 8. 9. 10. 11. 12. 13. 14. 15. 16. 17. 18. 19. 20. ... |
|||
|
:
Нравится:
Не нравится:
|
|||
| 18.10.2012, 10:57:41 |
|
||
|
извлечь часть текста
|
|||
|---|---|---|---|
|
#18+
либо так: Код: java 1. 2. 3. 4. 5. 6. 7. 8. 9. 10. 11. 12. 13. 14. 15. 16. тогда нужно считывать по байтам. помогите, пожалуйста ... |
|||
|
:
Нравится:
Не нравится:
|
|||
| 18.10.2012, 13:31:52 |
|
||
|
извлечь часть текста
|
|||
|---|---|---|---|
|
#18+
Вопрос у вас какой? Что именно не получается? Если вы web crawler изобретаете, то возьмите уже готовый. ... |
|||
|
:
Нравится:
Не нравится:
|
|||
| 18.10.2012, 13:38:23 |
|
||
|
извлечь часть текста
|
|||
|---|---|---|---|
|
#18+
Blazkowicz, 1. где его взять?? 2. мне нужно разбить входящий документ на несколько (инфу брать исходя из тегов) => нужно изять из файла необходимые тэги и создать новый файл с этим содержимым ... |
|||
|
:
Нравится:
Не нравится:
|
|||
| 18.10.2012, 13:44:05 |
|
||
|
извлечь часть текста
|
|||
|---|---|---|---|
|
#18+
planetka1. где его взять?? http://java-source.net/open-source/crawlers/java-web-crawler planetka2. мне нужно разбить входящий документ на несколько (инфу брать исходя из тегов) => нужно изять из файла необходимые тэги и создать новый файл с этим содержимым Как вы начало-конец нужного блока определяете? Идея примерно следующая. Читаете поисмвольно. (Смотрите интерфейс Reader). Складываете символы в буфер. Если буфер "похож" на начало ключевого тэга. То следующий символ добавляете в буфер. Если буфер не похож на ключевой тэг, то сбрасываете буфер. Если буфер в точности совпадает, то переключаетесь в режим копирования - каждый считаный символ записываете в нужый вывод. При этом аналогично ищите закрывающий тег, чтобы из режима копирования перейти в режим поиска. Это и многое другое можно подчерпнуть в статьях по синтаксическому анализу вроде этой: http://rtads.org/man/TADSADV.HTM ... |
|||
|
:
Нравится:
Не нравится:
|
|||
| 18.10.2012, 13:54:46 |
|
||
|
извлечь часть текста
|
|||
|---|---|---|---|
|
#18+
Blazkowicz, да, логика такая должна быть....буду реализовывать. Спасибо! Если встретятся примеры на похожую тематику - буду очень признательна ... |
|||
|
:
Нравится:
Не нравится:
|
|||
| 18.10.2012, 14:10:08 |
|
||
|
извлечь часть текста
|
|||
|---|---|---|---|
|
#18+
while((strRead = br.readLine())!=null){ -- это я читаю построчно?? ... |
|||
|
:
Нравится:
Не нравится:
|
|||
| 18.10.2012, 16:24:40 |
|
||
|
извлечь часть текста
|
|||
|---|---|---|---|
|
#18+
planetkareadLine -- это я читаю построчно?? Хм. Вопрос к словарю? ... |
|||
|
:
Нравится:
Не нравится:
|
|||
| 18.10.2012, 16:33:58 |
|
||
|
извлечь часть текста
|
|||
|---|---|---|---|
|
#18+
Blazkowicz, нет,я понимаю,что это считывание строки. просто не могу сообразить как отсюда перейти к символам ... |
|||
|
:
Нравится:
Не нравится:
|
|||
| 18.10.2012, 17:01:09 |
|
||
|
извлечь часть текста
|
|||
|---|---|---|---|
|
#18+
planetkaнет,я понимаю,что это считывание строки. просто не могу сообразить как отсюда перейти к символам Примерно тоже самое что у вас в первом примере. Только обязательное перейти к BufferedReader+InputStreamReader, чтобы читать посимвольно, но всё ещё через буфер. Не брезгуйте вот этим сайтом http://www.exampledepot.com/ ... |
|||
|
:
Нравится:
Не нравится:
|
|||
| 18.10.2012, 17:06:33 |
|
||
|
|

start [/forum/topic.php?fid=59&msg=38004144&tid=2130741]: |
0ms |
get settings: |
13ms |
get forum list: |
21ms |
check forum access: |
3ms |
check topic access: |
3ms |
track hit: |
52ms |
get topic data: |
20ms |
get forum data: |
6ms |
get page messages: |
84ms |
get tp. blocked users: |
3ms |
| others: | 319ms |
| total: | 524ms |

| 0 / 0 |
