|
|
|
Вывод переменных hadoop программы c помощью log4j
|
|||
|---|---|---|---|
|
#18+
Я написал hadoop программу с использованием log4j (привожу только шаг Map, работа которого не оправдала мои ожидания) Код: java 1. 2. 3. 4. 5. 6. 7. 8. 9. 10. 11. 12. 13. 14. 15. 16. 17. 18. 19. 20. 21. 22. 23. 24. 25. 26. 27. 28. 29. 30. 31. 32. 33. 34. 35. 36. 37. 38. 39. 40. 41. 42. 43. 44. 45. 46. 47. 48. 49. 50. 51. 52. 53. 54. 55. 56. 57. 58. 59. 60. 61. 62. 63. 64. 65. 66. 67. 68. 69. 70. 71. 72. 73. 74. 75. 76. 77. 78. 79. 80. 81. 82. 83. 84. 85. 86. 87. 88. 89. 90. 91. 92. 93. 94. 95. 96. 97. 98. 99. 100. 101. 102. 103. 104. 105. 106. 107. 108. 109. 110. 111. 112. 113. 114. 115. Привожу файл /folder/log4j.xml Код: xml 1. 2. 3. 4. 5. 6. 7. 8. 9. 10. 11. 12. 13. 14. 15. 16. 17. 18. Но несмотря на строки программы Код: java 1. 2. 3. 4. 5. в результате выполнения команды ./hadoop jar /export/hadoop-1.0.1/bin/ParallelIndexation.jar org.myorg.ParallelIndexation /export/hadoop-1.0.1/bin/input /export/hadoop-1.0.1/bin/output -D mapred.map.tasks=1 1> resultofexecute.txt 2>&1 в файле resultofexecute.txt не оказалось вывода соответствующих переменных (содержимое которого привожу ниже): args[0]=/export/hadoop-1.0.1/bin/input 13/04/19 22:23:19 WARN mapred.JobClient: Use GenericOptionsParser for parsing the arguments. Applications should implement Tool for the same. 13/04/19 22:23:19 INFO mapred.FileInputFormat: Total input paths to process : 0 13/04/19 22:23:20 INFO mapred.JobClient: Running job: job_201304192207_0001 13/04/19 22:23:21 INFO mapred.JobClient: map 0% reduce 0% 13/04/19 22:23:40 INFO mapred.JobClient: map 0% reduce 100% 13/04/19 22:23:45 INFO mapred.JobClient: Job complete: job_201304192207_0001 13/04/19 22:23:45 INFO mapred.JobClient: Counters: 15 13/04/19 22:23:45 INFO mapred.JobClient: Job Counters 13/04/19 22:23:45 INFO mapred.JobClient: Launched reduce tasks=1 13/04/19 22:23:45 INFO mapred.JobClient: SLOTS_MILLIS_MAPS=10343 13/04/19 22:23:45 INFO mapred.JobClient: Total time spent by all reduces waiting after reserving slots (ms)=0 13/04/19 22:23:45 INFO mapred.JobClient: Total time spent by all maps waiting after reserving slots (ms)=0 13/04/19 22:23:45 INFO mapred.JobClient: SLOTS_MILLIS_REDUCES=7555 13/04/19 22:23:45 INFO mapred.JobClient: File Output Format Counters 13/04/19 22:23:45 INFO mapred.JobClient: Bytes Written=0 13/04/19 22:23:45 INFO mapred.JobClient: FileSystemCounters 13/04/19 22:23:45 INFO mapred.JobClient: FILE_BYTES_WRITTEN=21536 13/04/19 22:23:45 INFO mapred.JobClient: Map-Reduce Framework 13/04/19 22:23:45 INFO mapred.JobClient: Reduce input groups=0 13/04/19 22:23:45 INFO mapred.JobClient: Combine output records=0 13/04/19 22:23:45 INFO mapred.JobClient: Reduce shuffle bytes=0 13/04/19 22:23:45 INFO mapred.JobClient: Reduce output records=0 13/04/19 22:23:45 INFO mapred.JobClient: Spilled Records=0 13/04/19 22:23:45 INFO mapred.JobClient: Total committed heap usage (bytes)=16252928 13/04/19 22:23:45 INFO mapred.JobClient: Combine input records=0 13/04/19 22:23:45 INFO mapred.JobClient: Reduce input records=0 ... |
|||
|
:
Нравится:
Не нравится:
|
|||
| 19.04.2013, 23:29:24 |
|
||
|
Вывод переменных hadoop программы c помощью log4j
|
|||
|---|---|---|---|
|
#18+
Вкралась опечатка Код: xml 1. 2. 3. 4. но несмотря на это проблема остается актуальной, я изменил уровень логгера на DEBUG во всех файлах /folder/log4j.xml на всех подчиненных узлах (а значит и на узле, на котором выполнялся mapper), но несмотря на это файл вывода остался тем же. ... |
|||
|
:
Нравится:
Не нравится:
|
|||
| 20.04.2013, 00:30:37 |
|
||
|
Вывод переменных hadoop программы c помощью log4j
|
|||
|---|---|---|---|
|
#18+
vladdv89, 1) Hadoop - это распределённая система, соответственно нужно понимать, что перенаправления stderr, stdout на запускающий сервер - не будет. Кроме того нет никакой гарантии, что маппер или редьюсер будет запущен на той ноде, на которой бы вам хотелось. Только если нода одна или если запустить job'у локально. Вы можете найти ввод/вывод в логах каждого конкретного сервера отдельно. 2) у вас используется старая версия hadoop api, рекомендую использовать org.apache.hadoop.mapreduce.*. 3) Рекомендую прочитать статьи о написании job'ов в Hadoop и перечитать документацию. На лицо - неверное восприятие парадигмы map-reduce, судя по логике вашего маппера. Он не масштабируем. 4) Сложение строк в итерации вот так: ` ConcatPaths[k] += "\n" + paths.get( ` - это плохая практика в коде. Но в hadoop'e - это просто абсолютное зло из-за больших объёмов данных. Если объёмы данных небольшие, тогда зачем нужен hadoop? IO на каждом map'e - еще хуже. 5) зачем вы используете hadoop? Какой объём данных? Какую задачу вы решаете? ... |
|||
|
:
Нравится:
Не нравится:
|
|||
| 20.04.2013, 01:22:13 |
|
||
|
|

start [/forum/topic.php?fid=59&gotonew=1&tid=2129506]: |
0ms |
get settings: |
15ms |
get forum list: |
25ms |
check forum access: |
7ms |
check topic access: |
7ms |
track hit: |
51ms |
get topic data: |
16ms |
get first new msg: |
11ms |
get forum data: |
4ms |
get page messages: |
70ms |
get tp. blocked users: |
2ms |
| others: | 285ms |
| total: | 493ms |

| 0 / 0 |
