Na super - BBC CP bricht nach Rechenfehler ab...

Klimaforschung (Africa Rainfall Project und Climate Prediction), Geologie (z.B. Quake Catcher Network), ...
Nachricht
Autor
Benutzeravatar
Michael H.W. Weber
Vereinsvorstand
Vereinsvorstand
Beiträge: 23063
Registriert: 07.01.2002 01:00
Wohnort: Marpurk

Na super - BBC CP bricht nach Rechenfehler ab...

#1 Ungelesener Beitrag von Michael H.W. Weber » 06.11.2006 09:58

...und das nach über einem halben Jahr Recheneinsatz! Vielen Dank.

Code: Alles auswählen

Fri 03 Nov 2006 03:15:31 PM CET||Starting BOINC client version 5.4.9 for i686-pc-linux-gnu
Fri 03 Nov 2006 03:15:31 PM CET||libcurl/7.15.3 OpenSSL/0.9.8a zlib/1.2.3
Fri 03 Nov 2006 03:15:31 PM CET||Data directory: /home/michi/bin/dc-clients/BOINC
Fri 03 Nov 2006 03:15:31 PM CET||gethostbyname failed
Fri 03 Nov 2006 03:15:31 PM CET||Processor: 1 AuthenticAMD AMD Sempron(tm)
Fri 03 Nov 2006 03:15:31 PM CET||Memory: 1011.66 MB physical, 4.01 GB virtual
Fri 03 Nov 2006 03:15:31 PM CET||Disk: 83.67 GB total, 74.59 GB free
Fri 03 Nov 2006 03:15:31 PM CET|BBC Climate Change Experiment|URL: http://bbc.cpdn.org/; Computer ID: 206848; location: home; project prefs: default
Fri 03 Nov 2006 03:15:31 PM CET||General prefs: from BBC Climate Change Experiment (last modified 2006-08-19 17:01:28)
Fri 03 Nov 2006 03:15:31 PM CET||General prefs: no separate prefs for home; using your defaults
Fri 03 Nov 2006 03:15:31 PM CET||Local control only allowed
Fri 03 Nov 2006 03:15:31 PM CET||Listening on port 31416
Fri 03 Nov 2006 03:15:31 PM CET|BBC Climate Change Experiment|Resuming task hadcm3ln_7q68_00599686_1 using hadcm3l version 508
Fri 03 Nov 2006 03:23:12 PM CET||gethostbyname failed
Fri 03 Nov 2006 03:23:13 PM CET|BBC Climate Change Experiment|Sending scheduler request to http://bbc.cpdn.org/bbc_cgi/cgi
Fri 03 Nov 2006 03:23:13 PM CET|BBC Climate Change Experiment|Reason: To send trickle-up message
Fri 03 Nov 2006 03:23:13 PM CET|BBC Climate Change Experiment|(not requesting new work or reporting completed tasks)
Fri 03 Nov 2006 03:23:18 PM CET|BBC Climate Change Experiment|Scheduler request succeeded
Sat 04 Nov 2006 11:00:29 AM CET||gethostbyname failed
Sat 04 Nov 2006 11:00:29 AM CET|BBC Climate Change Experiment|Sending scheduler request to http://bbc.cpdn.org/bbc_cgi/cgi
Sat 04 Nov 2006 11:00:29 AM CET|BBC Climate Change Experiment|Reason: To send trickle-up message
Sat 04 Nov 2006 11:00:29 AM CET|BBC Climate Change Experiment|(not requesting new work or reporting completed tasks)
Sat 04 Nov 2006 11:00:34 AM CET|BBC Climate Change Experiment|Scheduler request succeeded
Sun 05 Nov 2006 06:38:31 AM CET||gethostbyname failed
Sun 05 Nov 2006 06:38:31 AM CET|BBC Climate Change Experiment|Sending scheduler request to http://bbc.cpdn.org/bbc_cgi/cgi
Sun 05 Nov 2006 06:38:31 AM CET|BBC Climate Change Experiment|Reason: To send trickle-up message
Sun 05 Nov 2006 06:38:31 AM CET|BBC Climate Change Experiment|(not requesting new work or reporting completed tasks)
Sun 05 Nov 2006 06:38:37 AM CET|BBC Climate Change Experiment|Scheduler request succeeded
Sun 05 Nov 2006 05:06:58 PM CET||Suspending computation - running CPU benchmarks
Sun 05 Nov 2006 05:06:58 PM CET|BBC Climate Change Experiment|Pausing task hadcm3ln_7q68_00599686_1 (removed from memory)
Sun 05 Nov 2006 05:06:58 PM CET||Suspending network activity - running CPU benchmarks
Sun 05 Nov 2006 05:07:00 PM CET||Running CPU benchmarks
Sun 05 Nov 2006 05:07:59 PM CET||Benchmark results:
Sun 05 Nov 2006 05:07:59 PM CET||   Number of CPUs: 1
Sun 05 Nov 2006 05:07:59 PM CET||   1062 floating point MIPS (Whetstone) per CPU
Sun 05 Nov 2006 05:07:59 PM CET||   1858 integer MIPS (Dhrystone) per CPU
Sun 05 Nov 2006 05:07:59 PM CET||Finished CPU benchmarks
Sun 05 Nov 2006 05:08:00 PM CET||Resuming computation
Sun 05 Nov 2006 05:08:00 PM CET||Rescheduling CPU: Resuming computation
Sun 05 Nov 2006 05:08:00 PM CET||Resuming network activity
Sun 05 Nov 2006 05:08:00 PM CET|BBC Climate Change Experiment|Restarting task hadcm3ln_7q68_00599686_1 using hadcm3l version 508
Mon 06 Nov 2006 02:24:28 AM CET||gethostbyname failed
Mon 06 Nov 2006 02:24:29 AM CET|BBC Climate Change Experiment|Sending scheduler request to http://bbc.cpdn.org/bbc_cgi/cgi
Mon 06 Nov 2006 02:24:29 AM CET|BBC Climate Change Experiment|Reason: To send trickle-up message
Mon 06 Nov 2006 02:24:29 AM CET|BBC Climate Change Experiment|(not requesting new work or reporting completed tasks)
Mon 06 Nov 2006 02:24:34 AM CET|BBC Climate Change Experiment|Scheduler request succeeded
Mon 06 Nov 2006 03:16:14 AM CET||gethostbyname failed
Mon 06 Nov 2006 03:16:14 AM CET|BBC Climate Change Experiment|Sending scheduler request to http://bbc.cpdn.org/bbc_cgi/cgi
Mon 06 Nov 2006 03:16:14 AM CET|BBC Climate Change Experiment|Reason: To send trickle-up message
Mon 06 Nov 2006 03:16:14 AM CET|BBC Climate Change Experiment|(not requesting new work or reporting completed tasks)
Mon 06 Nov 2006 03:16:19 AM CET|BBC Climate Change Experiment|Scheduler request succeeded
Mon 06 Nov 2006 04:18:22 AM CET||Rescheduling CPU: application exited
Mon 06 Nov 2006 04:18:22 AM CET|BBC Climate Change Experiment|Computation for task hadcm3ln_7q68_00599686_1 finished
Mon 06 Nov 2006 04:18:22 AM CET|BBC Climate Change Experiment|Unrecoverable error for result hadcm3ln_7q68_00599686_1 (<file_xfer_error>  <file_name>hadcm3ln_7q68_00599686_1_9.zip</file_name>  <error_code>-161</error_code></file_xfer_error><file_xfer_error>  <file_name>hadcm3ln_7q68_00599686_1_10.zip</file_name>  <error_code>-161</error_code></file_xfer_error><file_xfer_error>  <file_name>hadcm3ln_7q68_00599686_1_11.zip</file_name>  <error_code>-161</error_code></file_xfer_error><file_xfer_error>  <file_name>hadcm3ln_7q68_00599686_1_12.zip</file_name>  <error_code>-161</error_code></file_xfer_error><file_xfer_error>  <file_name>hadcm3ln_7q68_00599686_1_13.zip</file_name>  <error_code>-161</error_code></file_xfer_error><file_xfer_error>  <file_name>hadcm3ln_7q68_00599686_1_14.zip</file_name>  <error_code>-161</error_code></file_xfer_error><file_xfer_error>  <file_name>hadcm3ln_7q68_00599686_1_15.zip</file_name>  <error_code>-161</error_code></file_xfer_error><file_xfer_error>  <file_name>hadcm3ln_7q68_0059968Mon 06 Nov 2006 04:18:22 AM CET|BBC Climate Change Experiment|Deferring scheduler requests for 1 minutes and 0 seconds
Mon 06 Nov 2006 09:54:46 AM CET||gethostbyname failed
Mon 06 Nov 2006 09:54:46 AM CET|BBC Climate Change Experiment|Sending scheduler request to http://bbc.cpdn.org/bbc_cgi/cgi
Mon 06 Nov 2006 09:54:46 AM CET|BBC Climate Change Experiment|Reason: Requested by user
Mon 06 Nov 2006 09:54:46 AM CET|BBC Climate Change Experiment|Reporting 1 tasks
Mon 06 Nov 2006 09:54:51 AM CET|BBC Climate Change Experiment|Scheduler request succeeded
Das war meine erste und letzte BBC CP WU. :attention: Man kann froh sein, daß das Projekt in weiser Vorraussicht wenigstens Teilergebnisse hochlädt. Die WU war übrigens gerade zu gut 50% beendet.

Michael.
Fördern, kooperieren und konstruieren statt fordern, konkurrieren und konsumieren.

Bild Bild

Benutzeravatar
Bananeweizen
Urvater
Urvater
Beiträge: 2867
Registriert: 14.06.2001 01:00
Wohnort: Kornwestheim

#2 Ungelesener Beitrag von Bananeweizen » 06.11.2006 20:46

Das passiert bei den Klima-Projekten anscheinend recht häufig. Zumindest erweckte das Forum dort vor einiger Zeit bei mir diesen Eindruck. Und bei mir sind auch schon einige WUs mit Rechenfehler weggebeamt.

Benutzeravatar
Michael H.W. Weber
Vereinsvorstand
Vereinsvorstand
Beiträge: 23063
Registriert: 07.01.2002 01:00
Wohnort: Marpurk

#3 Ungelesener Beitrag von Michael H.W. Weber » 07.11.2006 10:34

Kann man die Rechnung an der gleichen WU wieder aufnehmen? Vor dem Absturz wurde der Status doch an den Server gemeldet. Ich kann unfertige Sachen nicht ab...

Michael.
Fördern, kooperieren und konstruieren statt fordern, konkurrieren und konsumieren.

Bild Bild

Benutzeravatar
laguna
TuX-omane
TuX-omane
Beiträge: 2789
Registriert: 08.10.2003 09:36
Wohnort: Ettingshausen

#4 Ungelesener Beitrag von laguna » 07.11.2006 14:03

In discussion about the 161 error :

Ananas
It is a very common error and hits a lot of us. The real problem actually occured before this error pops up, it means that the model crashed for whatever reason but didn't return a proper status code to the BOINC program.

The real reason might be found in a file with the name "yabsd.out" (possibly "yabsd.out.gz") which sits in the dataout folder of your model.

If you can uncompress it (WinZip should be able to do .gz files) and open it with Notepad, you might find a problem report at the end of the file (often something with negative pressure) or the file just ends with an incomplete line.

Von hier:
http://climateapps2.oucs.ox.ac.uk/cpdnb ... 231&sort=6

Fehler 161 ist wohl weit verbreitet, und besagt lediglich, das das Modell kein Ergebnis gebracht hat. Der eigentliche Fehler wird von der 161 Meldung maskiert.
Bild Bild

Benutzeravatar
Michael H.W. Weber
Vereinsvorstand
Vereinsvorstand
Beiträge: 23063
Registriert: 07.01.2002 01:00
Wohnort: Marpurk

#5 Ungelesener Beitrag von Michael H.W. Weber » 07.11.2006 17:06

Naja, was heißt kein Ergebnis gebracht? Die WU war nach 1500 CPU-Stunden gerade mal zu 50% fertiggestellt. Daraus schließe ich, daß sie gecrasht ist.

Michael.
Fördern, kooperieren und konstruieren statt fordern, konkurrieren und konsumieren.

Bild Bild

Benutzeravatar
laguna
TuX-omane
TuX-omane
Beiträge: 2789
Registriert: 08.10.2003 09:36
Wohnort: Ettingshausen

#6 Ungelesener Beitrag von laguna » 07.11.2006 17:24

Michael H.W. Weber hat geschrieben:Naja, was heißt kein Ergebnis gebracht? Die WU war nach 1500 CPU-Stunden gerade mal zu 50% fertiggestellt. Daraus schließe ich, daß sie gecrasht ist.

Michael.
Ja, ist sie wohl. Nur der 161 Fehler verdeckt warum. Er sagt nur aus, das die WU kein Ergebnis gebracht hat, jedoch nicht warum.
Bild Bild

Zurück zu „Meteorologie, Geologie & Geografie“