k 2010

The importance of complete data sets for job scheduling simulations

KLUSÁČEK, Dalibor a Hana RUDOVÁ

Základní údaje

Originální název

The importance of complete data sets for job scheduling simulations

Vydání

Proceedings of the 15th Workshop on Job Scheduling Strategies for Parallel Processing, 2010

Další údaje

Jazyk

angličtina

Typ výsledku

Prezentace na konferencích

Obor

10201 Computer sciences, information science, bioinformatics

Stát vydavatele

Spojené státy

Utajení

není předmětem státního či obchodního tajemství

Označené pro přenos do RIV

Ano

Kód RIV

RIV/00216224:14330/10:00043910

Organizační jednotka

Fakulta informatiky

Klíčová slova anglicky

Grid; Cluster; Scheduling; MetaCentrum; Workload; Failures; Specific Job Requirements

Příznaky

Mezinárodní význam, Recenzováno
Změněno: 27. 4. 2011 14:54, RNDr. Dalibor Klusáček, Ph.D.

Anotace

V originále

This paper has been inspired by the study of the complex data set from the Czech National Grid MetaCentrum. Unlike other widely used workloads from Parallel Workloads Archive or Grid Workloads Archive, this data set includes additional information concerning machine failures, job requirements and machine parameters which allows to perform more realistic simulations. We show that large differences in the performance of various scheduling algorithms appear when these additional information are used. Moreover, we studied other publicly available workloads and partially reconstructed information concerning their machine failures and job requirements using statistical and analytical models to demonstrate that similar behavior is also expectable for other workloads. We suggest that additional information about both machines and jobs should be incorporated into the workloads archives to allow proper and more realistic simulations.

Česky

Tato práce ukazuje důležitost použití kompletních datových sad pro simulace procesu plánování úloh. Na základě kompletních dat z českého Gridu MetaCentrum bylo ukázáno jaký vliv mohou mít výpadky strojů a specifické požadavky úloh na kvalitu generovaného řešení. Na základě těchto zkušeností doporučujeme aby je-li to možné byly zhromažďovány skutečně úplné datové sady, včetně informací o výpadcích strojů a specifických požadavků úloh.

Návaznosti

MSM0021622419, záměr
Název: Vysoce paralelní a distribuované výpočetní systémy
Investor: Ministerstvo školství, mládeže a tělovýchovy ČR, Vysoce paralelní a distribuované výpočetní systémy
MUNI/A/0914/2009, interní kód MU
Název: Rozsáhlé výpočetní systémy: modely, aplikace a verifikace (Akronym: SV-FI MAV)
Investor: Masarykova univerzita, Rozsáhlé výpočetní systémy: modely, aplikace a verifikace, DO R. 2020_Kategorie A - Specifický výzkum - Studentské výzkumné projekty