DSpace DSpace UPC
 Català   Castellano   English  

E-prints UPC >
Altres >
Enviament des de DRAC >

Empreu aquest identificador per citar o enllaçar aquest ítem: http://hdl.handle.net/2117/16739

Ítem no disponible en accés obert per política de l'editorial

Arxiu Descripció MidaFormat
Martorell.pdf681,33 kBAdobe PDF Accés restringit

Citació: Bueno, J. [et al.]. Productive programming of GPU clusters with OmpSs. A: IEEE International Parallel and Distributed Processing Symposium. "2012 IEEE 26th International Parallel & Distributed Processing Symposium (IPDPS) 21-25 May 2012: Shanghai, China". Shanghai: 2012, p. 557-568.
Títol: Productive programming of GPU clusters with OmpSs
Autor: Bueno Hedo, Javier; Planas, Judit; Duran González, Alejandro Veure Producció científica UPC; Badia Sala, Rosa Maria Veure Producció científica UPC; Martorell Bofill, Xavier Veure Producció científica UPC; Ayguadé Parra, Eduard Veure Producció científica UPC; Labarta Mancho, Jesús José Veure Producció científica UPC
Data: 2012
Tipus de document: Conference lecture
Resum: Clusters of GPUs are emerging as a new computational scenario. Programming them requires the use of hybrid models that increase the complexity of the applications, reducing the productivity of programmers. We present the implementation of OmpSs for clusters of GPUs, which supports asynchrony and heterogeneity for task parallelism. It is based on annotating a serial application with directives that are translated by the compiler. With it, the same program that runs sequentially in a node with a single GPU can run in parallel in multiple GPUs either local (single node) or remote (cluster of GPUs). Besides performing a task-based parallelization, the runtime system moves the data as needed between the different nodes and GPUs minimizing the impact of communication by using affinity scheduling, caching, and by overlapping communication with the computational task. We show several applicactions programmed with OmpSs and their performance with multiple GPUs in a local node and in remote nodes. The results show good tradeoff between performance and effort from the programmer.
ISBN: 978-1-4673-0975-2
URI: http://hdl.handle.net/2117/16739
DOI: 10.1109/IPDPS.2012.58
Versió de l'editor: http://ieeexplore.ieee.org/xpl/articleDetails.jsp?arnumber=6267858
Apareix a les col·leccions:Altres. Enviament des de DRAC
CAP - Grup de Computació d´Altes Prestacions. Ponències/Comunicacions de congressos
Departament d'Arquitectura de Computadors. Ponències/Comunicacions de congressos
Comparteix:


Stats Mostra les estadístiques d'aquest ítem

SFX Query

Tots els drets reservats. Aquesta obra està protegida pels drets de propietat intel·lectual i industrial corresponents. Sense perjudici de les exempcions legals existents, queda prohibida la seva reproducció, distribució, comunicació pública o transformació sense l'autorització del titular dels drets.

Per a qualsevol ús que se'n vulgui fer no previst a la llei, dirigiu-vos a: sepi.bupc@upc.edu

 

Valid XHTML 1.0! Programari DSpace Copyright © 2002-2004 MIT and Hewlett-Packard Comentaris
Universitat Politècnica de Catalunya. Servei de Biblioteques, Publicacions i Arxius