DSpace DSpace UPC
 Català   Castellano   English  

E-prints UPC >
Altres >
Enviament des de DRAC >

Empreu aquest identificador per citar o enllaçar aquest ítem: http://hdl.handle.net/2117/6565

Ítem no disponible en accés obert per política de l'editorial

Arxiu Descripció MidaFormat
Badia.pdf1.09 MBAdobe PDF Accés restringit

Citació: Badia, R. [et al.]. Parallelizing dense and banded linear algebra libraries using SMPSs. "Concurrency and Computation: Practice and Experience", 25 Desembre 2009, vol. 21, núm. 18, p. 2438-2456.
Títol: Parallelizing dense and banded linear algebra libraries using SMPSs
Autor: Badia Sala, Rosa Maria Veure Producció científica UPC; Herrero Zaragoza, José Ramón Veure Producció científica UPC; Labarta Mancho, Jesús José Veure Producció científica UPC; Pérez, Josep M.; Quintana-Ortí, Enrique S.; Quintana-Ortí, Gregorio
Data: 25-des-2009
Tipus de document: Article
Resum: The promise of future many-core processors, with hundreds of threads running concurrently, has led the developers of linear algebra libraries to rethink their design in order to extract more parallelism, further exploit data locality, attain better load balance, and pay careful attention to the critical path of computation. In this paper we describe how existing serial libraries such as (C)LAPACK and FLAME can be easily parallelized using the SMPSs tools, consisting of a few OpenMP-like pragmas and a runtime system. In the LAPACK case, this usually requires the development of blocked algorithms for simple BLAS-level operations, which expose concurrency at a finer grain. For better performance, our experimental results indicate that column-major order, as employed by this library, needs to be abandoned in benefit of a block data layout. This will require a deeper rewrite of LAPACK or, alternatively, a dynamic conversion of the storage pattern at run-time. The parallelization of FLAME routines using SMPSs is simpler as this library includes blocked algorithms (or algorithms-by-blocks in the FLAME argot) for most operations and storage-by-blocks (or block data layout) is already in place.
ISSN: 1532-0626
URI: http://hdl.handle.net/2117/6565
Versió de l'editor: 10.1002/cpe.1463
Versió de l'editor: http://www3.interscience.wiley.com/journal/122519419/abstract
Apareix a les col·leccions:Altres. Enviament des de DRAC
Departament d'Arquitectura de Computadors. Articles de revista
CAP - Grup de Computació d´Altes Prestacions. Articles de revista
Comparteix:


Stats Mostra les estadístiques d'aquest ítem

SFX Query

Queda prohibida la reproducció, transformació, distribució i comunicació pública d'aquesta obra. Es permet, en tot cas, la reproducció per a ús privat sempre i quan la còpia que se'n faci no sigui objecte d'utilització col·lectiva ni lucrativa (art. 31.2 del Reial Decret Legislatiu 1/1996, de 12 d'abril, pel qual s'aprova el Text Refós de la Llei de Propietat Intel·lectual, http://bibliotecnica.upc.es/sepi/legislacio.asp).

Per a qualsevol ús que es vulgui fer diferent al permès, dirigiu-vos a: sepi@upc.edu

 

Valid XHTML 1.0! Programari DSpace Copyright © 2002-2004 MIT and Hewlett-Packard Comentaris
Universitat Politècnica de Catalunya. Servei de Biblioteques, Publicacions i Arxius