Performance · Computer Science
Autotuning by Changing Directives and Number of Threads in OpenMP using ppOpen-AT
Toma Sakurai, Satoshi Ohshima, Takahiro Katagiri, Toru Nagai
2023-12-12
Distributed, Parallel, and Cluster Computing · Computer Science
Performance Optimization using Multimodal Modeling and Heterogeneous GNN
Akash Dutta, Jordi Alcaraz, Ali TehraniJamsaz, Eduardo Cesar +2
2023-04-28
Distributed, Parallel, and Cluster Computing · Computer Science
Power Constrained Autotuning using Graph Neural Networks
Akash Dutta, Jee Choi, Ali Jannesari
2023-02-23
Distributed, Parallel, and Cluster Computing · Computer Science
Proactive bottleneck performance analysis in parallel computing using openMP
Vibha Rajput, Alok Katiyar
2013-11-12
Distributed, Parallel, and Cluster Computing · Computer Science
Dynamic autotuning of adaptive fast multipole methods on hybrid multicore CPU & GPU systems
Marcus Holm, Stefan Engblom, Anders Goude, Sverker Holmgren
2014-09-03
Distributed, Parallel, and Cluster Computing · Computer Science
Enabling performance portability of data-parallel OpenMP applications on asymmetric multicore processors
Juan Carlos Saez, Fernando Castro, Manuel Prieto-Matias
2024-02-13
Programming Languages · Computer Science
Machine Learning-Driven Adaptive OpenMP For Portable Performance on Heterogeneous Systems
Giorgis Georgakoudis, Konstantinos Parasyris, Chunhua Liao, David Beckingsale +2
2023-03-17
Performance · Computer Science
Adaptive Performance Optimization under Power Constraint in Multi-thread Applications with Diverse Scalability
Stefano Conoci, Pierangelo Di Sanzo, Bruno Ciciani, Francesco Quaglia
2017-09-05
Distributed, Parallel, and Cluster Computing · Computer Science
Optimizing Streaming Parallelism on Heterogeneous Many-Core Architectures: A Machine Learning Based Approach
Peng Zhang, Jianbin Fang, Canqun Yang, Chun Huang +2
2020-03-10
Distributed, Parallel, and Cluster Computing · Computer Science
OMP2MPI: Automatic MPI code generation from OpenMP programs
Albert Saa-Garriga, David Castells-Rufas, Jordi Carrabina
2015-06-12
Distributed, Parallel, and Cluster Computing · Computer Science
New Thread Migration Strategies for NUMA Systems
O. G. Lorenzo, M. L. Becoña, T. F. Pena, J. C. Cabaleiro +2
2018-10-01
Distributed, Parallel, and Cluster Computing · Computer Science
Optimizing the hybrid parallelization of BHAC
Salvatore Cielo, Oliver Porth, Luigi Iapichino, Anupam Karmakar +2
2021-08-30
Distributed, Parallel, and Cluster Computing · Computer Science
An Efficient Thread Mapping Strategy for Multiprogramming on Manycore Processors
Ashkan Tousimojarad, Wim Vanderbauwhede
2014-04-01
Distributed, Parallel, and Cluster Computing · Computer Science
AutOMP: An Automatic OpenMP Parallelization Generator for Variable-Oriented High-Performance Scientific Codes
Gal Oren, Yehuda Ganan, Guy Malamud
2017-07-25
Distributed, Parallel, and Cluster Computing · Computer Science
Time Critical Multitasking for Multicore Microcontroller using XMOS Kit
Prerna Saini, Ankit Bansal, Abhishek Sharma
2015-04-13
Distributed, Parallel, and Cluster Computing · Computer Science
Auto-tuning of dynamic scheduling applied to 3D reverse time migration on multicore systems
Ítalo A. S. Assis, João B. Fernandes, Tiago Barros, Samuel Xavier-de-Souza
2020-08-14
Distributed, Parallel, and Cluster Computing · Computer Science
OpenMP Advisor
Alok Mishra, Abid M. Malik, Meifeng Lin, Barbara Chapman
2023-01-11
Distributed, Parallel, and Cluster Computing · Computer Science
Performance Analysis and Optimization of a Hybrid Distributed Reverse Time Migration Application
Sri Raj Paul, John Mellor-Crummey, Mauricio Araya-Polo, Detlef Hohl
2016-03-15
Performance · Computer Science
PPT-Multicore: Performance Prediction of OpenMP applications using Reuse Profiles and Analytical Modeling
Atanu Barai, Yehia Arafa, Abdel-Hameed Badawy, Gopinath Chennupati +2
2021-09-09
Mathematical Software · Computer Science
OpenMP parallelization of multiple precision Taylor series method
S. Dimova, I. Hristov, R. Hristova, I. Puzynin +4
2019-08-27
Distributed, Parallel, and Cluster Computing · Computer Science
A Benchmark Set of Highly-efficient CUDA and OpenCL Kernels and its Dynamic Autotuning with Kernel Tuning Toolkit
Filip Petrovič, David Střelák, Jana Hozzová, Jaroslav Oľha +3
2020-03-02
Performance · Computer Science
Tuning Streamed Applications on Intel Xeon Phi: A Machine Learning Based Approach
Peng Zhang, Jianbin Fang, Tao Tang, Canqun Yang +1
2018-02-09