EURO-PAR 2026: 32ND INTERNATIONAL EUROPEAN CONFERENCE ON PARALLEL AND DISTRIBUTED COMPUTING
TALK KEYWORD INDEX

This page contains an index consisting of author-provided keywords.

3
3D-CTF
`
``Happens Before'' relation
A
Accelerator
Accelerator Architecture Design
Accelerator support
Accelerators
adaptive architecture
Adaptive distributed systems
Advanced Matrix Extensions
Agentic AI
AI
AI accelerators
AI-driven Data Management
Algorithm
Algorithm Engineering
algorithm-architecture co-design
AlphaFold2
Alternative Basis Method
Analytical Modeling
ARM SME
ARMv9
Assembly generator
Asymmetric multicore processors
Asynchrony
Attention
Auto-vectorization
Automatic Optimisation
Autonomous orchestration
Autotuning
B
Backfill scheduling
Banded matrices
base quality recalibration
Basic block throughput
Bayesian optimization
Benchmarking
bigshare parallel mode
Bilinear Algorithms
Blackwell
Blocked Sparse Matrix
BlueField
BULL
Byzantine fault-tolerance
C
C++
Cache eviction policy
Cache management
Cache-aware optimization
Carbon-aware computing
Carbon-aware data centers
Causality
cellular automata
Centrality indexes
CGRA
Cholesky decomposition
Cloud Computing
Cloud Environment
Cloud-Edge Environments
Coarse-Grained Reconfigurable Array (CGRA)
Code Instrumentation
Collaborative Data Center Demand Response
Combinatorial Optimization
Communication Contention
Communication Offloading
Communication Performance
community detection
Compiler intermediate representations
Compiler interoperability
Compiler optimization
Compiler-enforced memory safety
Compressed memory swap
Computing Continuum
Concept drift
Constraint optimization
Containerized applications
Converged computing
Convergence Optimization
CPU-GPU co-processing
CPU-GPU Training
Cross-Kernel Overlapping
Cross-Modal Collaborative,
cross-segment space
Cryo-ET
CUDA
CUDA Graphs
CUDA kernels
cuTile
D
DAG scheduling
Data augmentation
Data deduplication
Data Layouts
Data management
Data Parallelism
Data reduction
Data transfer
Data Transfer Volume
datacenters
Dataflow
DDN
Decentralized learning
Decentralized scheduling
Deep Learning Systems
Deep Surrogate Model
Delta Debugging
Demand Response
Dense matrix-matrix multiplication
Dependency management
Digital shadows
digital sufficiency
Disaggregated datacenter
Distance-based ISA
Distributed databases
Distributed Deep Training
Distributed execution plans
Distributed inference
Distributed Memory Parallelism
Distributed Snapshots
Distributed Systems
distributed tensor storage
Distributed Training
DiT
Divide-and-conquer
DNN model partitioning
DPU
DVFS
Dynamic Task Scheduling
Dynamic Time Warping (DTW)
E
E4
earthquake cycle simulation
Earthquake-cycle simulation
EasyGrid AMS middleware
Edge computing
Edge Intelligence
Edge-Cloud-Space continuum
Education
Efficient Communication
Efficient Enumeration
Einsum
Emulating Linearizability
Energy Efficiency
energy efficient
Energy-aware accelerators
energy-aware cloud
Energy-aware resource management
Energy-Aware Scheduling
Energy-efficient
Energy-efficient scientific computing
Epileptic Seizure Detection
EUPEX
Eventual consistency
Exascale
Exascale Systems
F
FAIR
Fast frequency response
Fast Long Integer Multiplication
Fault Detection
Fault Recovery
Fault tolerance
Fault tolerance in supercomputing
Federated Learning
Feedback-based adaptation
Field-Programmable Gate Array
Flash Attention
Flexible service-level agreements
Floating-Point Instability
Fortran
FPGA
FSDP
Fully Homomorphic Encryption
Futures
G
GEMM
Generative inference
genomics
GH200
Governance
GPU
GPU acceleration
GPU Chekcpoint and Restore
GPU computing
GPU L2 cache
GPU Runtime
GPU-CPU cooperative execution
Gradient Fusion
Gradient Sparsification,
Graph algorithms
Graph Kernels
Graph Neural Networks
GreenShift
H
Hard and soft errors
Hardware acceleration
Hardware performance counters
Hardware–software co-design
Heterogeneous
Heterogeneous Architectures
Heterogeneous Computing
Heterogeneous Graph Neural Network
Heterogeneous infrastructures
Heterogeneous memory
Heterogeneous platforms
Heterogeneous Systems
Hierarchical Parallel Computing
High level Synthesis
High throughput
High-energy physics
High-Level Synthesis
High-Performance Computing
HIP
Homogeneous platforms
HPC
HPC and Cloud sustainability
HPC software ecosystem
HPC-quantum integration
HSDP
Huawei
Hybrid quantum-classical computing
Hybrid Workflows
Hybridized methods
hypergraph matching
I
I/O Complexity
Inference optimization
Inference Optimizing
inference serving
Inner Product
Instruction scheduling
Intel RAPL
Intelligence Processing Unit
Intermediate Representation
Internet of Agents
Interoperability
IoT-Edge-Cloud
IR-to-IR translation
J
JAX performance
Job Scheduling
Julia language
K
Kernel Fusion
Knowledge-based resource management
Kokkos
KV cache
KV compression
L
Language Models
Large language model
Large Language Models
LEO space data centers
Lifetime Prediction
List Ranking
LLM
LLM inference
LLM servicing
LLM serving
LLVM
Load balancing
Load forecasting
Low Overhead
Lyapunov optimization
M
Machine learning
Mapping
matmul
matrix processing units (MXUs)
Memory allocations
Memory Management
Memory migration
Memory Optimization
Memory Profiling Framework
Memory-aware
memory-controller contention
Memory-Safety
MI300A
MIMD
Minimal Failure-Inducing Subsets
Mixed precision
Mobile robots
Modal Heterogeneity
Model Context Protocol
Model Heterogeneity
Model Parti-tioning
Model Partitioning
Monte Carlo Method
MPI
Multi-Agent Reinforcement Learning
Multi-core
Multi-model
Multi-Party Computation
Multi-SLO
Multi-tenant scheduling
Multiagent systems
multicore
Multimodal Model,
multiprocessors
N
Needleman-Wunsch
Neural compilation
neural networks
NISQ Systems
Non-uniform Memory access (NUMA)
NPU
O
Onedata
Open instruction set architectures
OpenACC
OpenCL
OpenEdgeCGRA
OpenMP
Operator Synthesis
Optimisation Guidelines
P
Paged Attention
Parallel
Parallel Algorithm
Parallel Algorithms
Parallel Branch-and-Bound
Parallel Computing
Parallel Monte Carlo
Parallelism
Parallelization
Pareto Optimisation
Performance
Performance Analysis
Performance analysis and optimizations
Performance characterization
Performance modeling
Performance Optimization
Performance prediction
Persistent Memory
Pipeline optimization
Pipeline Parallelism
Poseidon2
Power Capping
Power Management
PRAM
Predictive scaling
prefix caching and replication
Privacy
Privacy-Preserving Protocol
Processor micro-architectures
Profiling
Program Recognition
Programmatic Dependent Launch
Programming Languages
Proxy models
Q
QoS-aware
Quantile regression
quantization
Quantum
Quantum Chemistry Simulation
Quantum Computing
Quantum workflow orchestration
Quantum-Classical Optimization
Qubit Mapping
QUBO
R
RDMA
Real-time scheduling
recursive algorithms
Region prediction
Reliability
Research
Resource Allocation
Resource management
Resource prediction
Resource utilization
Resource-aware training
Retrieval-Augmented Generation
Ring Topology
RISC-V for HPC
RISC-V RVV
RISC-V SoC
Runtime estimation
Runtime Prediction
Runtime resource control
Rust
S
SBP-SAT
Scalable Matrix Extension
Scheduling
Scheduling algorithms
Scientific application performance
Scientific Computing
Scientific data management
Scientific workflows
Selective Tracing
Self-optimizing infrastructures
Semi-structured sparsity
Sequence Alignment
Sequence Parallelism
Serverless
Serverless computing
Shared Memory
SIMD/vector instructions
slack reclamation
SNN
source-to-source compilation
Sparse matrix--matrix multiplication
Sparse matrix–vector multiplication
Sparse solvers
Spatial Accelerator
Speculative decoding
SpMV
Standard Library
Standardization
Static analysis
Static-Dynamic Semantic Gap
Statistical timing analysis
stencil computation
Storage management
Stratified conformal prediction
Stream
Stream Processing
STT-MRAM
Sufficiency in computing
Sunway SW26010Pro processor
Sustainable supercomputing
Sustainable Transport
SYCL
SYR2K
SYRK
System Optimization
systolic array
T
Task Scheduling
Task-based parallel programming
Task-based parallelism
Task-level checkpointing
Task-level replication
Task-parallel solvers
Teachability
temporal graphs
Tensor Compiler
Tensor Contractions
tensor cores
Tenstorrent Wormhole
Thermal Mitigation
Tiered memory
Tiling
Time-Sensitive Networking
Toom-Cook
Traffic Scheduling
Transformers
Transparent
Triton
TRSM
Tuning
Turbo Boost
U
Ultra-Low Power
Unified memory
user behavior
Utilization Forecasting
V
Variable Centric
Variational quantum algorithms
Virtual memory
Vision Transformer
VM Management
W
Warm-up
WebAssembly
Weighted Back-Projection
Work-stealing
Workflow portability
Workflow scheduling
Workflow scheduling algorithms
Workload characterization
X
x86/Arm/RISC-V ISA
Z
Zero-Knowledge Proof
Zero-Knowledge Proofs