这是一个关于程序优化与设计的项目,包含了ntt多线程加速、SIMD指令集加速、AES的并行加速以及cache行为仿真。
- NTT 多线程优化:通过线程拆分实现 NTT 加速。
- 线程池优化:使用线程池减少线程创建的开销。
- GPU 加速:将 NTT 函数移植到 GPU 上运行。
- AES 的并行加速(aes_cuda.cu)
- cache 的可视化仿真模拟
- CPU: Intel i7-12700H 6P8E P Core @4.70 GHz E Core@3.50 GHz (在 Linux 内核下,CPU 0-11 为 P 核心,12-19 为 E 核心)
- A100(80G)
- 操作系统:Linux Kernel 6.9.0
- 编译器:GCC 13.2.1