开放资源库 · 软件项目

shrvan30/flash-attention-cuda

FlashAttention-style CUDA implementation with shared-memory tiling, online softmax fusion, IO-aware optimization, and GPU benchmarking.

← 返回资源筛选结果
RESOURCE OVERVIEW

资源说明

FlashAttention-style CUDA implementation with shared-memory tiling, online softmax fusion, IO-aware optimization, and GPU benchmarking.

聚变人工智能代理模型智能控制attentioncudacuda-kernelscuda-optimizationflashattention
RESEARCH USE PROFILE

研究使用指引

适用任务物理求解、集成建模、工程仿真、数据处理与研究工作流构建
使用准备核对软件版本、依赖环境、输入格式、求解设置与示例算例
核验重点正式研究应完成代码验证、基准对比、结果复现和必要的实验验证
RESOURCE FEEDBACK

资源信息需要更新?

可报告链接失效、文件异常、信息错误或版本变化,我们会核对并更新资源记录。