很多使用 Windows 便携版 ComfyUI(NVIDIA 专用) 的小伙伴,运行绘图时会疯狂刷屏报错:
Error running sage attention: … include file ‘Python.h’ not found
using pytorch attention instead.
虽然能正常出图,但能明显感觉到采样速度变慢,SageAttention 高性能加速内核完全失效,自动降级为原生 PyTorch 低效运算。
本篇博文带你彻底搞懂报错根源,提供 根治修复(恢复加速) 和 临时屏蔽报错(懒人方案)两种方法,全程傻瓜式操作、可直接照搬。
一、报错核心原因(看懂这一句就够了)
你的 ComfyUI 是 Windows 嵌入式 Python 便携版,自带的 python_embeded 属于精简版本:
✅ 包含运行依赖 | ❌ 缺失 Python 开发头文件、编译库文件
SageAttention 依赖 Triton 编译器实时编译 CUDA 内核,编译时需要系统文件Python.h,便携包默认没有,导致编译失败、强制降级为 PyTorch 原生注意力机制,速度大幅缩水。
环境特征:Python3.13 + CUDA13.0 + Windows 便携版 ComfyUI(99% 该报错用户的统一环境)
二、方案一:彻底修复(推荐,恢复 SageAttention 全速加速)
核心思路:给嵌入式 Python 补齐缺失的 Include 头文件 + libs 编译库,让 Triton 正常编译内核。
1. 下载适配文件(Python3.13 专属)
下载适配 Windows、Python3.13 的开发依赖包:
2. 替换补齐文件
解压压缩包,得到 Include、libs 两个文件夹,完整复制到目录:
C:\Work\ComfyUI_windows_portable_nvidia\ComfyUI_windows_portable\python_embeded\
直接覆盖原有文件即可,与 python.exe 同级目录。
3. 清理 Triton 编译缓存(关键步骤)
删除缓存文件夹,避免旧报错缓存持续生效:
C:\Users\AI-SPA~1\AppData\Local\Temp\triton
4. 重启生效
完全关闭 ComfyUI,重新双击启动,跑图即可恢复 SageAttention 硬件加速。
三、方案二:懒人方案(屏蔽报错,无需修复,不影响出图)
如果暂时不想补文件、追求省事,可以直接 禁用 SageAttention,彻底消除刷屏报错,仅牺牲加速效果,不影响绘图质量。
操作步骤
1. 打开 ComfyUI 根目录的启动脚本 run_nvidia_gpu.bat
2. 在 python main.py 上方添加一行环境变量:
set COMFYUI_DISABLE_SAGE_ATTENTION=1
python main.py
3. 保存文件,重新启动 ComfyUI,报错彻底消失。
四、一键自动修复脚本(终极懒人)
不想手动复制文件,可使用社区一键修复脚本,自动补齐依赖、修复 Triton 与 SageAttention 兼容问题。
脚本地址:https://github.com/DazzleML/comfyui-triton-and-sageattention-installer
在 ComfyUI 根目录打开 PowerShell,执行命令:
.\python_embeded\python.exe comfyui_triton_sageattention.py --install
五、修复成功验证方法
1. 修复成功:跑图日志不再出现 Python.h not found,打印 using sage attention
2. 未修复/降级:依旧打印 using pytorch attention instead
3. 直观感受:采样迭代速度明显变快,高分辨率、大模型绘图提速效果显著
六、高频踩坑避坑指南
- 禁止混用 Python 版本文件:必须使用 Python3.13 专属的 Include/libs,其他版本会直接闪退、崩溃
- 只用内嵌 Python 执行命令:所有安装、修复操作,仅使用
python_embeded\python.exe,不要用系统 Python - 更新 ComfyUI 后需重补文件:便携包更新会重置
python_embeded目录,需要重新粘贴一次依赖文件 - CUDA13.0 专属适配:官方原生 Triton 不支持 Windows,必须使用社区适配的 triton-windows 版本
七、总结
该报错属于 Windows 便携版 ComfyUI 的通病,并非模型、节点、显卡故障:
✅ 追求性能:用方案一补齐开发依赖,恢复 SageAttention 全速加速
✅ 追求省事:用方案二禁用功能,屏蔽报错,稳定出图
修复后彻底解决日志刷屏、采样慢速问题,完美适配 CUDA13.0 + Python3.13 最新环境。