TAG

#性能优化

共 8 篇文章

CSS 动画与合成器提升:为什么 transform 和 opacity 动画不触发重排

本文以首屏轮播图为例,解释浏览器如何将 transform 和 opacity 动画提升到合成器线程,避免主线程的布局与绘制。通过对比修改 width/left 与 transform 的渲染路径,说明合成层的创建条件、层爆炸风险及性能影响,帮助前端开发者做出合理的动画性能优化决策。

CUDA Graph 如何消除大模型推理中的 Kernel 启动开销

本文以在线大模型服务为场景,深入解析 CUDA Graph 通过捕获并重放 GPU Kernel 序列来减少 CPU 启动开销和内核间延迟的机制。文章分析了其与动态形状、批处理大小变化、PagedAttention 等技术的兼容性,讨论了捕获成本、内存占用和适用边界,并通过对比表格和流程图帮助读者理解何时使用 CUDA Graph 能获得显著收益。