MAKE · WRITE · SHARE

标签:优化

← 所有标签

AI-把高质量画面训练成低配Shader的探索

一种颇具吸引力的 Shader 降级方案是:先用路径追踪、多层 PBR 和全局光照生成高质量结果,再以这些结果训练小型模型。运行时只保留模型权重和推理代码,即使展开后是一面难以阅读的数字墙,只要能在低端设备上运行并接近原始画面,仍具有实际价

阅读更多

Unity-XCode_Instruments真机性能分析指南

Unity 应用通过 Xcode 安装到真机后,可以使用 Instruments 分析 CPU、内存、GPU、线程和能耗。它会将可复现的操作记录为时间线,用于定位卡顿区间、线程负载、内存增长、GPU Pass 开销,以及温度或能耗导致的降频

阅读更多

Unity-Jobs与Burst原理和优化

Unity Jobs 和 Burst 经常配合使用,但两者解决的问题不同: Jobs:把工作拆开,调度到多个CPU核心上并行执行。 Burst:把一部分C#编译成高性能Native机器码,并进行SIMD等优化。 Jobs 并不必然提高性

阅读更多

Base-GPU硬件架构基础

ALU、SIMD、Warp/Wave 和 half 精度分别描述 GPU 的执行电路、并行方式、线程调度单位与数据精度。它们属于不同层级,不能由某一个参数直接推导 GPU 的实际性能。 各概念的基本关系如下: ALU:真正执行数学

阅读更多

Base-Shader分支与GPU线程发散

Shader 中出现 if 并不代表一定产生明显开销。分支成本主要取决于同一个 GPU 执行组中的线程是否选择了不同路径。 如果整个执行组都进入同一个分支,动态分支反而可以跳过大量无用计算;如果组内线程分别进入不同分支,就会产生线程发散(D

阅读更多

UE4-GPU优化RazorForPS5

连接到PS5之后,可以通过Razor GPU For PS5,截帧分析每个DrawCall的具体消耗。 1.打开RazorGPUForPS5,点击Capture——GPU Capture截帧这个工具截出来没有RenderDoc那样对Pass

阅读更多

Unity-游戏渲染性能优化

Unity项目的优化思路和实践经验在此总结一下。 1.性能检测要优化首先需要分析现有的性能瓶颈,获取性能数据,根据情况决定优化什么,如何优化。性能分析的工具和方法: -检测工具:Profiler、SnapdragonProfiler、Int

阅读更多

Base-TBDR架构

问题背景为什么直接一条流水线会有性能瓶颈?在IMR里,GPU流水线是: 提交三角形——>VS——>Raster——>FS——>输出合并 没有全局信息、没有延迟、完全按照顺序执行。 GPU在执行FS的时候,并不知道像素

阅读更多