Files
2023-04-23 21:57:20 +08:00

51 lines
1.8 KiB
GLSL

#version 460
#extension GL_GOOGLE_include_directive : enable
#extension GL_EXT_samplerless_texture_functions : enable
#extension GL_KHR_shader_subgroup_arithmetic : enable
#extension GL_KHR_shader_subgroup_basic : enable
#include "sdsm_common.glsl"
// x3 is load-balance.
const uint kDimBlock = 3;
layout(local_size_x = 8, local_size_y = 8) in;
void main()
{
const uvec2 depthRangeSize = uvec2(textureSize(inDepth, 0) - 1);
const uvec2 groupThreadId = remap8x8(gl_LocalInvocationIndex);
const uvec2 dispatchId = groupThreadId + gl_WorkGroupID.xy * 8;
const uvec2 workPosBasic = dispatchId * kDimBlock;
// Depth is 32-bit float, gather no performance better to 4 fetch.
uint minDepthInBlock = ~0;
uint maxDepthInBlock = 0;
for(uint i = 0; i < kDimBlock; i ++)
{
for(uint j = 0; j < kDimBlock; j ++)
{
// OpenGL core 4.3
// Unlike filtered texel accesses, texel fetches do not support LOD clamping or any texture wrap mode.
ivec2 workPosLoop = ivec2(clamp(workPosBasic + uvec2(i, j), uvec2(0), depthRangeSize));
const bool bValidDraw = isShadingModelValid(texelFetch(inGbufferA, workPosLoop, 0).a);
const uint packDepth = depthPackUnit(texelFetch(inDepth, workPosLoop, 0).x);
uint packDepthForMin = bValidDraw ? packDepth : ~0;
uint packDepthForMax = bValidDraw ? packDepth : 0;
minDepthInBlock = min(minDepthInBlock, packDepthForMin);
maxDepthInBlock = max(maxDepthInBlock, packDepthForMax);
}
}
uint subGroupMinDepth = subgroupMin(minDepthInBlock);
uint subGroupMaxDepth = subgroupMax(maxDepthInBlock);
if(subgroupElect())
{
atomicMin(depthRange.minDepth, uint(subGroupMinDepth));
atomicMax(depthRange.maxDepth, uint(subGroupMaxDepth));
}
}