Expand description
Channel bias add Triton kernels.
Layout: input x and output y are NC-layout, where N = BHW and C =
number of channels. Bias is a (C,) vector. Element x[n, c] lives at flat
offset n * C + c.
Parallelism: one CTA per channel. Each CTA iterates over all N spatial
elements in BLOCK_N-wide tiles, adding the per-channel scalar bias.
Structs§
- Channel
Bias AddBackward - Backward pass for channel bias add.
- Channel
Bias AddForward - Adds a (C,) bias to a tensor in NC layout (N = BHW, C = channels).
- Channel
Bias AddRuntime Op - Combined forward + backward RuntimeOp for channel bias add.
- Nchw
Bias AddBackward - NCHW bias add backward: dx = dy, dbias[c] = sum over (B, H, W) of dy.
- Nchw
Bias AddForward - Adds a (C,) bias to a tensor in NCHW layout.
- Nchw
Bias AddRuntime Op - RuntimeOp for adding a (C,) bias to an NCHW-layout tensor.
Functions§
- channel_
bias_ add_ backward - Backward pass for channel bias add.
- channel_
bias_ add_ forward - Adds a (C,) bias to a tensor in NC layout (N = BHW, C = channels).
- nchw_
bias_ add_ backward - NCHW bias add backward: dx = dy, dbias[c] = sum over (B, H, W) of dy.
- nchw_
bias_ add_ forward - Adds a (C,) bias to a tensor in NCHW layout.