An interactive walk through tiled matrix multiplication, memory locality, outer products, and thread-owned output tiles.
← Home
Writing tagged tiling
Published writing tagged tiling.
A visual explanation of how large matrix products are split into cache-sized tiles, accumulated across K, and reorganized for efficient memory access.
How owner-computes scheduling splits a large result matrix into disjoint C tiles so threads can use outer-product updates without atomics or competing writes.