Artificial intelligence workloads have been shifting from training AI models to running them for everyday use, a process known as inference. While Nvidia's pricey graphics processors dominate training workloads, d-Matrix specializes in inference.