Mit dem GitHub-Repository AirLLM können Sie gewaltige KI-Modelle lokal auf wenigen GByte VRAM laufen lassen. Doch die Sache hat einen großen Haken.