Thinking Machines releases Inkling-Small, enabling 276B MoE deployment on single GPUs | StreamingMeme