Meet Husky: a Model-Specific Inference (MSI) engine up to 4.5× faster than Apple's MLX
Woof, Underdog's Pareto frontier model, now runs up to 730 tokens/sec on a MacBook
Finally local models are as fast & capable. Try it now in https://t.co/hAWKvlClUC - your personal private AI