#faster inference
Faster Inference: 2 AI articles covering faster inference news, analysis, and research
Articles
Liquid AI Releases LFM2.5-VL-3B-DSpark: Speculative Decoding for⭐8
Liquid AI releases LFM2.5-VL-3B-DSpark, a speculative decoding drafter for its vision-language model, delivering up to 3.13x faster decoding on Apple silicon, w...
Liquid AI Unveils LFM2.5-DSpark Draft Models: Up to 3.18x Faster⭐7
Liquid AI's DSpark draft models speed up LFM2.5 inference by up to 3.18x on H100, with identical outputs. Self-hosted deployment, open license for small firms.
