Meta's Llama 4 MoE model (16 experts x 17B active) with a 120K context window, running locally via local server. Strong multilingual capabilities and efficient inference thanks to mixture-of-experts routing. Great for long-form document analysis, multi-turn chat, and in-house code assistant use cases.