Tag: LLM efficiency

How MoE Routing Strategies Make Large Language Models Efficient 18 July 2026

How MoE Routing Strategies Make Large Language Models Efficient

Explore how Mixture-of-Experts routing strategies enable efficient large language models. Learn about Top-K, Expert Choice, and real-world implementations like Mixtral.

Susannah Greenwood 5 Comments
When Smaller, Heavily-Trained Large Language Models Beat Bigger Ones 18 December 2025

When Smaller, Heavily-Trained Large Language Models Beat Bigger Ones

Smaller, heavily-trained language models like Phi-2 and Gemma 2B now outperform larger models in coding and real-time applications. Learn why efficiency beats scale in AI deployment.

Susannah Greenwood 6 Comments