Kimi K3 Brings Open Weights Closer to Frontier Agents
A 2.8T-parameter MoE combines Delta Attention, 16-of-896 expert routing, and agentic reinforcement learning to approach leading proprietary systems at lower task cost.
Aug 10, 20264 min2607.24653
1 article on SOTA Papers