Artículos sobre LLM
8 artículos · ← Ver todo el blog

Mixture of Experts (MoE): qué es, cómo funciona y por qué importa en 2026
IAMoEMixture of ExpertsQwenKimiArquitecturaLLM
11 de agosto del 2026 • 11 min read
Cuánta RAM necesitas para correr IA local en 2026: la guía honesta para 8, 16, 32 y 64 GB
IA localLLMllama.cppcuantizaciónGGUFApple SiliconRAMself-hosting
10 de agosto del 2026 • 21 min read
Cómo funcionan los modelos con un millón de tokens de contexto (y qué modelos lo entregan en 2026)
IALLMContextoAtenciónRAGAnthropicOpenAIGoogleDeepSeek
10 de agosto del 2026 • 16 min read
Claude Sonnet 5 a $2/$10: el costo de la inferencia cayó hasta 80% — revisá tu COGS esta semana
Claude Sonnet 5AnthropicIALLMPricingSaaS
28 de julio del 2026 • 14 min read
Claude Opus 5: qué cambia frente a Opus 4.8 y cuándo usarlo (2026)
Claude Opus 5AnthropicIALLMCoding
25 de julio del 2026 • 9 min read
MiniMax M3: el modelo frontier open-weight con contexto 1M y multimodalidad nativa (2026)
MiniMax M3IALLMOpen SourceMultimodal
23 de julio del 2026 • 6 min read
Kimi K3 de Moonshot AI: qué cambia frente a K2 y cuándo usarlo (2026)
Kimi K3Moonshot AIIALLMOpen Source
23 de julio del 2026 • 8 min read
Gemini 3.6 Flash y 3.5 Flash-Lite: el modelo rápido de Google que cambia el balance (julio 2026)
Gemini 3.6 FlashGoogle DeepMindIALLMAgentic
23 de julio del 2026 • 7 min read