Tag
#llm
3 posts
- Corrí Gemma 3n en el navegador: brutal como experimento, malo como feature29 jun 2026
Metí Gemma 3n E2B a correr 100% en el navegador de un blog estático: WebGPU, 3 GB de modelo, cero servidor. Lo que parecía un demo de una tarde se volvió headers que GitHub Pages no deja poner, un modelo gated en R2, un progress bar imposible y un chat armado a mano. Los números reales en una M2 Max, y por qué hoy esto vive mejor en backend o mobile que en la web.
- LLM context windows: por qué tu feature de IA es más lento de lo que necesita ser5 ago 2025
El tamaño del contexto afecta directamente latencia y costo. Cómo medir qué estás enviando realmente, cuándo chunking vs summarization vs retrieval, y por qué streaming cambia el UX aunque el tiempo total sea el mismo.
- DeepSeek R1 y lo que el momento open-source en LLMs realmente significa4 mar 2025
DeepSeek R1 llegó el 20 de enero de 2025 y rompió el supuesto de que los modelos de razonamiento frontier requieren clusters de $100M. Qué cambió, qué no, y qué significa para developers.