Saltar al contenido
notdefined_
Blog TIL Proyectos About
← Todos los tags

Tag

#llm

3 posts

  • Corrí Gemma 3n en el navegador: brutal como experimento, malo como feature

    Metí Gemma 3n E2B a correr 100% en el navegador de un blog estático: WebGPU, 3 GB de modelo, cero servidor. Lo que parecía un demo de una tarde se volvió headers que GitHub Pages no deja poner, un modelo gated en R2, un progress bar imposible y un chat armado a mano. Los números reales en una M2 Max, y por qué hoy esto vive mejor en backend o mobile que en la web.

    gemmawebgpullmaimediapipecloudflare
    29 jun 2026
  • LLM context windows: por qué tu feature de IA es más lento de lo que necesita ser

    El tamaño del contexto afecta directamente latencia y costo. Cómo medir qué estás enviando realmente, cuándo chunking vs summarization vs retrieval, y por qué streaming cambia el UX aunque el tiempo total sea el mismo.

    aillmbackendperformance
    5 ago 2025
  • DeepSeek R1 y lo que el momento open-source en LLMs realmente significa

    DeepSeek R1 llegó el 20 de enero de 2025 y rompió el supuesto de que los modelos de razonamiento frontier requieren clusters de $100M. Qué cambió, qué no, y qué significa para developers.

    aillmopen-source
    4 mar 2025

© 2026 Adrian Castillo

About CV Cómo escribo
konami code supported RSS
🍪

Este sitio usa cookies para mejorar tu experiencia.