Noticias de inteligencia artificial
Lo que ha salido hoy,
y qué haces con ello.
Sale algo de IA cada hora y casi nada cambia tu día. Aquí recogemos lo que publican los laboratorios, los papers y la gente que construye — y le ponemos encima lo que a nosotros nos habría gustado leer: qué significa en cristiano y qué puedes hacer con ello esta semana. Sin hype y sin copiar a nadie: cada pieza enlaza a su fuente.
Lo hace AIMA, un estudio de una persona en Sabadell que se pasa el día trabajando con estos modelos.
El taller
Lo que escribimos nosotros.
Lo que aprendemos montando cosas de verdad: lo que funciona, lo que costó más de lo que decía la documentación, y lo que nos habría ahorrado una tarde saberlo antes.
El radar · lo último
Recién salido.
-
Hugging Face05/08
Un formato de pesos que carga los modelos grandes cuatro veces más rápido
Cambian cómo se guardan los tensores para que la carga no pase por la CPU. En los ejemplos, un modelo de 70B pasa de 90 a 22 segundos.
-
Google DeepMind05/08
Un modelo pequeño que corre entero en el móvil sin perder el razonamiento largo
Destilan la cadena de razonamiento en vez de las respuestas. Ocupa 3 GB y aguanta contextos de 128k.
-
Simon Willison05/08
Cómo dejé de pagar de más por embeddings sin cambiar de proveedor
Cachear por hash del texto normalizado y trocear por párrafo en vez de por caracteres: la factura baja sin tocar la calidad de la búsqueda.
-
Hacker News05/08
Un servidor MCP que expone tu base de datos a cualquier cliente sin escribir código
412 puntos · 96 comentarios en Hacker News.
-
arXiv · cs.CL05/08
Los modelos citan mal las fuentes cuando el contexto pasa de 60k tokens
Miden la fidelidad de la cita según crece el contexto: se degrada mucho antes de lo que sugieren los benchmarks de recuperación.
-
Ars Technica05/08
Las empresas medianas gastan más en tokens que en licencias de software
Una encuesta a 900 empresas encuentra que el gasto en inferencia ha superado por primera vez al de SaaS en la franja de 50 a 250 empleados.