OpenAI acaba de lanzar sus modelos o1. o1 agrega un nuevo nivel de complejidad a la arquitectura tradicional de los LLM, una cadena de pensamiento (CoT) de cero disparos. Comparto mis primeras impresiones sobre o1 en el estilo característico de este sitio web: hablar con chatbots, obtener sus respuestas, publicar todo.

Leer más →

Hablamos mucho de "artículos" y de la supuesta autenticidad de su contenido cuando leemos investigaciones académicas, en todos los campos, pero cuando tocamos el aprendizaje automático en particular. Irónicamente, el proceso que creó el medio para la difusión de la investigación científica en la era del papel físico no fue tan diferente del proceso que produce el "contenido" en la era gobernada por algoritmos de aprendizaje automático, ya sean clasificadores, motores de búsqueda o algoritmos generativos. : 'destrozar' textos al tokenizarlos y crear incrustaciones, descomponer piezas de arte visual en 'tensores' numéricos, una red neuronal artificial profunda que luego se 'difundirá' en imágenes que atraerán clics para este blog vergonzoso...

Leer más →

La búsqueda de información es la idea errónea por excelencia sobre la utilidad de los LLM o sobre cómo mejoran otras tecnologías existentes. En mi opinión, la búsqueda web es una forma más eficaz de encontrar información, simplemente porque los motores de búsqueda le dan al usuario lo que quiere más rápido y en un formato que se ajusta mucho mejor al propósito que una herramienta de chat: múltiples fuentes para explorar en una interfaz de usuario diseñada específicamente, que incluye opciones de filtro, ajustes de configuración, elementos listados, extractos, resultados tabulados, todo lo que se obtiene en esa herramienta de búsqueda web en particular… no el típico “Estoy aquí para ayudarte, profundicemos en las complejidades del panorama en constante evolución de X…” seguido de un párrafo largo y perfectamente redactado basado en un modelo probabilístico que normalmente se obtendría al…

Leer más →