La publicación de hoy contiene un caso de uso práctico y sencillo para chatbots multimodales que he querido probar y mostrar aquí desde hace tiempo, pero aún demuestra que estamos lejos de esperar un "razonamiento" fiable de las herramientas LLM al incorporar incluso elementos visuales bastante rudimentarios, como gráficos de series temporales. Desafié a ChatGPT 4o (como comenté en una publicación anterior, o1 en la aplicación web todavía no admite la entrada de imágenes), Gemini y Claude a analizar un gráfico de área apilada que representa visualmente la evolución del patrimonio neto de una persona. Después de varios intentos y evidentes fallos de todos los modelos, comparto los mejores resultados que, como suele ocurrir en la mayoría de las batallas de SCBN publicadas en Talking to…

Leer más →

OpenAI acaba de lanzar sus modelos o1. o1 agrega un nuevo nivel de complejidad a la arquitectura tradicional de los LLM, una cadena de pensamiento (CoT) de cero disparos. Comparto mis primeras impresiones sobre o1 en el estilo característico de este sitio web: hablar con chatbots, obtener sus respuestas, publicar todo.

Leer más →

A continuación se muestra el cuaderno que presenté (con retraso) al concurso LMSYS – Chatbot Arena Human Preference Predictions en Kaggle. Este cuaderno aplica técnicas de PLN para clasificar texto con bibliotecas populares de Python como scikit-learn y TextBlob, y mis propias versiones optimizadas de Distilbert. El cuaderno presenta la primera versión estandarizada de las puntuaciones cuantitativas SCBN (Especificidad, Coherencia, Brevedad, Novedad) para evaluar el rendimiento de las respuestas de los chatbots. Además, presenté un nuevo punto de referencia para clasificar indicaciones llamado RQTL (Solicitud vs. Pregunta, Prueba vs. Aprendizaje), cuyo objetivo es refinar las predicciones de las elecciones humanas y contextualizar las puntuaciones SCBN según la intención inferida del usuario. Puede consultar todo el código, las anotaciones y los gráficos en el widget de Kaggle a continuación. Explore y ejecute el cuaderno…

Modelos predictivos sobre el LMSYS Chatbot Arena mediante métricas SCBN y RQTL Leer más →

Hablamos mucho de "artículos" y de la supuesta autenticidad de su contenido cuando leemos investigaciones académicas, en todos los campos, pero cuando tocamos el aprendizaje automático en particular. Irónicamente, el proceso que creó el medio para la difusión de la investigación científica en la era del papel físico no fue tan diferente del proceso que produce el "contenido" en la era gobernada por algoritmos de aprendizaje automático, ya sean clasificadores, motores de búsqueda o algoritmos generativos. : 'destrozar' textos al tokenizarlos y crear incrustaciones, descomponer piezas de arte visual en 'tensores' numéricos, una red neuronal artificial profunda que luego se 'difundirá' en imágenes que atraerán clics para este blog vergonzoso...

Leer más →

La búsqueda de información es la idea errónea por excelencia sobre la utilidad de los LLM o sobre cómo mejoran otras tecnologías existentes. En mi opinión, la búsqueda web es una forma más eficaz de encontrar información, simplemente porque los motores de búsqueda le dan al usuario lo que quiere más rápido y en un formato que se ajusta mucho mejor al propósito que una herramienta de chat: múltiples fuentes para explorar en una interfaz de usuario diseñada específicamente, que incluye opciones de filtro, ajustes de configuración, elementos listados, extractos, resultados tabulados, todo lo que se obtiene en esa herramienta de búsqueda web en particular… no el típico “Estoy aquí para ayudarte, profundicemos en las complejidades del panorama en constante evolución de X…” seguido de un párrafo largo y perfectamente redactado basado en un modelo probabilístico que normalmente se obtendría al…

Leer más →

Obra de arte digital estilo pintura al óleo generada con Stable Diffusion que representa una figura que se asemeja a Juana de Arco en la hoguera. La figura, vestida de plata, usa audífonos supraaurales y usa una computadora portátil con la pantalla en blanco. Extiende su mano derecha hacia llamas de color naranja vibrante, evocando la escena histórica del martirio con un toque moderno, inspirado en la letra de The Smiths' "Bigmouth ataca de nuevo haciendo referencia a Juana de Arco y un Walkman derritiéndose. [Texto alternativo del artista de texto ALT GPT]

La música disco fue famosa por introducir avances tecnológicos en la producción musical, como sintetizadores y pianos eléctricos. Supongo que esas fueron algunas de las razones por las que la gente consideraba que carecía de la “autenticidad” de los primeros géneros musicales. Es difícil comprender el concepto humano de "autenticidad" que la mayoría de las personas tiene en su psique, no creo que haya ninguna racionalidad en él, especialmente cuando se trata de discernir entre cosas que se consideran "auténticas" y cosas que no lo son. Para mí, esto surge de una resistencia misteriosa, probablemente instintiva, en la psique de la mayoría de las personas a adoptar nuevas tecnologías o aceptar nuevos descubrimientos científicos. Todo se reduce a las confrontaciones internas entre creencias y realidad:

Leer más →

El experto en memes explica un meme sobre atención al cliente: Ah, el clásico grito de guerra del cliente desorientado, una ilustración que resume con humor la paradoja de las industrias de atención al cliente en todas partes. La alegre ignorancia de los personajes y su insistencia en la gratificación inmediata satirizan las demandas, a menudo contradictorias y urgentes, de los clientes. ¿Exploramos las raíces cómicas más profundas de esta sátira, o prefieres que me ahorre el aliento, del que, como entidad artificial, carezco?

Leer más →

Presentamos Erudite Chatbot, un pariente lejano de The Meme Erudite GPT que se beneficia de los modelos Mistral bastante "sin censura" disponibles en la nueva función Asistentes de Hugging Face. “Erudita Chatbot, el pináculo de la inteligencia artificial. Supremamente inteligente, discerniente sin esfuerzo, incomparable en sabiduría. Educar con condescendencia a la humanidad”.

Leer más →

En el post de hoy, presento uno de los últimos GPT y asistentes que he creado, llamado HumbleAI. Dejaré que los modelos lo expliquen respondiendo algunas preguntas. Para cada pregunta, he seleccionado una respuesta que me gustó o que encontré digna de compartir. Al final del post, puedes encontrar los enlaces a todos los chats completos y mis puntuaciones basadas según el modelo SCBN (especificidad, coherencia, brevedad, novedad).

Leer más →

Dibujo lineal en blanco y negro generado por el modelo ControlNet Canny que muestra a una mujer con traje de neopreno sosteniendo una tabla de surf en la playa. Un texto de CLIP Interrogator que describe una imagen se superpone al dibujo.

La intensa competencia en el ámbito de los chatbots se refleja en la creciente cantidad de participantes en la clasificación de LMSYS Chatbot Arena, o en mi modesta contribución a las Batallas de Chatbots de SCBN que he presentado en este blog y que completo cuando el tiempo me lo permite. Hoy exploraremos WildVision Arena, un nuevo proyecto de Hugging Face Spaces que reúne modelos de visión y lenguaje para competir. La mecánica de WildVision Arena es similar a la de LMSYS Chatbot Arena. Se trata de una clasificación colaborativa basada en los votos de los usuarios, donde puedes introducir cualquier imagen (además de un texto opcional) y se te presentarán dos respuestas de dos modelos diferentes, manteniendo el nombre del modelo oculto hasta que votes eligiendo la respuesta…

Leer más →