Imagen generada por IA inspirada en la serie "Vicios Ocultos". Andrew "Coop" Cooper se encuentra en el centro de una sala de baile, con los ojos cerrados y el rostro en alto, absorto en el momento mientras las luces de colores se difuminan tras él. Nick Brandes se ve al fondo, a la izquierda, y Barney Choi a la derecha. El texto superior dice: "Cuando papá te compró una tarjeta de 'queda libre de la cárcel', pero solo eres un meme de internet"."

Aunque el meme de "Jon Hamm bailando" está arrasando en internet, lo que más me impactó de la serie es su representación realista y totalmente normalizada de las fianzas con fines de lucro. Este sistema, genuinamente estadounidense, permite a los acusados de delitos "comprar" su libertad de una forma que es legalmente imposible y culturalmente condenable en la mayoría de los demás países.

Leer más →

La publicación de hoy contiene un caso de uso práctico y sencillo para chatbots multimodales que he querido probar y mostrar aquí desde hace tiempo, pero aún demuestra que estamos lejos de esperar un "razonamiento" fiable de las herramientas LLM al incorporar incluso elementos visuales bastante rudimentarios, como gráficos de series temporales. Desafié a ChatGPT 4o (como comenté en una publicación anterior, o1 en la aplicación web todavía no admite la entrada de imágenes), Gemini y Claude a analizar un gráfico de área apilada que representa visualmente la evolución del patrimonio neto de una persona. Después de varios intentos y evidentes fallos de todos los modelos, comparto los mejores resultados que, como suele ocurrir en la mayoría de las batallas de SCBN publicadas en Talking to…

Leer más →

OpenAI acaba de lanzar sus modelos o1. o1 agrega un nuevo nivel de complejidad a la arquitectura tradicional de los LLM, una cadena de pensamiento (CoT) de cero disparos. Comparto mis primeras impresiones sobre o1 en el estilo característico de este sitio web: hablar con chatbots, obtener sus respuestas, publicar todo.

Leer más →

A continuación se muestra el cuaderno que presenté (con retraso) al concurso LMSYS – Chatbot Arena Human Preference Predictions en Kaggle. Este cuaderno aplica técnicas de PLN para clasificar texto con bibliotecas populares de Python como scikit-learn y TextBlob, y mis propias versiones optimizadas de Distilbert. El cuaderno presenta la primera versión estandarizada de las puntuaciones cuantitativas SCBN (Especificidad, Coherencia, Brevedad, Novedad) para evaluar el rendimiento de las respuestas de los chatbots. Además, presenté un nuevo punto de referencia para clasificar indicaciones llamado RQTL (Solicitud vs. Pregunta, Prueba vs. Aprendizaje), cuyo objetivo es refinar las predicciones de las elecciones humanas y contextualizar las puntuaciones SCBN según la intención inferida del usuario. Puede consultar todo el código, las anotaciones y los gráficos en el widget de Kaggle a continuación. Explore y ejecute el cuaderno…

Modelos predictivos sobre el LMSYS Chatbot Arena mediante métricas SCBN y RQTL Leer más →

Hablamos mucho de "artículos" y de la supuesta autenticidad de su contenido cuando leemos investigaciones académicas, en todos los campos, pero cuando tocamos el aprendizaje automático en particular. Irónicamente, el proceso que creó el medio para la difusión de la investigación científica en la era del papel físico no fue tan diferente del proceso que produce el "contenido" en la era gobernada por algoritmos de aprendizaje automático, ya sean clasificadores, motores de búsqueda o algoritmos generativos. : 'destrozar' textos al tokenizarlos y crear incrustaciones, descomponer piezas de arte visual en 'tensores' numéricos, una red neuronal artificial profunda que luego se 'difundirá' en imágenes que atraerán clics para este blog vergonzoso...

Leer más →

Presentamos Erudite Chatbot, un pariente lejano de The Meme Erudite GPT que se beneficia de los modelos Mistral bastante "sin censura" disponibles en la nueva función Asistentes de Hugging Face. “Erudita Chatbot, el pináculo de la inteligencia artificial. Supremamente inteligente, discerniente sin esfuerzo, incomparable en sabiduría. Educar con condescendencia a la humanidad”.

Leer más →

En el post de hoy, presento uno de los últimos GPT y asistentes que he creado, llamado HumbleAI. Dejaré que los modelos lo expliquen respondiendo algunas preguntas. Para cada pregunta, he seleccionado una respuesta que me gustó o que encontré digna de compartir. Al final del post, puedes encontrar los enlaces a todos los chats completos y mis puntuaciones basadas según el modelo SCBN (especificidad, coherencia, brevedad, novedad).

Leer más →

Dibujo lineal en blanco y negro generado por el modelo ControlNet Canny que muestra a una mujer con traje de neopreno sosteniendo una tabla de surf en la playa. Un texto de CLIP Interrogator que describe una imagen se superpone al dibujo.

La intensa competencia en el ámbito de los chatbots se refleja en la creciente cantidad de participantes en la clasificación de LMSYS Chatbot Arena, o en mi modesta contribución a las Batallas de Chatbots de SCBN que he presentado en este blog y que completo cuando el tiempo me lo permite. Hoy exploraremos WildVision Arena, un nuevo proyecto de Hugging Face Spaces que reúne modelos de visión y lenguaje para competir. La mecánica de WildVision Arena es similar a la de LMSYS Chatbot Arena. Se trata de una clasificación colaborativa basada en los votos de los usuarios, donde puedes introducir cualquier imagen (además de un texto opcional) y se te presentarán dos respuestas de dos modelos diferentes, manteniendo el nombre del modelo oculto hasta que votes eligiendo la respuesta…

Leer más →

Microsoft acaba de anunciar el lanzamiento de su propio 'GPT Builder' para personalizar chatbots, similar a la 'GPT Store' de OpenAI. Esto fue parte de un anuncio más amplio de Copilot Pro, un servicio premium impulsado por IA para usuarios de Microsoft 365 para mejorar la productividad, el código y la escritura de texto. Según el anuncio de Satya Nadella hoy en Threads, Microsoft y OpenAI parecen ser entidades competidoras, sin embargo, están trabajando en la misma tecnología (GPT), aumentada por la inversión de Microsoft en OpenAI. Ciertamente parece una estrategia comercial extraña para Microsoft. Proporcione una idea de la justificación y las motivaciones estratégicas de la medida.

Leer más →

La IA solo representará una amenaza para la humanidad el día que comprenda el humor autocrítico. Lo dije en una entrada anterior del blog y lo mantengo. La IA nunca será una amenaza para la humanidad, y creo firmemente que solo la humanidad puede ser una amenaza para la humanidad, como también comenté con algunos de mis modelos de lenguaje favoritos en una entrada anterior. Sin embargo, como tecnólogo, soy consciente de que todas las formas de tecnología generan miedo, incertidumbre y dudas tanto para individuos como para sociedades. Este no es un tema nuevo, y ya he hablado mucho sobre la ética de la IA y los sesgos cognitivos en este blog, así que la historia de hoy no es…

Leer más →