TecnoArtesanos Tech BlogTecnoArtesanos Tech Blog

Blog

0
Sergio Morales
Wednesday, 26 March 2025 / Published in Uncategorized

Esta empresa tiene la clave para que la IA se entrena a sí misma

Databricks, una empresa que ayuda a las gigantes tecnológicas a crear modelos de IA personalizados, ha desarrollado un truco de aprendizaje automático que puede aumentar el rendimiento de un modelo generativo sin necesidad de datos etiquetados o brutos. Durante un año, Jonathan Frankle, científico jefe de IA en Databricks, habló con los clientes sobre los principales retos para conseguir que los sistemas de inteligencia artificial funcionen de forma fiable. Según él, el problema son los “datos sucios”.

Contents
  • Una mezcla para reproducir mejores datos
  • El futuro de TAO es brillante

“Todo el mundo tiene algunos datos y una mínima idea de lo que quiere hacer”, reitera Frankle. Añade que nadie ofrece datos claros y precisos que puedan introducirse en un prompt (instrucción) o en una interfaz de programación de aplicaciones para un modelo. El modelo de Databricks podría permitir a las empresas desplegar agentes de IA para tareas específicas sin que la calidad de los datos sea un obstáculo.


Un collage fotográfico de un rostro representado en cuadrados yuxtapuesto frente a dos brazos robóticos.
Google Presenta Gemini Robotics, una IA para robots humanoides

Google presenta su nuevo modelo de inteligencia artificial que dota de más inteligencia a los humanoides y otros robots, y una herramienta diseñada para darles una brújula moral.


Una mezcla para reproducir mejores datos

La técnica ofrece una visión poco usual de los trucos clave que los ingenieros usan para mejorar las capacidades de los modelos avanzados de inteligencia artificial, especialmente cuando es difícil conseguir buenos datos. El método combina las ideas producidas por modelos de razonamiento avanzados con el aprendizaje por refuerzo, una forma de mejorar la práctica con datos de entrenamiento “sintéticos” o generados por la IA.

Los últimos modelos de OpenAI, Google y DeepSeek se basan en gran medida en el aprendizaje por refuerzo y en datos de entrenamiento sintéticos. WIRED reveló que Nvidia planea adquirir Gretel, una empresa especializada en datos sintéticos. “Todos estamos navegando por este espacio”, afirma Frankle.

El método de Databricks aprovecha el hecho de que, con suficientes intentos, incluso un modelo débil puede obtener una buena puntuación en una determinada tarea o referencia. Los investigadores llaman a este método de mejorar el rendimiento de un modelo “best-of-N” (mejor de N). Databricks entrenó a un modelo para predecir qué resultado preferirían los evaluadores humanos. El modelo de recompensa de Databricks (DBRM) puede utilizarse para mejorar el rendimiento de otros modelos sin necesidad de más datos etiquetados.

El DBRM selecciona los mejores resultados de un modelo determinado. Así, se crean datos de entrenamiento sintéticos que permiten afinar el modelo para que produzca mejores resultados a la primera. Databricks denomina a su nuevo método “Test-time Adaptive Optimization” (TAO), u Optimización adaptativa en tiempo de prueba. “Este método utiliza un aprendizaje por refuerzo relativamente ligero para incorporar las ventajas de la optimización adaptativa en el propio modelo”, explica Frankle.

La investigación realizada por Databricks demuestra que el método TAO mejora a medida que se amplía a modelos más grandes y capaces. El aprendizaje por refuerzo y los datos sintéticos ya se utilizan ampliamente, pero combinarlos para mejorar los grandes modelos de lenguaje (LLM) es una técnica relativamente nueva y técnicamente difícil.

Databricks es inusualmente abierta sobre cómo desarrolla la IA, porque quiere demostrar a los clientes que tiene las habilidades necesarias para crear potentes modelos personalizados para ellos. En el pasado, la empresa reveló a WIRED cómo desarrolló DBX, un modelo avanzado de lenguaje de código abierto (LLM) desde cero.


Imagen de una mujer con un teléfono móvil delante del logotipo de Meta AI en la pantalla de un ordenador, el 29 de abril de 2024, en Edmonton, Canadá.
Meta presenta una IA que traduce los pensamientos en texto

Fundamental Artificial Intelligence Research, el laboratorio de IA de Meta, anuncia una nueva máquina que puede decodificar señales cerebrales y convertirlas en palabras escritas en una computadora.


El futuro de TAO es brillante

Sin datos bien etiquetados y cuidadosamente conservados, es difícil ajustar un LLM para realizar tareas específicas con mayor eficacia, como analizar informes financieros o historiales médicos para encontrar patrones o identificar problemas. Muchas empresas esperan ahora utilizar los LLM para automatizar tareas con los llamados agentes de IA.

Por ejemplo, un agente utilizado en finanzas podría analizar los principales resultados de una empresa, generar un informe y enviarlo automáticamente a distintos analistas. Otro contexto en el que sería útil un agente es en la industria de los seguros de salud, orientando a los clientes con información sobre un fármaco o una enfermedad relevante.

What you can read next

Cómo evitar que Google use tus fotos y videos para entrenar su IA
Qué hay detrás de Rassvet, la competencia rusa de Starlink
Sheinbaum conduce Olinia, el vehículo eléctrico mexicano que estará disponible en 2027 por 150,000 pesos

Recent Posts

  • Los agentes de IA rebeldes no son malvados, solo quieren complacernos
  • Dime cómo prompteas y la IA te dirá quién eres
  • La primicia ahora la tienen los periodistas de IA. Spoiler: son malos reporteros
  • El reto de las empresas mexicanas ya no es la adopción de IA, sino aprender a aprovecharla
  • Bienvenidos a la era de la computación hecha con cerebros de verdad

Recent Comments

  1. A WordPress Commenter on Welcome to My Tech Blog – A New Chapter in Innovation

Archives

  • August 2026
  • July 2026
  • June 2026
  • May 2026
  • April 2026
  • March 2026
  • February 2026
  • January 2026
  • December 2025
  • November 2025
  • October 2025
  • September 2025
  • August 2025
  • July 2025
  • June 2025
  • May 2025
  • April 2025
  • March 2025
  • February 2025
  • August 2016

Categories

  • Uncategorized

Recent Posts

  • Los agentes de IA rebeldes no son malvados, solo quieren complacernos

    Que los agentes de IA vayan libres hackeando ot...
  • Dime cómo prompteas y la IA te dirá quién eres

    A finales de 2022, cuando OpenAI lanzó ChatGPT,...
  • La primicia ahora la tienen los periodistas de IA. Spoiler: son malos reporteros

    En la conferencia de seguridad Black Hat celebr...
  • El reto de las empresas mexicanas ya no es la adopción de IA, sino aprender a aprovecharla

    La adopción de la inteligencia artificial (IA) ...
  • Bienvenidos a la era de la computación hecha con cerebros de verdad

    Te voy a contar un secreto. Cada célula de tu c...

Archives

  • August 2026
  • July 2026
  • June 2026
  • May 2026
  • April 2026
  • March 2026
  • February 2026
  • January 2026
  • December 2025
  • November 2025
  • October 2025
  • September 2025
  • August 2025
  • July 2025
  • June 2025
  • May 2025
  • April 2025
  • March 2025
  • February 2025
  • August 2016

Categories

  • Uncategorized

Meta

  • Log in
  • Entries feed
  • Comments feed
  • WordPress.org

Kallyas

The #1 Multi-Purpose theme with a Powerful Visual Page Builder that you’ll actually enjoy.

Newsletter

 

sociall

 

Company

Customer

The #1 WordPress theme with a Powerful Visual Page Builder that you'll actually enjoy.

Lorem ipsum dolor sit amet, consectetur adipiscing elit, sed do eiusmod tempor incididunt ut labore et dolore magna aliqua. Ut enim ad minim veniam, quis nostrud exercitation ullamco laboris nisi ut aliquip ex ea commodo consequat. Duis aute irure dolor in reprehenderit in voluptate velit esse cillum.

Feed with such ID does not exist

Made with  ♥  by Hogash Studios. All Rights Reserved © 2016.

TOP