Noticias
La mayoría de los sistemas de IA supuestamente “abiertos” están en realidad cerrados, y eso es un problema
Los modelos de IA “abiertos” tienen mucho que ofrecer. La práctica de compartir el código fuente con el público estimula la innovación y democratiza la IA como herramienta.
O eso dice la historia. Un nuevo análisis en Naturaleza le da un giro a la narrativa: la mayoría de los modelos de IA supuestamente “abiertos”, como Meta’s Llama 3, no son eso.
En lugar de alentar o beneficiar a las pequeñas empresas emergentes, la “retórica de la apertura con frecuencia se esgrime de maneras que… exacerban la concentración de poder” en las grandes empresas tecnológicas, escribieron David Widder de la Universidad de Cornell, Meredith Whittaker de la Signal Foundation y Sarah West de AI Now. Instituto.
¿Por qué preocuparse? Debatir sobre la apertura de la IA parece puramente académico. Pero con el creciente uso de ChatGPT y otros grandes modelos de lenguaje, los responsables políticos están luchando por ponerse al día. ¿Se pueden permitir modelos en escuelas o empresas? ¿Qué guías deberían existir para proteger contra el mal uso?
Y quizás lo más importante es que la mayoría de los modelos de IA están controlados por Google, Meta y otros gigantes tecnológicos, que tienen la infraestructura y los medios financieros para desarrollar o licenciar la tecnología y, a su vez, guiar la evolución de la IA para cumplir con sus incentivos financieros.
Los legisladores de todo el mundo han tomado nota. Este año, la Unión Europea adoptó la Ley de IA, la primera legislación integral del mundo para garantizar que los sistemas de IA utilizados sean “seguros, transparentes, no discriminatorios y respetuosos con el medio ambiente”. En septiembre, había más de 120 proyectos de ley sobre IA en el Congreso, que velaban por la privacidad, la rendición de cuentas y la transparencia.
En teoría, los modelos abiertos de IA pueden satisfacer esas necesidades. Pero “cuando se están dando forma a las políticas, las definiciones importan”, escribió el equipo.
En el nuevo análisis, desglosaron el concepto de “apertura” en los modelos de IA a lo largo de todo el ciclo de desarrollo y señalaron cómo se puede utilizar mal el término.
¿Qué es la ‘apertura’?
El término “código abierto” es casi tan antiguo como el propio software.
A principios de siglo, pequeños grupos de rebeldes informáticos publicaron códigos de software gratuito que cualquiera podía descargar y utilizar desafiando el control corporativo. Tenían una visión: el software de código abierto, como los procesadores de texto disponibles gratuitamente similares a los de Microsoft, podrían nivelar el campo de juego para los pequeños y permitir el acceso a personas que no podían permitirse la tecnología. El código también se convirtió en un campo de juego, donde los entusiastas ingenieros de software juguetearon con el código para descubrir fallas que necesitaban solución, lo que resultó en un software más utilizable y seguro.
Con la IA, la historia es diferente. Los grandes modelos de lenguaje se construyen con numerosas capas de “neuronas” artificiales interconectadas. Al igual que sus contrapartes biológicas, la estructura de esas conexiones influye en gran medida en el desempeño de un modelo en una tarea específica.
Los modelos se entrenan buscando en Internet textos, imágenes y, cada vez más, vídeos. A medida que estos datos de entrenamiento fluyen a través de sus redes neuronales, ajustan las fortalezas de las conexiones de sus neuronas artificiales (llamadas “pesos”) para que generen los resultados deseados. Luego, la mayoría de los sistemas son evaluados por personas para juzgar la precisión y la calidad de los resultados.
¿El problema? Comprender los procesos internos de estos sistemas no es sencillo. A diferencia del software tradicional, compartir solo los pesos y el código de un modelo de IA, sin los datos de entrenamiento subyacentes, dificulta que otras personas detecten posibles errores o amenazas a la seguridad.
Esto significa que conceptos previos del software de código abierto se están aplicando de “formas que no se adaptan a los sistemas de IA”, escribió el equipo, lo que genera confusión sobre el término.
lavado a cielo abierto
Los modelos de IA “abiertos” actuales abarcan un rango de apertura, pero en general tienen tres características principales.
Uno es la transparencia, o cuántos detalles sobre la configuración de un modelo de IA publica su creador. La serie Pythia de Eleuther AI, por ejemplo, permite a cualquiera descargar el código fuente, los datos de entrenamiento subyacentes y la documentación completa. También otorgan licencias del modelo de IA para una amplia reutilización, cumpliendo con la definición de “código abierto” de la Open Source Initiative, una organización sin fines de lucro que ha definido el término a medida que ha evolucionado durante casi tres décadas. En contraste, Llama 3 de Meta, aunque se describe como abierto, solo permite a las personas desarrollar su IA a través de una API (una especie de interfaz que permite que diferentes software se comuniquen, sin compartir el código subyacente) o descargar solo los pesos del modelo para jugar, pero con restricciones a su uso.
“Se trata de sistemas de ‘lavado abierto’ que se entienden mejor como cerrados”, escribieron los autores.
Una segunda característica es la reutilización, en el sentido de que otras personas pueden utilizar datos y detalles de un modelo de IA con licencia abierta (aunque a menudo solo a través de un servicio en la nube; hablaremos de esto más adelante). modelos para sus necesidades específicas.
“[This] “Es una característica clave defendida particularmente por los actores corporativos que invierten en la IA abierta”, escribió el equipo. Hay una razón: entrenar modelos de IA requiere una enorme potencia informática y recursos, que a menudo sólo están disponibles para las grandes empresas de tecnología. Llama 3, por ejemplo, fue entrenada con 15 billones de tokens, una unidad para procesar datos, como palabras o caracteres. Estos puntos críticos dificultan que las nuevas empresas creen sistemas de inteligencia artificial desde cero. En cambio, a menudo reentrenan sistemas “abiertos” para adaptarlos a una nueva tarea o ejecutarlos de manera más eficiente. El modelo AI Alpaca de Stanford, basado en Llama, por ejemplo, ganó interés por el hecho de que podía ejecutarse en una computadora portátil.
No hay duda de que muchas personas y empresas se han beneficiado de los modelos abiertos de IA. Pero para los autores, también pueden ser una barrera para la democratización de la IA.
El lado oscuro
Muchos sistemas abiertos de IA a gran escala hoy en día se entrenan en servidores en la nube, señalan los autores. El Instituto de Innovación Tecnológica de los Emiratos Árabes Unidos desarrolló Falcon 40B y lo entrenó en los servidores AWS de Amazon. La IA de MosaicML está “vinculada a Azure de Microsoft”. Incluso OpenAI se ha asociado con Microsoft para ofrecer sus nuevos modelos de IA a un precio.
Si bien la computación en la nube es extremadamente útil, limita quién puede realmente ejecutar modelos de IA en un puñado de grandes empresas y sus servidores. Alpaca de Stanford finalmente cerró parcialmente debido a la falta de recursos financieros.
El secreto en torno a los datos de entrenamiento es otra preocupación. “Muchos modelos de IA a gran escala se describen como negligencia abierta a la hora de proporcionar incluso información básica sobre los datos subyacentes utilizados para entrenar el sistema”, escribieron los autores.
Los grandes modelos de lenguaje procesan enormes cantidades de datos extraídos de Internet, algunos de los cuales tienen derechos de autor, lo que da lugar a una serie de demandas en curso. Cuando los conjuntos de datos no están disponibles fácilmente, o cuando son increíblemente grandes, es difícil verificar el rendimiento informado del modelo, o si los conjuntos de datos “blanquean la propiedad intelectual de otros”, según los autores.
El problema empeora cuando se construyen frameworks, a menudo desarrollados por grandes empresas tecnológicas, para minimizar el tiempo”[reinventing] la rueda”. Estos fragmentos de código, flujos de trabajo y herramientas de evaluación preescritos ayudan a los desarrolladores a desarrollar rápidamente un sistema de inteligencia artificial. Sin embargo, la mayoría de los ajustes no cambian el modelo en sí. En otras palabras, cualquier problema o sesgo potencial que exista dentro de los modelos también podría propagarse a las aplicaciones posteriores.
Un ecosistema de IA
Para los autores, desarrollar una IA que sea más abierta no se trata de evaluar un modelo a la vez. Más bien, se trata de tener en cuenta todo el ecosistema.
La mayoría de los debates sobre la apertura de la IA pasan por alto el panorama general. A medida que la IA avance, “es poco probable que la búsqueda de la apertura por sí sola produzca muchos beneficios”, escribió el equipo. En cambio, al elaborar políticas abiertas de IA se debe considerar todo el ciclo de desarrollo de la IA, desde la creación, la capacitación y el funcionamiento de sistemas de IA hasta sus usos prácticos y sus incentivos financieros.
“Fijar nuestras esperanzas en una IA ‘abierta’ de forma aislada no nos llevará a ese mundo”, escribió el equipo.
Crédito de la imagen: x / x
Noticias
Lo que hace y no hace el PD para profesores de OpenAI
¿Qué es lo primero que deberían hacer los profesores que se sumergen en la inteligencia artificial generativa?
¿Deberían aprender a aprovechar la IA para crear el plan de lección perfecto? ¿Utilizar la herramienta para generar preguntas para un cuestionario? ¿O deberían aprender primero sobre los posibles sesgos y la desinformación que a menudo se introducen en el contenido generado por IA antes de utilizarlo en su trabajo diario?
Deberían comenzar con lo básico, según OpenAI, creador de ChatGPT y una de las empresas de investigación de inteligencia artificial más destacadas del mundo. El mes pasado, la empresa lanzó un curso en línea de una hora de duración y a su propio ritmo. para profesores de K-12 sobre la definición, el uso y los daños de la IA generativa en el aula. Se lanzó en colaboración con Common Sense Media, una organización nacional sin fines de lucro que califica y revisa una amplia gama de contenido digital según su idoneidad para la edad.
Desde su lanzamiento el 20 de noviembre, alrededor de 10.000 educadores han tomado el curso, y el 98 por ciento de los docentes “compartieron que el curso ofrecía nuevas ideas o estrategias que podrían aplicar a su trabajo”, dijo Robbie Torney, director senior de programas de IA. en Common Sense Media, en un correo electrónico.
Para Eric Curts, entrenador de IA para distritos escolares del noreste de Ohio, el curso es una “buena introducción” para los educadores que aún no han experimentado con ChatGPT o cualquier otro chatbot de IA generativa.
“No se trata sólo de hablar de los beneficios que aporta la IA. También aborda cuestiones como la necesidad de privacidad de los datos”, dijo. “Menciona varias veces que no se debe incluir información de identificación personal sobre los estudiantes”.
El curso también cubre “incitar” a la IA a realizar las tareas que usted desea, dijo Drew Olssen, coordinador de tecnología del distrito escolar de Agua Fría en Avondale, Arizona. El curso viene con una “biblioteca de indicaciones” con ejemplos de indicaciones que los maestros pueden uso: desde redactar correos electrónicos hasta crear un cuestionario para la clase.
“Es una plantilla básica y agradable de lo que harías si ingresaras a ChatGPT por primera vez”, dijo.
Formar a los profesores para que utilicen la IA requiere recursos y tiempo que muchos distritos escolares no tienen, afirmó Olssen, por lo que un curso como este, junto con otros cursos introductorios gratuitos, puede ser un buen punto de partida.
Una encuesta representativa a nivel nacional Un estudio de más de 700 profesores, realizado por el Centro de Investigación EdWeek este otoño, indicó que el 58 por ciento no había recibido ningún desarrollo profesional sobre IA generativa. Esto fue una disminución del 13 por ciento desde la última vez que el Centro de Investigación EdWeek encuestó a los maestros en la primavera. Hubo solo un aumento del 1 por ciento (del 5 al 6 por ciento) en los docentes que dijeron que recibían formación profesional continua en IA generativa.
“Estamos en las primeras etapas de adopción de la IA en K-12. Nuestra primera prioridad es equipar a los educadores con recursos fundamentales para utilizar las herramientas de inteligencia artificial de manera reflexiva y modelar un uso eficaz y responsable en el aula. Este curso, intencionadamente simple, breve y accesible, fue diseñado para comenzar a construir esa base. Estamos entusiasmados de que los educadores quieran recursos más detallados sobre estos temas”, dijo un portavoz de OpenAI.
Un curso intensivo sobre IA generativa necesita más detalles, dicen los expertos
No todo el mundo está de acuerdo con la cantidad de temas nuevos introducidos en el curso de una hora de OpenAI (que le llevó a este reportero unos 30 minutos completar) y el ritmo al que se tratan.
“Para meter tanto, [a teacher] Está garantizado que lo superará rápidamente”, dijo Eryk Salvaggio, investigador del meta(LAB) de la Universidad de Harvard, que ha trabajado en pedagogía basada en IA.
Salvaggio dijo que si bien el curso brinda a los docentes consejos sobre el uso de la IA para ahorrar tiempo y ser más productivos, aún enfatiza que los docentes deben seguir “iterando” los resultados de una consulta solicitada.
“¿La IA realmente ahorra más tiempo a los docentes que si hicieran la tarea ellos mismos?” dijo Salvaggio.
El curso OpenAI se divide en tres secciones: una explicación de la IA, consejos prácticos sobre cómo los profesores pueden usar la IA para preparar lecciones o enseñar y una lección sobre los riesgos que implica el uso de ChatGPT en el aula. Cada módulo tiene secciones de videos y cuestionarios asociados para que los profesores prueben sus conocimientos a medida que avanzan en el curso.
El principal mecanismo de capacitación es crear indicaciones sólidas para ChatGPT para que los profesores obtengan los resultados que buscan. A través de diferentes ejemplos, el curso detalla qué constituye la “mejor” indicación en comparación con una indicación “OK” o menos detallada.
Sin embargo, los ejemplos no cubren varias tareas comunes en el aula, dijo Curts, como nivelar un texto, hacer adaptaciones para estudiantes con discapacidades o idear actividades para la clase.
En las sesiones de formación del propio Curts, que duran tres horas, dedica una hora a abordar los riesgos del uso de IA generativa, que incluyen plagio, “deepfakes”y preocupaciones sobre la privacidad de los datos. La sección de OpenAI sobre daños es mucho más breve y no analiza el plagio ni los deepfakes.
“A [cover risks] correctamente, merece mucho más tiempo del que se puede dedicar en un curso introductorio como este, pero al menos pone estos temas en el radar de los profesores, lo cual creo que es importante”, dijo Curts.
El curso no explica en profundidad cómo funciona la IA, lo que otros expertos en IA identificaron como una oportunidad perdida.
“Gastan una frase en ello [at the beginning]. No se unen [how AI works] a sus limitaciones”, dijo Pat Yongpradit, director académico de Code.org y líder de TeachAI, una iniciativa que apoya a las escuelas en el uso y la enseñanza de la tecnología.
Por ejemplo, dijo, la razón por la que una herramienta como ChatGPT está sesgada es porque refleja los prejuicios del mundo que nos rodea.
Existe la suposición subyacente de que es demasiado técnico para que un consumidor medio (como un profesor) comprenda cómo funciona la IA generativa. Pero los profesores deberían tener al menos un nivel “medio” de conocimiento para entender por qué la IA funciona como lo hace, afirmó.
Además, “es importante lograr que la gente tome buenas decisiones sobre el uso de la IA”, añadió Yongpradit. El curso podría haber agregado ejemplos de sesgos específicos, o incluso ejemplos en los que no es apropiado usar IA debido a sus sesgos, dijo.
Torney, de Common Sense, dijo que el curso es una manera para que “los profesores ocupados adquieran habilidades esenciales en poco tiempo”.
Los detalles complejos y técnicos sobre cómo funciona ChatGPT se dividieron en partes manejables para que los profesores los abordaran a su propio ritmo, dijo. “Anticipamos que se necesitará más capacitación”, añadió Torney.
Los distritos pueden aprovechar este rumbo, pero tienen que trazar un camino a seguir
Yongpradit espera que el curso introductorio de OpenAI despierte el apetito de los profesores por aprender más sobre la IA.
“Lo peor sería si los profesores pensaran que este curso es todo el desarrollo profesional que necesitan”, dijo. “Tampoco creo que los creadores crean que esto sea suficiente. Esta es una pequeña porción de una oportunidad más grande”.
Yongpradit sugiere el desarrollo profesional continuo a través de comunidades de aprendizaje profesional, donde los profesores puedan compartir sus experiencias sobre el uso de la IA en sus aulas y aprender unos de otros.
El distrito escolar de Agua Fría ha implementado una versión de esta capacitación desde 2022, poco después del lanzamiento de ChatGPT por primera vez, dijo Olssen, coordinador de tecnología del distrito. Olssen reunió a un grupo de profesores, bibliotecarios, formadores de alfabetización y administradores que se reúnen todos los meses para discutir cómo utilizar la IA en las aulas.
“Es un tipo de modelo de formación de formadores”, dijo Olssen, “en el que estos embajadores dirigen sesiones de formación con otros educadores cada trimestre”.
El mes pasado, el grupo discutió cómo ir más allá del uso de la IA para realizar tareas simples como generar hojas de trabajo y, en cambio, se centró en cómo se podría usar la IA para crear experiencias de aprendizaje “más profundas” para los estudiantes, a través de proyectos o trabajos de investigación.
Cuando se trata de abordar los sesgos inherentes de la IA generativa y el potencial de desinformación, Olssen dijo que el distrito capacita a maestros y estudiantes, al comienzo del año escolar, sobre cómo evaluar el rendimiento de la IA. La capacitación del distrito es “muy explícita en cuanto a verificar la claridad, precisión, relevancia y ética de lo que escupe una plataforma de IA”, dijo.
El curso OpenAI presenta una comprensión superficial de estos riesgos, dijo Olssen, pero más allá de cualquier curso introductorio, corresponde a los distritos escolares hacer que los maestros sean plenamente conscientes de los daños de “confiar demasiado” en cualquier tecnología.
“Los educadores también están ávidos de más contenido; un tema importante en la retroalimentación ha sido el deseo de un curso más largo”, dijo Torney.
¿Quiere leer más sobre cómo los profesores pueden utilizar (y aprender sobre) la IA? Estén atentos al nuevo informe especial de la Semana de la Educación que se publicará el lunes.
Noticias
Ya nadie habla de ChatGPT
Sam Altman niega que el acuerdo de OpenAI con Microsoft se esté desmoronando y se burla del lanzamiento de productos
El director ejecutivo de OpenAI, Sam Altman, fue entrevistado hoy por Andrew Ross Sorkin en la Cumbre DealBook del New York Times y dijo algunas cosas interesantes sobre la relación de su empresa con su socio Microsoft, la nueva influencia política de Elon Musk y los límites teóricos del escalamiento de la IA. Altman también adelantó el próximo lanzamiento de productos “12 días de OpenAI”.
Se le preguntó a Altman sobre los informes de que el acuerdo de 13 mil millones de dólares de OpenAI con Microsoft está en peligro de desmoronarse:
“No creo que nos estemos desenredando. No pretenderé que no haya desajustes ni desafíos. Obviamente hay algunos. Pero en general, creo que ha sido algo tremendamente positivo para ambas empresas”.
Con respecto a la carrera armamentista de la computación con IA, se le preguntó a Altman si OpenAI necesitaba desarrollar sus propios recursos informáticos, en lugar de depender de socios (como NVIDIA y microsoft):
“No… Creo que debemos asegurarnos de tener suficiente computación del tipo que queremos, en la que podamos confiar y todo eso. Y puede haber razones por las que tenemos algunas ideas muy locas sobre cosas que nos gustaría construir que son, ya sabes, de alto riesgo y alta recompensa. Pero ciertamente no necesitamos que OpenAI se vuelva realmente bueno en la construcción de centros de datos a gran escala similares a computadoras”.
Sorkin le preguntó a Altman sobre el hecho de que nunca recibió ninguna participación en OpenAI, que busca pasar de una entidad sin fines de lucro a una empresa principal con fines de lucro.
“Mira, es raro que no obtuviera capital… No lo quería… Si pudiera retroceder en el tiempo, lo habría tomado… sólo un poquito, sólo para nunca tenerlo. para responder a esta pregunta”.
De cara a cómo serán los próximos uno o dos años de progreso en la IA, Altman dijo:
“Los agentes son de lo que todo el mundo habla… ya sabes, esta idea de que puedes darle a un sistema de IA una tarea bastante complicada, como un tipo de tarea que le asignas a un humano muy inteligente y que tarda un tiempo en ponerse en marcha y realizarla. y utilizar un montón de herramientas y crear algo de valor. Ese es el tipo de cosas que esperaría el próximo año… Si funciona tan bien como esperamos, realmente puede transformar las cosas”.
Algunas de las cosas más interesantes que dijo Altman estaban relacionadas con el cofundador de OpenAI, Elon Musk, y su startup xAI, que compite directamente con ChatGPT. Refiriéndose a xAI, Altman dijo: “Supongo que serán un competidor realmente serio… Tremendo respeto por la rapidez con la que construyeron ese centro de datos”, refiriéndose a Colossus, el enorme clúster de supercomputación de xAI impulsado por 100.000 GPU Nvidia H100.
Luego, la conversación giró hacia la nueva influencia política de Elon Musk que surge de su estrecha relación con el presidente electo Donald Trump, y cómo Musk podría usar esa influencia para beneficiar a su imperio y castigar a sus competidores:
“Sería profundamente antiestadounidense utilizar el poder político (en la medida en que lo tiene Elon) para perjudicar a sus competidores… No creo que Elon lo hiciera”.
Altman reflexionó sobre su relación personal con Musk, que se ha deteriorado: “Crecí con él como un megahéroe… Todavía me alegro de que exista”.
Cuando se le preguntó si los informes sobre las leyes de escala de la IA podrían estar chocando contra una pared, Altman no se lo creyó:
“Siempre me ha llamado la atención lo mucho que a la gente le encanta especular: ¿hay un muro? ¿Seguirá escalando? En lugar de simplemente mirar la curva de progreso y decir: ‘Tal vez no debería apostar una exponencial contra otra exponencial como esa’”.
Altman adelantó una serie de lanzamientos y demostraciones diarias de OpenAI que se llevarán a cabo durante las próximas semanas:
“Tenemos un montón de cosas nuevas y geniales… Haremos ’12 días de OpenAI’ a partir de mañana, pero lanzaremos algo o haremos una demostración todos los días durante los próximos 12 días de la semana”.
Esta publicación se ha actualizado para aclarar una cita de Sam Altman.
Se le preguntó a Altman sobre los informes de que el acuerdo de 13 mil millones de dólares de OpenAI con Microsoft está en peligro de desmoronarse:
“No creo que nos estemos desenredando. No pretenderé que no haya desajustes ni desafíos. Obviamente hay algunos. Pero en general, creo que ha sido algo tremendamente positivo para ambas empresas”.
Con respecto a la carrera armamentista de la computación con IA, se le preguntó a Altman si OpenAI necesitaba desarrollar sus propios recursos informáticos, en lugar de depender de socios (como NVIDIA y microsoft):
“No… Creo que debemos asegurarnos de tener suficiente computación del tipo que queremos, en la que podamos confiar y todo eso. Y puede haber razones por las que tenemos algunas ideas muy locas sobre cosas que nos gustaría construir que son, ya sabes, de alto riesgo y alta recompensa. Pero ciertamente no necesitamos que OpenAI se vuelva realmente bueno en la construcción de centros de datos a gran escala similares a computadoras”.
Sorkin le preguntó a Altman sobre el hecho de que nunca recibió ninguna participación en OpenAI, que busca pasar de una entidad sin fines de lucro a una empresa principal con fines de lucro.
“Mira, es raro que no obtuviera capital… No lo quería… Si pudiera retroceder en el tiempo, lo habría tomado… sólo un poquito, sólo para nunca tenerlo. para responder a esta pregunta”.
De cara a cómo serán los próximos uno o dos años de progreso en la IA, Altman dijo:
“Los agentes son de lo que todo el mundo habla… ya sabes, esta idea de que puedes darle a un sistema de IA una tarea bastante complicada, como un tipo de tarea que le asignas a un humano muy inteligente y que tarda un tiempo en ponerse en marcha y realizarla. y utilizar un montón de herramientas y crear algo de valor. Ese es el tipo de cosas que esperaría el próximo año… Si funciona tan bien como esperamos, realmente puede transformar las cosas”.
Algunas de las cosas más interesantes que dijo Altman estaban relacionadas con el cofundador de OpenAI, Elon Musk, y su startup xAI, que compite directamente con ChatGPT. Refiriéndose a xAI, Altman dijo: “Supongo que serán un competidor realmente serio… Tremendo respeto por la rapidez con la que construyeron ese centro de datos”, refiriéndose a Colossus, el enorme clúster de supercomputación de xAI impulsado por 100.000 GPU Nvidia H100.
Luego, la conversación giró hacia la nueva influencia política de Elon Musk que surge de su estrecha relación con el presidente electo Donald Trump, y cómo Musk podría usar esa influencia para beneficiar a su imperio y castigar a sus competidores:
“Sería profundamente antiestadounidense utilizar el poder político (en la medida en que lo tiene Elon) para perjudicar a sus competidores… No creo que Elon lo hiciera”.
Altman reflexionó sobre su relación personal con Musk, que se ha deteriorado: “Crecí con él como un megahéroe… Todavía me alegro de que exista”.
Cuando se le preguntó si los informes sobre las leyes de escala de la IA podrían estar chocando contra una pared, Altman no se lo creyó:
“Siempre me ha llamado la atención lo mucho que a la gente le encanta especular: ¿hay un muro? ¿Seguirá escalando? En lugar de simplemente mirar la curva de progreso y decir: ‘Tal vez no debería apostar una exponencial contra otra exponencial como esa’”.
Altman adelantó una serie de lanzamientos y demostraciones diarias de OpenAI que se llevarán a cabo durante las próximas semanas:
“Tenemos un montón de cosas nuevas y geniales… Haremos ’12 días de OpenAI’ a partir de mañana, pero lanzaremos algo o haremos una demostración todos los días durante los próximos 12 días de la semana”.
Esta publicación se ha actualizado para aclarar una cita de Sam Altman.
Noticias
🔮 De ChatGPT a mil millones de agentes
Hola, soy Azeem.
Estoy en la Cumbre DealBook en Nueva York hoy y acabo de escuchar a Sam Altman hablar sobre su visión sobre los próximos años:
Espero que en 2025 tengamos sistemas que la gente mire, incluso aquellos que son escépticos sobre el progreso actual, y digan: ‘Vaya, no esperaba eso’. Los agentes son de lo que todo el mundo habla y por una buena razón. Esta idea de que puedes darle a un sistema de IA una tarea bastante complicada, el tipo de tarea que le darías a un ser humano muy inteligente, que lleva un tiempo implementar y usar un montón de herramientas y crear algo de valor. Ese es el tipo de cosas que esperaría el próximo año. Y eso es un gran problema. Si eso funciona tan bien como esperamos, realmente puede transformar las cosas.
Los agentes han estado en mi hoja de ruta por un tiempo. El año pasado hablé de nuestra mil millones de agentes futuros e invirtió en un par de nuevas empresas que construyen sistemas agentes. En la publicación de hoy, analizamos cómo pensamos que pasaremos de asistentes de inteligencia artificial como ChatGPT a miles de millones de agentes que nos respaldan en segundo plano. ¡Disfrutar!
Por
y
En un futuro muy cercano, los trabajadores del conocimiento podrían contar con el apoyo de miles de agentes de IA, todos operando en paralelo. Esto no es futurismo especulativo. Jensen Huang de Nvidia habló recientemente sobre el papel de los agentes Ya juega en Nvidia y cómo ve su futuro:
Puntilla: ¿Ya estás utilizando cadenas de razonamiento y herramientas como o1 en nuestro propio negocio para mejorarlo?
Jensen: Absolutamente. Nuestro sistema de ciberseguridad actual no puede funcionar sin nuestros propios agentes. Contamos con agentes de IA que ayudan a diseñar chips: Hopper no sería posible, Blackwell no sería posible y ni siquiera pensamos en Rubin. Contamos con diseñadores de chips de IA, ingenieros de software de IA e ingenieros de verificación de IA, y los construimos todos internamente. Tenemos la capacidad y preferiríamos aprovechar la oportunidad para explorar la tecnología nosotros mismos. Espero que Nvidia algún día sea una empresa de 50.000 empleados con 100 millones de asistentes de IA […] Las IA reclutarán a otras IA para resolver problemas […] Por lo tanto, seremos simplemente una gran base de empleados, algunos de ellos digitales y otros biológicos.
De manera similar, Sam Altman anticipa el surgimiento de una unicornio unipersonal—Una empresa de mil millones de dólares administrada por un solo individuo que aprovecha un ejército de agentes de IA.
Los asistentes de IA actuales, como ChatGPT, requieren una participación humana constante: son copilotos, no actores autónomos. La próxima evolución, que ya está en marcha, es la de agentes que ejecutan tareas de forma independiente una vez que se les asigna un objetivo, muy parecido a delegar a un equipo experimentado y dar un paso atrás mientras ellos se encargan del resto. Y no hay límite para el tamaño de este equipo.
Para ayudarle a entender esto, nos asociamos con
ingeniero de aprendizaje automático, escritor y editor en jefe de .
Juntos, exploraremos tres áreas en la publicación de hoy:
-
El estado actual de los agentes de IA y sus aplicaciones en el mundo real.
-
¿Por qué su adopción generalizada se está volviendo inevitable?
-
Cómo esta transición podría conducir a un futuro en el que miles de millones de agentes aumenten el trabajo humano.
Los agentes han sido una prioridad para los científicos informáticos durante décadas, pero hasta hace poco se lograron pocos avances. Lo lejos que hemos llegado se refleja mejor en una cita de un artículo de 1997 por los científicos informáticos Christopher Welty y Louis Hoebel, quienes luego escribieron
Cualquiera que tenga conocimientos sobre “agentes” no puede evitar reconocer que, como tecnología de inteligencia artificial, normalmente hay muy poca inteligencia real involucrada. En cierto sentido, los Agentes pueden definirse como IA a pequeña escala que funciona.
La era ChatGPT introdujo sistemas basados en LLM que actualmente consideramos “agentes de IA”. Los primeros prototipos como BebéAGIpor ejemplo, demostró que la planificación de tareas podría permitir a los LLM actuar de forma autónoma.
Ejemplo de Yohei Nakajima
Las últimas mejoras se han capturado en puntos de referencia (consulte la Informe sobre el estado de la IA 2024 para profundizar) e investigaciones que demuestran que los LLM existentes se pueden utilizar para crear agentes que aprenden continuamente en entornos abiertos (como Minecraft).
Lanzamiento de DeepMind gatoun “agente generalista” que utiliza la misma idea subyacente en los LLM para realizar tareas, desde apilar bloques con un brazo robótico real hasta subtitular imágenes. Joon Park y sus colegas propusieron Agentes generativos como una caja de arena interactiva que se utilizará principalmente para las ciencias sociales. En ciencias duras, investigadores de Stanford crearon un laboratorio virtual que utilizaba agentes crear 92 nuevos diseños de nanocuerposincluidos múltiples nanocuerpos con actividad de unión exitosa contra el virus que causa Covid-19 (como se destaca en EV#501).
En la empresa, Adepto imaginó un asistente digital que podría convertir un comando de texto en una serie de acciones, como hacer un plano para una pieza nueva de un automóvil, y recaudó 350 millones de dólares hacerlo antes de ser absorbido en Amazon.
En el ámbito del consumo, empresas emergentes como Shortwave han desarrollado agentes que pueden desempeñar el papel de asistentes ejecutivos para gestionar y estructurar la información en dominios como el correo electrónico. Azeem ha invertido en dos nuevas empresas de agentes, WordWare y Mellizo.
Mientras tanto, Microsoft ha estado aprovechando su fortaleza en software empresarial para establecer silenciosamente un punto de apoyo en esta área. Encima 100.000 de sus clientes empresariales ya están experimentando en Copilot Studio, creando agentes autónomos personalizados o implementando soluciones listas para usar.
Hiscox, una aseguradora, utilizó agentes para reducir el tiempo de cotización de riesgos complejos de tres días a unos pocos minutos. De manera similar, McKinsey, utilizando el ecosistema de agentes de Microsoft, ha reducido su flujo de trabajo de admisión de proyectos de 20 días a dos días.
Durante el siglo pasado, hemos sido testigos de asombrosos aumentos de productividad en industrias como la manufacturera y la agrícola: las fábricas producen productos exponencialmente más rápido y las granjas alimentan a miles de millones con una fracción de la fuerza laboral que alguna vez necesitaron. Sin embargo, en las aulas todavía se necesita un maestro para educar a 30 estudiantes. Esto es La maldición de Baumol. Cuando los salarios aumentan en sectores de alta productividad como el manufacturero, los servicios intensivos en mano de obra deben aumentar los salarios para competir, incluso si su productividad permanece estancada. Así, mientras los productos manufacturados se abaratan, muchos servicios se encarecen.
En el centro de esta cuestión está nuestra incapacidad para escalar nuestra propia humano tiempo. Según la Ley de Amdahl, la velocidad de un sistema está limitada por su componente más lento. En muchas partes del sector de servicios, esto se reduce a limitaciones en torno a los procesos dependientes de los seres humanos. La Revolución Industrial superó las limitaciones físicas mediante la mecanización; La IA podría ser una oportunidad similar para superar los obstáculos cognitivos al otro lado de…
-
Velocidad: Los sistemas de IA operan mucho más allá de los tiempos de reacción humanos, procesando datos en milisegundos. El LLM más rápido produce resultados a 6000 veces la velocidad que puede alcanzar un humano.
-
Escala: Podemos implementar tantos agentes de IA como lo permitan nuestros recursos computacionales, superando potencialmente la población humana.
-
Paralelización: Las tareas se pueden dividir entre miles o incluso millones de agentes de IA. En lugar de analizar 100 documentos secuencialmente, 100 agentes de IA pueden procesarlos simultáneamente y fusionar sus hallazgos en un solo informe.
-
Eficiencia de costes: Con el tiempo, los agentes se vuelven más baratos que la mano de obra humana, especialmente cuando se escala. En este momento podemos conseguir un sistema protoagente para realizar un metanálisis de 200 artículos de ArXiv por aproximadamente el 1% del costo humano. AlphaFold predijo 200 millones de estructuras proteicas, cada una de las cuales tradicionalmente cuesta $100,000 y un doctorado completo para determinar.
-
Personalización: En lugar de dividir un servicio humano entre muchos, la IA permite experiencias individualizadas para todos: un tutor privado para usted o su hijo, por ejemplo.
-
Aprendizaje y adaptación: Como sostiene el investigador independiente Gwern Branwen: “Todo problema suficientemente difícil se convierte en un problema de aprendizaje por refuerzo.“Cada desafío complejo requiere tomar secuencias de decisiones bajo incertidumbre donde cada elección afecta las opciones y resultados futuros, que es exactamente lo que resuelve el aprendizaje por refuerzo. Con esto, los sistemas de IA pueden ejecutar millones de experimentos paralelos, agregar sus aprendizajes mediante el reparto de peso y actuar sobre esos conocimientos de una manera que los sistemas biológicos no pueden.
Durante el próximo año, el despliegue de agentes tomará un “Gatear, caminar, correr” acercarse. Las empresas están experimentando con casos de uso simples, antes de expandirse en complejidad. De ahí todo lo que se habla de los agentes de servicio al cliente, una implementación fácil y de riesgo relativamente bajo. Pero la complejidad y la variedad de tareas que un agente puede realizar crecerán.
Para pensar más en una evolución que podríamos comenzar a ver el próximo año, veamos una profesión que todos aman… los abogados.
De acuerdo a una base de datos mantenida por el Departamento de Trabajo de EE. UU.los abogados realizan 22 tareas profesionales distintas. Una de estas tareas principales es la preparación de escritos y dictámenes legales para presentaciones judiciales. Imagine a un socio de una firma de abogados asignando un complejo escrito de apelación a lo que parece ser un único asistente de IA, pero que en realidad es una orquesta de agentes especializados, cada uno con una “experiencia” distinta.
El proceso comienza en el momento en que se cargan los expedientes del caso. Un agente coordinador (un director de proyectos de IA, por así decirlo) analiza inmediatamente los requisitos del tribunal y los plazos de presentación. En cuestión de segundos, un agente de investigación revisa bases de datos legales a una velocidad sobrehumana. Identifica todos los precedentes relevantes y patrones sutiles en el razonamiento judicial en casos similares. Al mismo tiempo, un agente de análisis de casos examina el expediente del juicio, relaciona los hechos del caso con elementos legales e identifica argumentos prometedores que los abogados humanos podrían pasar por alto en miles de páginas de testimonios.
Así como un agente de redacción elabora argumentos preliminares en un lenguaje legal preciso, un agente de gestión de citaciones garantiza que cada referencia cumpla con los estándares del Bluebook y valida que cada caso citado siga siendo una buena ley. Un agente de cumplimiento técnico monitorea continuamente el formato, el recuento de palabras y las reglas judiciales en tiempo real, mientras que un agente de control de calidad valida las cotizaciones y garantiza la coherencia lógica. El agente coordinador contrata a otros agentes, gestiona los flujos de trabajo y resuelve conflictos.
Y esto es sólo para una única tarea…
La magia del sistema agente es que puede escalar. Podría tener una docena o más de informes preparados en paralelo. Lo que comienza con unos pocos agentes especializados manejando un informe legal rápidamente se convierte en cascada. Empezar con 1,3 millones de abogados estadounidensescada uno de los cuales despliega 5 agentes especializados para cada una de las 22 tareas que realizan; eso ya son mil millones de agentes. Eso es sólo para 1 millón de abogados… Se estima que hay 1.000 millones trabajadores del conocimiento en todo el mundo. Habrá miles de millones de agentes. Y esto supone 5 agentes por tarea. ¿Pero por qué no 5, 10, 100 agentes? Teóricamente no hay más límite que el de eficacia.
Pero hacer que las organizaciones de abogados sean más eficientes no es lo único que los agentes permitirán. Como señala Flo Crivello, fundador y CEO de Lindy, cuando las herramientas se vuelven exponencialmente más baratas, pasan de ser activos corporativos a permitir la creatividad individual:
-
Recursos7 meses ago
Cómo Empezar con Popai.pro: Tu Espacio Personal de IA – Guía Completa, Instalación, Versiones y Precios
-
Startups7 meses ago
Remove.bg: La Revolución en la Edición de Imágenes que Debes Conocer
-
Recursos7 meses ago
Suno.com: La Revolución en la Creación Musical con Inteligencia Artificial
-
Recursos6 meses ago
Perplexity aplicado al Marketing Digital y Estrategias SEO
-
Estudiar IA6 meses ago
Curso de Inteligencia Artificial de UC Berkeley estratégico para negocios
-
Eventos7 meses ago
La nueva era de la inteligencia artificial por el Washington Post – Mayo 2024
-
Noticias5 meses ago
Dos periodistas octogenarios deman a ChatGPT por robar su trabajo
-
Tutoriales7 meses ago
Cómo Comenzar a Utilizar ChatGPT: Una Guía Completa para Principiantes