Connect with us

Noticias

¿Qué proveedor de IA debería elegir? Aquí están los 7 primeros (OpenAI sigue liderando)

Published

on

Únase a nuestros boletines diarios y semanales para obtener las últimas actualizaciones y contenido exclusivo sobre la cobertura de IA líder en la industria. Más información


Los proveedores están implementando nuevas herramientas de inteligencia artificial generativa todos los días en un mercado que se ha comparado con el Salvaje Oeste. Pero debido a que la tecnología es tan nueva y está en constante evolución, puede resultar extremadamente confusa, y los proveedores de plataformas a veces hacen promesas especulativas.

La firma de TI GAI Insights espera brindar cierta claridad a los tomadores de decisiones empresariales con el lanzamiento de la primera guía del comprador conocida sobre modelos de lenguajes grandes (LLM) y generación de IA. Revisó a más de dos docenas de proveedores e identificó siete líderes emergentes (OpenAI está muy por delante del resto). Además, los modelos propietarios, de código abierto y pequeños tendrán una gran demanda en 2025, a medida que la alta dirección priorice el gasto en IA.

“Estamos viendo una migración real de la concientización a la experimentación temprana para impulsar realmente los sistemas a la producción”, dijo a VentureBeat Paul Baier, director ejecutivo y cofundador de GAI Insights. “Esto está explotando, la IA está transformando toda la pila de TI empresarial”.

7 líderes emergentes

GAI Insights, que aspira a ser el “Gartner de la IA de generación”, revisó a 29 proveedores en casos de uso comunes de IA de generación empresarial, como servicio al cliente, soporte de ventas, marketing y cadenas de suministro. Descubrieron que OpenAI sigue firmemente a la cabeza, acaparando el 65% de la cuota de mercado.

La firma señala que la startup tiene asociaciones con multitud de proveedores de contenidos y chips (incluido Broadcom, con quien está desarrollando chips). “Obviamente son los primeros, ellos definieron la categoría”, dijo Baier. Sin embargo, señaló, la industria se está “dividiendo en subcategorías”.

Los otros seis proveedores que GAI Insights identificó como líderes emergentes (en orden alfabético):

  • Amazon (Titan, Bedrock): tiene un enfoque neutral respecto a los proveedores y es una “ventanilla única” para la implementación. También ofrece una infraestructura de IA personalizada en forma de chips de IA especializados como Trainium e Inferentia.
  • Anthropic (Sonnet, Haiku, Opus): es un competidor “formidable” de OpenAI, con modelos que cuentan con largas ventanas de contexto y funcionan bien en tareas de codificación. La compañía también tiene un fuerte enfoque en la seguridad de la IA y este año ha lanzado múltiples herramientas para uso empresarial junto con artefactos, uso de computadoras y recuperación contextual.
  • Cohere (Command R): ofrece modelos centrados en la empresa y capacidades multilingües, así como implementaciones locales y de nube privada. Sus modelos Embed y Rerank pueden mejorar la búsqueda y recuperación con generación aumentada de recuperación (RAG), lo cual es importante para las empresas que buscan trabajar con datos internos.
  • CustomGPT: tiene una oferta sin código y sus modelos presentan alta precisión y bajas tasas de alucinaciones. También tiene funciones empresariales como Sign-On y OAuth y proporciona análisis e información sobre cómo los empleados y clientes utilizan las herramientas.
  • Meta (Llama): Presenta modelos “mejores en su clase” que van desde pequeños y especializados hasta de vanguardia. Su serie Meta’s Llama 3, con 405 mil millones de parámetros, rivaliza con GPT-4o y Claude 3.5 Sonnet en tareas complejas como razonamiento, matemáticas, procesamiento multilingüe y comprensión de contexto prolongado.
  • Microsoft (Azure, Phi-3): adopta un enfoque dual: aprovecha las herramientas existentes de OpenAI mientras invierte en plataformas patentadas. La compañía también está reduciendo la dependencia de los chips mediante el desarrollo de los suyos propios, incluidos Maia 100 y Cobalt 100.

Algunos otros proveedores evaluados por GAI Insights incluyen SambaNova, IBM, Deepset, Glean, LangChain, LlamaIndex y Mistral AI.

Los proveedores fueron calificados en función de una variedad de factores, incluida la innovación de productos y servicios; claridad del producto y servicio y beneficios y características; trayectoria en el lanzamiento de productos y asociaciones; compradores objetivo definidos; calidad de los equipos técnicos y experiencia del equipo directivo; relaciones estratégicas y calidad de los inversionistas; dinero recaudado; y valoración.

Mientras tanto, Nvidia sigue dominando, con el 85% de la cuota de mercado. La empresa seguirá ofreciendo productos en todos los niveles de hardware y software, e innovará y crecerá en 2025 a un ritmo “vertiginoso”.

Si bien el mercado de la IA de generación aún se encuentra en sus primeras etapas (solo el 5% de las empresas tienen aplicaciones en producción), en 2025 se verá un crecimiento masivo, con el 33% de las empresas impulsando modelos a producción, proyecta GAI Insights. La IA de generación es la principal prioridad presupuestaria para los CIO y CTO en medio de una caída de 240 veces en los últimos 18 meses en el costo del cálculo de la IA.

Curiosamente, el 90% de las implementaciones actuales utilizan LLM propietarios (en comparación con el código abierto), una tendencia que la empresa denomina “Sea dueño de su propia inteligencia”. Esto se debe a la necesidad de una mayor privacidad de los datos, control y cumplimiento normativo. Los principales casos de uso de la IA de generación incluyen atención al cliente, codificación, resúmenes, generación de texto y gestión de contratos.

Pero en última instancia, señaló Baier, “en este momento hay una explosión en casi cualquier caso de uso”.

Señaló que se estima que el 90% de los datos no están estructurados y se encuentran en correos electrónicos, archivos PDF, vídeos y otras plataformas y se maravilló de que “la generación de IA nos permite hablar con las máquinas, nos permite desbloquear el valor de los datos no estructurados. Nunca antes habíamos podido hacer eso de forma rentable. Ahora podemos. Actualmente se está produciendo una impresionante revolución de TI”.

En 2025 también surgirá un mayor número de modelos de lenguaje pequeño (SLM) específicos de verticales, y también habrá demanda de modelos de código abierto (aunque su definición sea polémica). También habrá un mejor rendimiento con modelos aún más pequeños como Gemma (parámetros 2B a 7B), Phi-3 (parámetros 3,8 B a 7B) y Llama 3.2 (1B y 3B). GAI Insights señala que los modelos pequeños son rentables y seguros, y que ha habido desarrollos clave en la tokenización a nivel de bytes, la poda de peso y la destilación de conocimientos que están minimizando el tamaño y aumentando el rendimiento.

Además, se espera que la asistencia de voz sea la “interfaz principal” en 2025, ya que ofrece experiencias más personalizadas y se espera que la IA en el dispositivo experimente un impulso significativo. “Veremos un verdadero auge el próximo año cuando los teléfonos inteligentes comiencen a distribuirse con chips de inteligencia artificial integrados”, dijo Baier.

¿Veremos realmente agentes de IA en 2025?

Si bien los agentes de IA son todo el tema de conversación en las empresas en este momento, queda por ver qué tan viables serán en el próximo año. Hay muchos obstáculos que superar, señaló Baier, como la propagación no regulada, la IA agente que toma decisiones “poco confiables o cuestionables” y opera con datos de mala calidad.

Los agentes de IA aún no se han definido completamente, dijo, y los que se están implementando en este momento se limitan principalmente a aplicaciones internas y implementaciones a pequeña escala. “Vemos todo el revuelo en torno a los agentes de IA, pero pasarán años antes de que se adopten de manera generalizada en las empresas”, dijo Baier. “Son muy prometedores, pero no prometedores el año que viene”.

Factores a considerar al implementar IA de generación

Con el mercado tan saturado y las herramientas tan variadas, Baier ofreció algunos consejos críticos para que las empresas comenzaran. En primer lugar, tenga cuidado con la dependencia de los proveedores y acepte la realidad de que la pila de TI empresarial seguirá cambiando drásticamente durante los próximos 15 años.

Dado que las iniciativas de IA deben provenir de arriba, Baier sugiere que la alta dirección realice una revisión en profundidad con la junta directiva para explorar oportunidades, amenazas y prioridades. El director ejecutivo y los vicepresidentes también deben tener experiencia práctica (al menos tres horas para comenzar). Antes de implementarlo, considere realizar una prueba piloto de chatbot sin riesgo utilizando datos públicos para respaldar el aprendizaje práctico y experimentar con IA en el dispositivo para operaciones de campo.

Las empresas también deberían designar un ejecutivo para supervisar la integración, desarrollar un centro de excelencia y coordinar proyectos, aconseja Baier. Es igualmente importante implementar políticas y capacitación sobre el uso de IA genérica. Para respaldar la adopción, publique una política de uso, realice capacitación básica e identifique qué herramientas están aprobadas y qué información no debe ingresarse.

En definitiva, “no prohíban ChatGPT; sus empleados ya lo están utilizando”, afirma GAI.

Continue Reading
Click to comment

Leave a Reply

Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *

Noticias

Lo que hace y no hace el PD para profesores de OpenAI

Published

on

¿Qué es lo primero que deberían hacer los profesores que se sumergen en la inteligencia artificial generativa?

¿Deberían aprender a aprovechar la IA para crear el plan de lección perfecto? ¿Utilizar la herramienta para generar preguntas para un cuestionario? ¿O deberían aprender primero sobre los posibles sesgos y la desinformación que a menudo se introducen en el contenido generado por IA antes de utilizarlo en su trabajo diario?

Deberían comenzar con lo básico, según OpenAI, creador de ChatGPT y una de las empresas de investigación de inteligencia artificial más destacadas del mundo. El mes pasado, la empresa lanzó un curso en línea de una hora de duración y a su propio ritmo. para profesores de K-12 sobre la definición, el uso y los daños de la IA generativa en el aula. Se lanzó en colaboración con Common Sense Media, una organización nacional sin fines de lucro que califica y revisa una amplia gama de contenido digital según su idoneidad para la edad.

Desde su lanzamiento el 20 de noviembre, alrededor de 10.000 educadores han tomado el curso, y el 98 por ciento de los docentes “compartieron que el curso ofrecía nuevas ideas o estrategias que podrían aplicar a su trabajo”, dijo Robbie Torney, director senior de programas de IA. en Common Sense Media, en un correo electrónico.

Para Eric Curts, entrenador de IA para distritos escolares del noreste de Ohio, el curso es una “buena introducción” para los educadores que aún no han experimentado con ChatGPT o cualquier otro chatbot de IA generativa.

“No se trata sólo de hablar de los beneficios que aporta la IA. También aborda cuestiones como la necesidad de privacidad de los datos”, dijo. “Menciona varias veces que no se debe incluir información de identificación personal sobre los estudiantes”.

El curso también cubre “incitar” a la IA a realizar las tareas que usted desea, dijo Drew Olssen, coordinador de tecnología del distrito escolar de Agua Fría en Avondale, Arizona. El curso viene con una “biblioteca de indicaciones” con ejemplos de indicaciones que los maestros pueden uso: desde redactar correos electrónicos hasta crear un cuestionario para la clase.

“Es una plantilla básica y agradable de lo que harías si ingresaras a ChatGPT por primera vez”, dijo.

Formar a los profesores para que utilicen la IA requiere recursos y tiempo que muchos distritos escolares no tienen, afirmó Olssen, por lo que un curso como este, junto con otros cursos introductorios gratuitos, puede ser un buen punto de partida.

Una encuesta representativa a nivel nacional Un estudio de más de 700 profesores, realizado por el Centro de Investigación EdWeek este otoño, indicó que el 58 por ciento no había recibido ningún desarrollo profesional sobre IA generativa. Esto fue una disminución del 13 por ciento desde la última vez que el Centro de Investigación EdWeek encuestó a los maestros en la primavera. Hubo solo un aumento del 1 por ciento (del 5 al 6 por ciento) en los docentes que dijeron que recibían formación profesional continua en IA generativa.

“Estamos en las primeras etapas de adopción de la IA en K-12. Nuestra primera prioridad es equipar a los educadores con recursos fundamentales para utilizar las herramientas de inteligencia artificial de manera reflexiva y modelar un uso eficaz y responsable en el aula. Este curso, intencionadamente simple, breve y accesible, fue diseñado para comenzar a construir esa base. Estamos entusiasmados de que los educadores quieran recursos más detallados sobre estos temas”, dijo un portavoz de OpenAI.

Un curso intensivo sobre IA generativa necesita más detalles, dicen los expertos

No todo el mundo está de acuerdo con la cantidad de temas nuevos introducidos en el curso de una hora de OpenAI (que le llevó a este reportero unos 30 minutos completar) y el ritmo al que se tratan.

“Para meter tanto, [a teacher] Está garantizado que lo superará rápidamente”, dijo Eryk Salvaggio, investigador del meta(LAB) de la Universidad de Harvard, que ha trabajado en pedagogía basada en IA.

Salvaggio dijo que si bien el curso brinda a los docentes consejos sobre el uso de la IA para ahorrar tiempo y ser más productivos, aún enfatiza que los docentes deben seguir “iterando” los resultados de una consulta solicitada.

“¿La IA realmente ahorra más tiempo a los docentes que si hicieran la tarea ellos mismos?” dijo Salvaggio.

El curso OpenAI se divide en tres secciones: una explicación de la IA, consejos prácticos sobre cómo los profesores pueden usar la IA para preparar lecciones o enseñar y una lección sobre los riesgos que implica el uso de ChatGPT en el aula. Cada módulo tiene secciones de videos y cuestionarios asociados para que los profesores prueben sus conocimientos a medida que avanzan en el curso.

El principal mecanismo de capacitación es crear indicaciones sólidas para ChatGPT para que los profesores obtengan los resultados que buscan. A través de diferentes ejemplos, el curso detalla qué constituye la “mejor” indicación en comparación con una indicación “OK” o menos detallada.

Sin embargo, los ejemplos no cubren varias tareas comunes en el aula, dijo Curts, como nivelar un texto, hacer adaptaciones para estudiantes con discapacidades o idear actividades para la clase.

En las sesiones de formación del propio Curts, que duran tres horas, dedica una hora a abordar los riesgos del uso de IA generativa, que incluyen plagio, “deepfakes”y preocupaciones sobre la privacidad de los datos. La sección de OpenAI sobre daños es mucho más breve y no analiza el plagio ni los deepfakes.

“A [cover risks] correctamente, merece mucho más tiempo del que se puede dedicar en un curso introductorio como este, pero al menos pone estos temas en el radar de los profesores, lo cual creo que es importante”, dijo Curts.

El curso no explica en profundidad cómo funciona la IA, lo que otros expertos en IA identificaron como una oportunidad perdida.

“Gastan una frase en ello [at the beginning]. No se unen [how AI works] a sus limitaciones”, dijo Pat Yongpradit, director académico de Code.org y líder de TeachAI, una iniciativa que apoya a las escuelas en el uso y la enseñanza de la tecnología.

Por ejemplo, dijo, la razón por la que una herramienta como ChatGPT está sesgada es porque refleja los prejuicios del mundo que nos rodea.

Existe la suposición subyacente de que es demasiado técnico para que un consumidor medio (como un profesor) comprenda cómo funciona la IA generativa. Pero los profesores deberían tener al menos un nivel “medio” de conocimiento para entender por qué la IA funciona como lo hace, afirmó.

Además, “es importante lograr que la gente tome buenas decisiones sobre el uso de la IA”, añadió Yongpradit. El curso podría haber agregado ejemplos de sesgos específicos, o incluso ejemplos en los que no es apropiado usar IA debido a sus sesgos, dijo.

Torney, de Common Sense, dijo que el curso es una manera para que “los profesores ocupados adquieran habilidades esenciales en poco tiempo”.

Los detalles complejos y técnicos sobre cómo funciona ChatGPT se dividieron en partes manejables para que los profesores los abordaran a su propio ritmo, dijo. “Anticipamos que se necesitará más capacitación”, añadió Torney.

Los distritos pueden aprovechar este rumbo, pero tienen que trazar un camino a seguir

Yongpradit espera que el curso introductorio de OpenAI despierte el apetito de los profesores por aprender más sobre la IA.

“Lo peor sería si los profesores pensaran que este curso es todo el desarrollo profesional que necesitan”, dijo. “Tampoco creo que los creadores crean que esto sea suficiente. Esta es una pequeña porción de una oportunidad más grande”.

Yongpradit sugiere el desarrollo profesional continuo a través de comunidades de aprendizaje profesional, donde los profesores puedan compartir sus experiencias sobre el uso de la IA en sus aulas y aprender unos de otros.

El distrito escolar de Agua Fría ha implementado una versión de esta capacitación desde 2022, poco después del lanzamiento de ChatGPT por primera vez, dijo Olssen, coordinador de tecnología del distrito. Olssen reunió a un grupo de profesores, bibliotecarios, formadores de alfabetización y administradores que se reúnen todos los meses para discutir cómo utilizar la IA en las aulas.

“Es un tipo de modelo de formación de formadores”, dijo Olssen, “en el que estos embajadores dirigen sesiones de formación con otros educadores cada trimestre”.

El mes pasado, el grupo discutió cómo ir más allá del uso de la IA para realizar tareas simples como generar hojas de trabajo y, en cambio, se centró en cómo se podría usar la IA para crear experiencias de aprendizaje “más profundas” para los estudiantes, a través de proyectos o trabajos de investigación.

Cuando se trata de abordar los sesgos inherentes de la IA generativa y el potencial de desinformación, Olssen dijo que el distrito capacita a maestros y estudiantes, al comienzo del año escolar, sobre cómo evaluar el rendimiento de la IA. La capacitación del distrito es “muy explícita en cuanto a verificar la claridad, precisión, relevancia y ética de lo que escupe una plataforma de IA”, dijo.

El curso OpenAI presenta una comprensión superficial de estos riesgos, dijo Olssen, pero más allá de cualquier curso introductorio, corresponde a los distritos escolares hacer que los maestros sean plenamente conscientes de los daños de “confiar demasiado” en cualquier tecnología.

“Los educadores también están ávidos de más contenido; un tema importante en la retroalimentación ha sido el deseo de un curso más largo”, dijo Torney.

¿Quiere leer más sobre cómo los profesores pueden utilizar (y aprender sobre) la IA? Estén atentos al nuevo informe especial de la Semana de la Educación que se publicará el lunes.

Continue Reading

Noticias

Ya nadie habla de ChatGPT

Published

on

Sam Altman niega que el acuerdo de OpenAI con Microsoft se esté desmoronando y se burla del lanzamiento de productos

El director ejecutivo de OpenAI, Sam Altman, fue entrevistado hoy por Andrew Ross Sorkin en la Cumbre DealBook del New York Times y dijo algunas cosas interesantes sobre la relación de su empresa con su socio Microsoft, la nueva influencia política de Elon Musk y los límites teóricos del escalamiento de la IA. Altman también adelantó el próximo lanzamiento de productos “12 días de OpenAI”.

Se le preguntó a Altman sobre los informes de que el acuerdo de 13 mil millones de dólares de OpenAI con Microsoft está en peligro de desmoronarse:

“No creo que nos estemos desenredando. No pretenderé que no haya desajustes ni desafíos. Obviamente hay algunos. Pero en general, creo que ha sido algo tremendamente positivo para ambas empresas”.

Con respecto a la carrera armamentista de la computación con IA, se le preguntó a Altman si OpenAI necesitaba desarrollar sus propios recursos informáticos, en lugar de depender de socios (como NVIDIA y microsoft):

“No… Creo que debemos asegurarnos de tener suficiente computación del tipo que queremos, en la que podamos confiar y todo eso. Y puede haber razones por las que tenemos algunas ideas muy locas sobre cosas que nos gustaría construir que son, ya sabes, de alto riesgo y alta recompensa. Pero ciertamente no necesitamos que OpenAI se vuelva realmente bueno en la construcción de centros de datos a gran escala similares a computadoras”.

Sorkin le preguntó a Altman sobre el hecho de que nunca recibió ninguna participación en OpenAI, que busca pasar de una entidad sin fines de lucro a una empresa principal con fines de lucro.

“Mira, es raro que no obtuviera capital… No lo quería… Si pudiera retroceder en el tiempo, lo habría tomado… sólo un poquito, sólo para nunca tenerlo. para responder a esta pregunta”.

De cara a cómo serán los próximos uno o dos años de progreso en la IA, Altman dijo:

“Los agentes son de lo que todo el mundo habla… ya sabes, esta idea de que puedes darle a un sistema de IA una tarea bastante complicada, como un tipo de tarea que le asignas a un humano muy inteligente y que tarda un tiempo en ponerse en marcha y realizarla. y utilizar un montón de herramientas y crear algo de valor. Ese es el tipo de cosas que esperaría el próximo año… Si funciona tan bien como esperamos, realmente puede transformar las cosas”.

Algunas de las cosas más interesantes que dijo Altman estaban relacionadas con el cofundador de OpenAI, Elon Musk, y su startup xAI, que compite directamente con ChatGPT. Refiriéndose a xAI, Altman dijo: “Supongo que serán un competidor realmente serio… Tremendo respeto por la rapidez con la que construyeron ese centro de datos”, refiriéndose a Colossus, el enorme clúster de supercomputación de xAI impulsado por 100.000 GPU Nvidia H100.

Luego, la conversación giró hacia la nueva influencia política de Elon Musk que surge de su estrecha relación con el presidente electo Donald Trump, y cómo Musk podría usar esa influencia para beneficiar a su imperio y castigar a sus competidores:

“Sería profundamente antiestadounidense utilizar el poder político (en la medida en que lo tiene Elon) para perjudicar a sus competidores… No creo que Elon lo hiciera”.

Altman reflexionó sobre su relación personal con Musk, que se ha deteriorado: “Crecí con él como un megahéroe… Todavía me alegro de que exista”.

Cuando se le preguntó si los informes sobre las leyes de escala de la IA podrían estar chocando contra una pared, Altman no se lo creyó:

“Siempre me ha llamado la atención lo mucho que a la gente le encanta especular: ¿hay un muro? ¿Seguirá escalando? En lugar de simplemente mirar la curva de progreso y decir: ‘Tal vez no debería apostar una exponencial contra otra exponencial como esa’”.

Altman adelantó una serie de lanzamientos y demostraciones diarias de OpenAI que se llevarán a cabo durante las próximas semanas:

“Tenemos un montón de cosas nuevas y geniales… Haremos ’12 días de OpenAI’ a partir de mañana, pero lanzaremos algo o haremos una demostración todos los días durante los próximos 12 días de la semana”.

Esta publicación se ha actualizado para aclarar una cita de Sam Altman.

Se le preguntó a Altman sobre los informes de que el acuerdo de 13 mil millones de dólares de OpenAI con Microsoft está en peligro de desmoronarse:

“No creo que nos estemos desenredando. No pretenderé que no haya desajustes ni desafíos. Obviamente hay algunos. Pero en general, creo que ha sido algo tremendamente positivo para ambas empresas”.

Con respecto a la carrera armamentista de la computación con IA, se le preguntó a Altman si OpenAI necesitaba desarrollar sus propios recursos informáticos, en lugar de depender de socios (como NVIDIA y microsoft):

“No… Creo que debemos asegurarnos de tener suficiente computación del tipo que queremos, en la que podamos confiar y todo eso. Y puede haber razones por las que tenemos algunas ideas muy locas sobre cosas que nos gustaría construir que son, ya sabes, de alto riesgo y alta recompensa. Pero ciertamente no necesitamos que OpenAI se vuelva realmente bueno en la construcción de centros de datos a gran escala similares a computadoras”.

Sorkin le preguntó a Altman sobre el hecho de que nunca recibió ninguna participación en OpenAI, que busca pasar de una entidad sin fines de lucro a una empresa principal con fines de lucro.

“Mira, es raro que no obtuviera capital… No lo quería… Si pudiera retroceder en el tiempo, lo habría tomado… sólo un poquito, sólo para nunca tenerlo. para responder a esta pregunta”.

De cara a cómo serán los próximos uno o dos años de progreso en la IA, Altman dijo:

“Los agentes son de lo que todo el mundo habla… ya sabes, esta idea de que puedes darle a un sistema de IA una tarea bastante complicada, como un tipo de tarea que le asignas a un humano muy inteligente y que tarda un tiempo en ponerse en marcha y realizarla. y utilizar un montón de herramientas y crear algo de valor. Ese es el tipo de cosas que esperaría el próximo año… Si funciona tan bien como esperamos, realmente puede transformar las cosas”.

Algunas de las cosas más interesantes que dijo Altman estaban relacionadas con el cofundador de OpenAI, Elon Musk, y su startup xAI, que compite directamente con ChatGPT. Refiriéndose a xAI, Altman dijo: “Supongo que serán un competidor realmente serio… Tremendo respeto por la rapidez con la que construyeron ese centro de datos”, refiriéndose a Colossus, el enorme clúster de supercomputación de xAI impulsado por 100.000 GPU Nvidia H100.

Luego, la conversación giró hacia la nueva influencia política de Elon Musk que surge de su estrecha relación con el presidente electo Donald Trump, y cómo Musk podría usar esa influencia para beneficiar a su imperio y castigar a sus competidores:

“Sería profundamente antiestadounidense utilizar el poder político (en la medida en que lo tiene Elon) para perjudicar a sus competidores… No creo que Elon lo hiciera”.

Altman reflexionó sobre su relación personal con Musk, que se ha deteriorado: “Crecí con él como un megahéroe… Todavía me alegro de que exista”.

Cuando se le preguntó si los informes sobre las leyes de escala de la IA podrían estar chocando contra una pared, Altman no se lo creyó:

“Siempre me ha llamado la atención lo mucho que a la gente le encanta especular: ¿hay un muro? ¿Seguirá escalando? En lugar de simplemente mirar la curva de progreso y decir: ‘Tal vez no debería apostar una exponencial contra otra exponencial como esa’”.

Altman adelantó una serie de lanzamientos y demostraciones diarias de OpenAI que se llevarán a cabo durante las próximas semanas:

“Tenemos un montón de cosas nuevas y geniales… Haremos ’12 días de OpenAI’ a partir de mañana, pero lanzaremos algo o haremos una demostración todos los días durante los próximos 12 días de la semana”.

Esta publicación se ha actualizado para aclarar una cita de Sam Altman.

Continue Reading

Noticias

🔮 De ChatGPT a mil millones de agentes

Published

on

Hola, soy Azeem.

Estoy en la Cumbre DealBook en Nueva York hoy y acabo de escuchar a Sam Altman hablar sobre su visión sobre los próximos años:

Espero que en 2025 tengamos sistemas que la gente mire, incluso aquellos que son escépticos sobre el progreso actual, y digan: ‘Vaya, no esperaba eso’. Los agentes son de lo que todo el mundo habla y por una buena razón. Esta idea de que puedes darle a un sistema de IA una tarea bastante complicada, el tipo de tarea que le darías a un ser humano muy inteligente, que lleva un tiempo implementar y usar un montón de herramientas y crear algo de valor. Ese es el tipo de cosas que esperaría el próximo año. Y eso es un gran problema. Si eso funciona tan bien como esperamos, realmente puede transformar las cosas.

Los agentes han estado en mi hoja de ruta por un tiempo. El año pasado hablé de nuestra mil millones de agentes futuros e invirtió en un par de nuevas empresas que construyen sistemas agentes. En la publicación de hoy, analizamos cómo pensamos que pasaremos de asistentes de inteligencia artificial como ChatGPT a miles de millones de agentes que nos respaldan en segundo plano. ¡Disfrutar!

Por

y

En un futuro muy cercano, los trabajadores del conocimiento podrían contar con el apoyo de miles de agentes de IA, todos operando en paralelo. Esto no es futurismo especulativo. Jensen Huang de Nvidia habló recientemente sobre el papel de los agentes Ya juega en Nvidia y cómo ve su futuro:

Puntilla: ¿Ya estás utilizando cadenas de razonamiento y herramientas como o1 en nuestro propio negocio para mejorarlo?

Jensen: Absolutamente. Nuestro sistema de ciberseguridad actual no puede funcionar sin nuestros propios agentes. Contamos con agentes de IA que ayudan a diseñar chips: Hopper no sería posible, Blackwell no sería posible y ni siquiera pensamos en Rubin. Contamos con diseñadores de chips de IA, ingenieros de software de IA e ingenieros de verificación de IA, y los construimos todos internamente. Tenemos la capacidad y preferiríamos aprovechar la oportunidad para explorar la tecnología nosotros mismos. Espero que Nvidia algún día sea una empresa de 50.000 empleados con 100 millones de asistentes de IA […] Las IA reclutarán a otras IA para resolver problemas […] Por lo tanto, seremos simplemente una gran base de empleados, algunos de ellos digitales y otros biológicos.

De manera similar, Sam Altman anticipa el surgimiento de una unicornio unipersonal—Una empresa de mil millones de dólares administrada por un solo individuo que aprovecha un ejército de agentes de IA.

Los asistentes de IA actuales, como ChatGPT, requieren una participación humana constante: son copilotos, no actores autónomos. La próxima evolución, que ya está en marcha, es la de agentes que ejecutan tareas de forma independiente una vez que se les asigna un objetivo, muy parecido a delegar a un equipo experimentado y dar un paso atrás mientras ellos se encargan del resto. Y no hay límite para el tamaño de este equipo.

Para ayudarle a entender esto, nos asociamos con

ingeniero de aprendizaje automático, escritor y editor en jefe de .

Juntos, exploraremos tres áreas en la publicación de hoy:

  • El estado actual de los agentes de IA y sus aplicaciones en el mundo real.

  • ¿Por qué su adopción generalizada se está volviendo inevitable?

  • Cómo esta transición podría conducir a un futuro en el que miles de millones de agentes aumenten el trabajo humano.

Los agentes han sido una prioridad para los científicos informáticos durante décadas, pero hasta hace poco se lograron pocos avances. Lo lejos que hemos llegado se refleja mejor en una cita de un artículo de 1997 por los científicos informáticos Christopher Welty y Louis Hoebel, quienes luego escribieron

Cualquiera que tenga conocimientos sobre “agentes” no puede evitar reconocer que, como tecnología de inteligencia artificial, normalmente hay muy poca inteligencia real involucrada. En cierto sentido, los Agentes pueden definirse como IA a pequeña escala que funciona.

La era ChatGPT introdujo sistemas basados ​​en LLM que actualmente consideramos “agentes de IA”. Los primeros prototipos como BebéAGIpor ejemplo, demostró que la planificación de tareas podría permitir a los LLM actuar de forma autónoma.

Ejemplo de Yohei Nakajima

Las últimas mejoras se han capturado en puntos de referencia (consulte la Informe sobre el estado de la IA 2024 para profundizar) e investigaciones que demuestran que los LLM existentes se pueden utilizar para crear agentes que aprenden continuamente en entornos abiertos (como Minecraft).

Lanzamiento de DeepMind gatoun “agente generalista” que utiliza la misma idea subyacente en los LLM para realizar tareas, desde apilar bloques con un brazo robótico real hasta subtitular imágenes. Joon Park y sus colegas propusieron Agentes generativos como una caja de arena interactiva que se utilizará principalmente para las ciencias sociales. En ciencias duras, investigadores de Stanford crearon un laboratorio virtual que utilizaba agentes crear 92 nuevos diseños de nanocuerposincluidos múltiples nanocuerpos con actividad de unión exitosa contra el virus que causa Covid-19 (como se destaca en EV#501).

En la empresa, Adepto imaginó un asistente digital que podría convertir un comando de texto en una serie de acciones, como hacer un plano para una pieza nueva de un automóvil, y recaudó 350 millones de dólares hacerlo antes de ser absorbido en Amazon.

En el ámbito del consumo, empresas emergentes como Shortwave han desarrollado agentes que pueden desempeñar el papel de asistentes ejecutivos para gestionar y estructurar la información en dominios como el correo electrónico. Azeem ha invertido en dos nuevas empresas de agentes, WordWare y Mellizo.

Mientras tanto, Microsoft ha estado aprovechando su fortaleza en software empresarial para establecer silenciosamente un punto de apoyo en esta área. Encima 100.000 de sus clientes empresariales ya están experimentando en Copilot Studio, creando agentes autónomos personalizados o implementando soluciones listas para usar.

Hiscox, una aseguradora, utilizó agentes para reducir el tiempo de cotización de riesgos complejos de tres días a unos pocos minutos. De manera similar, McKinsey, utilizando el ecosistema de agentes de Microsoft, ha reducido su flujo de trabajo de admisión de proyectos de 20 días a dos días.

Socios de conocimiento predice que todos tendrán un asistente de IA: estos agentes tomarán diferentes formas y redefinirán los límites entre aplicaciones, plataformas y servicios.

Durante el siglo pasado, hemos sido testigos de asombrosos aumentos de productividad en industrias como la manufacturera y la agrícola: las fábricas producen productos exponencialmente más rápido y las granjas alimentan a miles de millones con una fracción de la fuerza laboral que alguna vez necesitaron. Sin embargo, en las aulas todavía se necesita un maestro para educar a 30 estudiantes. Esto es La maldición de Baumol. Cuando los salarios aumentan en sectores de alta productividad como el manufacturero, los servicios intensivos en mano de obra deben aumentar los salarios para competir, incluso si su productividad permanece estancada. Así, mientras los productos manufacturados se abaratan, muchos servicios se encarecen.

En el centro de esta cuestión está nuestra incapacidad para escalar nuestra propia humano tiempo. Según la Ley de Amdahl, la velocidad de un sistema está limitada por su componente más lento. En muchas partes del sector de servicios, esto se reduce a limitaciones en torno a los procesos dependientes de los seres humanos. La Revolución Industrial superó las limitaciones físicas mediante la mecanización; La IA podría ser una oportunidad similar para superar los obstáculos cognitivos al otro lado de…

  1. Velocidad: Los sistemas de IA operan mucho más allá de los tiempos de reacción humanos, procesando datos en milisegundos. El LLM más rápido produce resultados a 6000 veces la velocidad que puede alcanzar un humano.

  2. Escala: Podemos implementar tantos agentes de IA como lo permitan nuestros recursos computacionales, superando potencialmente la población humana.

  3. Paralelización: Las tareas se pueden dividir entre miles o incluso millones de agentes de IA. En lugar de analizar 100 documentos secuencialmente, 100 agentes de IA pueden procesarlos simultáneamente y fusionar sus hallazgos en un solo informe.

  4. Eficiencia de costes: Con el tiempo, los agentes se vuelven más baratos que la mano de obra humana, especialmente cuando se escala. En este momento podemos conseguir un sistema protoagente para realizar un metanálisis de 200 artículos de ArXiv por aproximadamente el 1% del costo humano. AlphaFold predijo 200 millones de estructuras proteicas, cada una de las cuales tradicionalmente cuesta $100,000 y un doctorado completo para determinar.

  5. Personalización: En lugar de dividir un servicio humano entre muchos, la IA permite experiencias individualizadas para todos: un tutor privado para usted o su hijo, por ejemplo.

  6. Aprendizaje y adaptación: Como sostiene el investigador independiente Gwern Branwen: “Todo problema suficientemente difícil se convierte en un problema de aprendizaje por refuerzo.“Cada desafío complejo requiere tomar secuencias de decisiones bajo incertidumbre donde cada elección afecta las opciones y resultados futuros, que es exactamente lo que resuelve el aprendizaje por refuerzo. Con esto, los sistemas de IA pueden ejecutar millones de experimentos paralelos, agregar sus aprendizajes mediante el reparto de peso y actuar sobre esos conocimientos de una manera que los sistemas biológicos no pueden.

Durante el próximo año, el despliegue de agentes tomará un “Gatear, caminar, correr” acercarse. Las empresas están experimentando con casos de uso simples, antes de expandirse en complejidad. De ahí todo lo que se habla de los agentes de servicio al cliente, una implementación fácil y de riesgo relativamente bajo. Pero la complejidad y la variedad de tareas que un agente puede realizar crecerán.

Para pensar más en una evolución que podríamos comenzar a ver el próximo año, veamos una profesión que todos aman… los abogados.

Honoré Daumier, Les Gens du Justice: Les avocats et les plaideurs, 1845

De acuerdo a una base de datos mantenida por el Departamento de Trabajo de EE. UU.los abogados realizan 22 tareas profesionales distintas. Una de estas tareas principales es la preparación de escritos y dictámenes legales para presentaciones judiciales. Imagine a un socio de una firma de abogados asignando un complejo escrito de apelación a lo que parece ser un único asistente de IA, pero que en realidad es una orquesta de agentes especializados, cada uno con una “experiencia” distinta.

El proceso comienza en el momento en que se cargan los expedientes del caso. Un agente coordinador (un director de proyectos de IA, por así decirlo) analiza inmediatamente los requisitos del tribunal y los plazos de presentación. En cuestión de segundos, un agente de investigación revisa bases de datos legales a una velocidad sobrehumana. Identifica todos los precedentes relevantes y patrones sutiles en el razonamiento judicial en casos similares. Al mismo tiempo, un agente de análisis de casos examina el expediente del juicio, relaciona los hechos del caso con elementos legales e identifica argumentos prometedores que los abogados humanos podrían pasar por alto en miles de páginas de testimonios.

Así como un agente de redacción elabora argumentos preliminares en un lenguaje legal preciso, un agente de gestión de citaciones garantiza que cada referencia cumpla con los estándares del Bluebook y valida que cada caso citado siga siendo una buena ley. Un agente de cumplimiento técnico monitorea continuamente el formato, el recuento de palabras y las reglas judiciales en tiempo real, mientras que un agente de control de calidad valida las cotizaciones y garantiza la coherencia lógica. El agente coordinador contrata a otros agentes, gestiona los flujos de trabajo y resuelve conflictos.

Y esto es sólo para una única tarea…

La magia del sistema agente es que puede escalar. Podría tener una docena o más de informes preparados en paralelo. Lo que comienza con unos pocos agentes especializados manejando un informe legal rápidamente se convierte en cascada. Empezar con 1,3 millones de abogados estadounidensescada uno de los cuales despliega 5 agentes especializados para cada una de las 22 tareas que realizan; eso ya son mil millones de agentes. Eso es sólo para 1 millón de abogados… Se estima que hay 1.000 millones trabajadores del conocimiento en todo el mundo. Habrá miles de millones de agentes. Y esto supone 5 agentes por tarea. ¿Pero por qué no 5, 10, 100 agentes? Teóricamente no hay más límite que el de eficacia.

Pero hacer que las organizaciones de abogados sean más eficientes no es lo único que los agentes permitirán. Como señala Flo Crivello, fundador y CEO de Lindy, cuando las herramientas se vuelven exponencialmente más baratas, pasan de ser activos corporativos a permitir la creatividad individual:

Continue Reading

Trending