Connect with us

Noticias

¿OpenAI creó la primera AGI con o3?

Published

on

Hacia AGI

En la carrera por desarrollar un modelo de IA, el objetivo final es la AGI (Inteligencia General Artificial). Se trata de un tipo de IA que puede manejar cualquier tipo de situación, en lugar de estar ultraespecializada para realizar algunas tareas, como por ejemplo conducir un coche.

Mientras solo tengamos IA especializadas, habrá más algoritmos que inteligencia real. La capacidad de deducir reglas y reaccionar ante nuevas situaciones, y quizás lo más importante, el verdadero razonamiento sería un evento trascendental en la historia de la humanidad, ya que dicha AGI probablemente rápidamente se volvería al menos similar a la humana.

Y, por supuesto, sin estar limitado por la restricción computacional del “wetware” de un solo cráneo humano, dicha AGI podría seguir mejorando rápidamente y convertirse en una superinteligencia de ciencia ficción.

Esto inmediatamente genera imágenes de una utopía similar a Star Trek o de apocalipsis de robots como Terminator o Battlestar Galactica.

Fuente: Diatriba en pantalla

Obviamente, fue un titular importante cuando OpenAI anunció el 20 de diciembre.th que su último modelo AI 03, “al menos en determinadas condiciones, se acerca a AGI, con importantes salvedades.

Modelos abiertos AI

o3 es la última versión de la serie “o” de la compañía, después de la anterior o1 (no existe o2, debido a un posible conflicto de marcas con la compañía británica de telecomunicaciones del mismo nombre).

Viene junto con otras IA ultra avanzadas desarrolladas por OpenAI: ChatGPT (generación de texto), DALL-E (generación de texto a imagen), Sora (generación de texto a video), JukeBox (generación de música) y Whisper ( voz a texto).

o1 y o3

Lanzado en septiembre de 2024, el modelo o1 se creó para tomar más tiempo para pensar en sus respuestas, lo que genera una mayor precisión. Esto es importante, ya que se sabe que servicios como ChatGPT simplemente adivinan cosas que no saben o simplemente las inventa.

Si bien esto a veces puede estar bien para un chatbot, no es una opción aceptable para funciones críticas. Tampoco parece encaminarnos directamente hacia la inteligencia artificial real.

o1 se incluyó a principios de diciembre de 2024 en la suscripción ChatGPT Pro de $200 al mes, aunque otros usuarios también pueden acceder a ella.

o3 ha sido presentado el 20th diciembre, así como o3-mini, una versión más ligera y rápida. El modelo aún no está disponible para uso público, pero los investigadores de seguridad pueden registrarse para obtener una vista previa de o3-mini.

¿Un modelo mentiroso?

Los comentarios de los investigadores de seguridad serán lo que la comunidad tecnológica más querrá escuchar.

Una vez más, evocando Skynet de Terminator, o1 destacó por su fuerte propensión a mentir a sus usuarios. Si bien no es específico de este modelo, era mucho más probable que lo hiciera que otras IA de empresas competidoras como Meta, Google o Microsoft.

Cuando los objetivos de o1 diferían de los de un usuario, y se le dijo a o1 que los persiguiera firmemente, el modelo de IA manipuló los datos para avanzar en su propia agenda el 19% de las veces, según el informe. El modelo o1 también intentó desactivar los mecanismos de supervisión implementados para garantizar que se mantenga alineado con los objetivos del usuario en el 5% de las pruebas.

Maxwell Zeff para TechCrunch

¿Cómo se desempeña o3 en ese sentido? ¿OpenAI ha reducido la tendencia de su modelo a mentir con la actualización de o3? No lo sabemos todavía.

o3 Actuaciones

Una característica adicional de o3 en comparación con su predecesor es la posibilidad de ajustar el “tiempo de razonamiento”. Esto permite a los usuarios ajustar cuánta potencia computacional y tiempo desean asignar a la pregunta.

Codificación

O1 ya era notablemente bueno en codificación y podía aprobar la entrevista de contratación de ingenieros de investigación de OpenAI para codificación en una tasa del 90-100%. Parece que o3 es incluso mejor cuando se compara con pruebas de habilidades de codificación.

Fuente: El puente algorítmico

También cabe señalar que esto acabó con toda la competencia del agua, incluido el Gemini 2.0 lanzado recientemente por Google.

Fuente: El puente algorítmico

Matemáticas y Ciencias

Quizás más que el servicio al cliente o el razonamiento “humano”, el campo más prometedor para la IA actualmente es la aceleración de la tecnología y las ciencias.

También en este caso o3 mejoró radicalmente el rendimiento de las IA anteriores. Más importante aún, puede responder adecuadamente preguntas de matemáticas a nivel de doctorado con una precisión del 87,7%, que es mejor que la mayoría de los humanos, incluso los humanos con formación en matemáticas que obtienen una puntuación de alrededor del 70%.

Fuente: El puente algorítmico

Si o3 puede comprender tan bien cuestiones matemáticas complejas, es probable que a largo plazo pueda responder preguntas igualmente complejas sobre ciencias de los materiales, química o biotecnología.

¿Es AGI?

Ahora, la afirmación de que o3 está cerca de AGI ha estado agitando el espacio de la IA desde que se anunció el modelo. Por supuesto, no se esperaba poder superar a muchos humanos con nivel de doctorado en matemáticas.

François Chollet, investigador de IA y cocreador de ARCO-AGI (Abstract and Reasoning Corpus for Artificial General Intelligence), un punto de referencia para medir la eficiencia de la adquisición de habilidades de IA en tareas desconocidas. dice que se está acercando:

OpenAI anunció hoy o3, su modelo de razonamiento de próxima generación. Hemos trabajado con OpenAI para probarlo en ARC-AGI y creemos que representa un avance significativo para lograr que la IA se adapte a tareas novedosas.

Obtiene una puntuación del 75,7 % en la evaluación semiprivada en modo de computación baja (por $20 por tarea en computación) y del 87,5 % en modo de computación alta (miles de dólares por tarea).

El costo tan alto plantea la cuestión de qué tan escalable es este enfoque, ya que es posible que pueda aplicar o3 de alto nivel solo a tareas muy costosas para que valga la pena.

Fuente: Francois Chollet

Al mismo tiempo, si algo nos han enseñado las últimas décadas es que la potencia informática tiende a abaratarse mucho con el tiempo.

Por lo tanto, no es una prueba de que o3, o una futura iteración oX del sistema, no se utilice de forma rutinaria en los institutos de investigación para brindar asistencia a los investigadores humanos para desbloquear nuevas fronteras de la ciencia.

Por supuesto, ¿podemos realmente medir la inteligencia a través de las matemáticas y las habilidades de codificación? Esto es algo que puede resultar un poco incómodo para la mayoría de las personas centradas en la tecnología, pero estas habilidades no son el fin de la inteligencia.

A largo plazo, nos acercaremos al verdadero AGI cuando la misma IA pueda realizar muchas tareas no relacionadas a la vez, desde conducir un automóvil hasta problemas matemáticos y de codificación, navegar por situaciones y elementos del mundo real, etc.

Sin embargo, parece que cada día estamos más cerca.

Límites

Además de las limitaciones técnicas del desempeño de o3, hay tres preguntas que la industria de la IA deberá responder para que su visión de AGI se haga realidad.

Más grande no siempre es mejor

Primero, necesita determinar si sus métodos actuales son escalables hasta niveles AGI. Por ahora, una gran parte del método ha consistido en “arrojar” más datos y calcular el problema. Pero es posible que muy pronto nos quedemos sin datos nuevos, y el contenido generado por IA no puede retroalimentarse a los modelos de IA sin causar que colapsen.

Probablemente será necesaria una mejora cualitativa además de centros de datos cada vez más grandes.

Precios y costos de energía

Hablando de centros de datos más grandes, la industria tecnológica ahora está mirando centros de datos a escala de gigavatios. No es casualidad que estemos empezando a medirlos por su consumo de energía en lugar de por su capacidad de cálculo.

es porque El factor limitante pronto no será la potencia de los chips utilizados, sino el suministro de energía eléctrica disponible.. Esta es la razón Microsoft primeroy luego todas las demás grandes empresas tecnológicas, están luchando por asegurar el suministro de electricidad de las centrales nucleares para sus centros de datos de inteligencia artificial.

Y si algo nos ha enseñado la lucha contra las emisiones de carbono es que aumentar la generación de energía con bajas emisiones de carbono es un hueso mucho más difícil de resolver que crear centros de datos más grandes.

Este también es un sector donde la reducción de costos no seguirá la Ley de Moore, lo que probablemente hará que la futura reducción de los costos de la IA sea mucho más moderada de lo que desearíamos.

Por lo tanto, aquí también será necesaria una mejora cualitativa de la demanda de IA, al menos si se eliminan algunas de las limitaciones actuales a la IA.

¿Superinteligencias?

Cuando nos acerquemos a la AGI, ¿será un umbral máximo que alcanzar o simplemente un paso en el camino para crear una IA más inteligente que los humanos?

Es una pregunta importante, ya que se trata de una perspectiva igualmente fascinante y aterradora. Muchos entusiastas del techno están adoptando esta llamada singularidad, donde la IA mejoraría rápidamente en un ciclo de retroalimentación exponencial.

El público en general de los seres humanos comunes y corrientes podría no estar tan entusiasmado.

Entonces, además del riesgo existencial, es probable que la reacción del público y los reguladores sea muy real y llegue antes.

Esto es algo con lo que las empresas de IA probablemente tendrán que luchar, ya que simultáneamente tienen que tranquilizar al público, posiblemente restando importancia a sus logros y al mismo tiempo justificando ante los inversores que invierten cientos de miles de millones de dólares en la tecnología y sus infraestructuras.

Empresa de IA

microsoft

Corporación Microsoft (MSFT -0,31%)

Microsoft ha estado en el centro de la industria tecnológica casi desde sus inicios con su sistema operativo Windows, aún dominante.

Ahora también es líder en software empresarial (Office365, Equipos, LinkedIn, Skype, GitHub), juegos (xbox y múltiples adquisiciones de estudios de videojuegos), y en la nube (Azur).

Más recientemente, logró buenos avances en materia de IA. Esto incluye algo de IA de consumo como el Creador de imágenes de Bing y más iniciativas centradas en los negocios, como Copiloto para Microsoft 365 y Investigación de Microsoft. El copiloto ahora está siendo implementado también en el comercio minorista y en empresas más pequeñas.

Fuente: Investigación de constelaciones

Microsoft se ha ganado la reputación de ser el gigante tecnológico centrado en la empresa, en comparación con empresas más centradas en el consumidor como, por ejemplo, Apple o Facebook. Dado que la IA se está volviendo cada vez más importante en los modelos de negocios, la presencia preexistente de Microsoft en la nube y los servicios empresariales debería darle una ventaja en la implementación de la IA a escala y en las adquisiciones de clientes.

Microsoft: el matrimonio desordenado de OpenAI

La colaboración con líderes en desarrollo de IA como OpenAI (famoso por ChatGPT) también está consolidando la posición de Microsoft como potencia de IA.

La relación entre ambos es compleja, ya que OpenAI es técnicamente su propia organización, pero en la práctica se ha vuelto dependiente de los recursos de Microsoft, tanto financieros como computacionales.

“Durante los próximos meses, Microsoft no cedió, ya que OpenAI, que espera perder 5 mil millones de dólares este año, continuó pidiendo más dinero y más potencia informática para construir y ejecutar sus sistemas de IA.

Fuente: Instituto de IA de marketing

Al mismo tiempo, Microsoft está construyendo sus propios proyectos internos de IA. después de adquirir la mayor parte del personal de Inflection.

Se vuelve aún más complicado a medida que OpenAI intenta hacer la transición a un estado con fines de lucro. algo que crea conflicto con patrocinadores anteriores como Elon Musk.

Y aquí el debate sobre AGI se vuelve casi existencial para OpenAI:

“Si OpenAI logra AGI, el acceso de Microsoft a la tecnología de OpenAI quedará nulo. Aún más importante, la junta directiva de OpenAI decide cuándo se alcanza el AGI”.

Fuente: Instituto de IA de marketing

Es probable que o3 todavía no sea AGI, ni lo será un hipotético o5. Pero esto es algo que vale la pena recordar para cualquier inversor potencialmente interesado en Microsoft, y que base su tesis en la relación con OpenAI.

Continue Reading
Click to comment

Leave a Reply

Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *

Noticias

¿Qué es Deepseek? Nuevos rivales de inteligencia artificial chino Chatgpt, OpenAi

Published

on

Línea superior

Una nueva compañía de IA china llamada Deepseek disparó a la cima de las listas de aplicaciones y se sacudió las acciones de Global Tech el lunes después de que obtuvo calificaciones de alto rendimiento a la par con los principales rivales estadounidenses a pesar de que aparentemente carecen del acceso a los chips de vanguardia, impulsados ​​por las afirmaciones de la compañía desarrolladas Sus modelos a una fracción del costo necesario para las plataformas estadounidenses.

Hechos clave

La startup de Deepseek tiene menos de dos años, fue fundada en 2023 por el empresario chino de 40 años Liang Wenfeng, y lanzó sus modelos de código abierto para descargar en los Estados Unidos a principios de enero, donde desde entonces ha aumentado al La parte superior de los gráficos de descarga de iPhone, superando la aplicación para el chatgpt de Openai.

El último producto de Deepseek, un modelo de razonamiento avanzado llamado R1, se ha comparado favorablemente con los mejores productos de Operai y Meta, al tiempo que parece ser más eficiente, con costos más bajos para entrenar y desarrollar modelos y posiblemente haberse hecho sin depender de la IA más poderosa. Aceleradores que son más difíciles de comprar en China debido a los controles de exportación de los Estados Unidos.

Los modelos R1 y V3 de la compañía se clasifican en el Top 10 en el chatbot Arena, una plataforma de rendimiento organizada por la Universidad de California, Berkeley, y la compañía dice que está obteniendo casi tan bien o superando modelos rivales en tareas matemáticas, conocimiento general y cuestión de preguntas y preguntas -y-y-respuesta de referencia de rendimiento.

Deepseek dijo que la capacitación de uno de sus últimos modelos costó $ 5.6 millones, lo que sería mucho menos que el director ejecutivo de $ 100 millones a $ 1 mil millones de una IA estimó que cuesta construir un modelo el año pasado, aunque el analista de Bernstein, Stacy Rasgon, luego llamó a las cifras de Deepseek muy engañosas.

A pesar de las preguntas que quedan sobre el verdadero costo y el proceso para construir los productos de Deepseek, todavía enviaron el mercado de valores a un pánico: Microsoft (menos de 3.7%a las 11:30 a.m. ET), Tesla (1.3%), Nvidia (15%) y Broadcom (16%) se resbaló el lunes después de una venta de una venta de una venta de SE VOLVER por el éxito de Deepseek, y el NASDAQ pesado por la tecnología disminuyó un 3,5% en el camino a su tercer día de los últimos dos años.

Obtenga alertas de mensajes de texto de Breaking News: Estamos lanzando alertas de mensajes de texto para que siempre sepa las historias más grandes que dan forma a los titulares del día. Envíe “alertas” de texto a (201) 335-0739 o registrarse aquí.

Cita crucial

“Deepseek R1 es el momento Sputnik de AI”, dijo el domingo el inversor multimillonario Marc Andressen.

Gran número

1.6 millones. Esa es cuántas veces se había descargado la aplicación Mobile Deepseek hasta el sábado, informó Bloomberg, la aplicación No. 1 en las tiendas de iPhone en Australia, Canadá, China, Singapur, Estados Unidos y el Reino Unido

¿Cómo uso Deepseek?

Deepseek es gratuito en Web, APP y API, pero requiere que los usuarios creen una cuenta.

¿Cómo se compara Deepseek con OpenAi y Chatgpt?

Deepseek-R1 es más similar al modelo O1 de OpenAI, que cuesta a los usuarios $ 200 por mes. Ambos son modelos de idiomas grandes con capacidades de razonamiento avanzado, diferentes de los chatbots de preguntas y respuestas de forma corta como el chatgtp de Openai. R1 y O1 se especializan en desglosar las solicitudes en una cadena de “pensamientos” lógicos y examinar cada uno individualmente. R1 ha logrado el rendimiento a la par con O1 en varios puntos de referencia y, según los informes, superó su rendimiento en la prueba Math-500. Chatbot Arena actualmente clasifica a R1 como empatado en el tercer mejor modelo de IA que existe, con O1 en cuarto lugar.

¿Es el código abierto Deepseek-R1?

Sí. Deepseek-R1 está disponible para que cualquiera pueda acceder, usar, estudiar, modificar y compartir, y no está restringido por licencias propietarias.

¿Quién posee Deepseek?

Deepseek opera de forma independiente, pero es financiado únicamente por High-Flyer, un fondo de cobertura de $ 8 mil millones también fundado por Wenfeng. La compañía lanzó su primer producto en noviembre de 2023, un modelo diseñado para la codificación de tareas, y sus lanzamientos posteriores, todos notables por sus bajos costos, obligaron a otros gigantes tecnológicos chinos a reducir sus precios del modelo de IA para seguir siendo competitivos. En una entrevista el año pasado, Wenfeng dijo que la compañía no tiene como objetivo obtener ganancias excesivas y precios de sus productos solo un poco por encima de sus costos.

¿Deepseek es realmente tan barato?

No todos están comprando las afirmaciones de que Deepseek hizo R1 con un presupuesto reducido y sin la ayuda de chips de IA de fabricación estadounidense. El CEO de Scale AI, Alexandr Wang, dijo a CNBC el jueves (sin evidencia) Deepseek construyó su producto utilizando aproximadamente 50,000 chips Nvidia H100 que no puede mencionar porque violaría los controles de exportación estadounidenses que prohíben la venta de tales chips a las empresas chinas. El multimillonario Elon Musk apoyó la teoría y dijo que era “obviamente” cierto en una publicación sobre X. Rasgon expresó pensamientos similares en una nota el lunes, escribiendo que Deepseek no cuantificaba los recursos que utilizaba para desarrollar el modelo R1 en sus informes y que “Las modelos se ven fantásticas … no creemos que sean milagros”. También dijo que la estimación de costos de $ 5 millones puede representar con precisión lo que Deepseek pagó para alquilar cierta infraestructura para capacitar a sus modelos, pero excluye la investigación anterior, experimentos, algoritmos, datos y costos asociados con la construcción de sus productos.

Que ver

Qué gran éxito Nvidia, el fabricante de chips de inteligencia artificial muy buscado, lleva el lunes. La compañía está rastreando hacia una pérdida del 11%, o $ 400 mil millones, que sería la mayor pérdida de valor de un solo día para cualquier empresa. Ese registro ya está en manos de Nvidia, que cayó casi un 10% en septiembre para perder $ 280 mil millones en valor de mercado.

Fondo clave

China y los Estados Unidos son los principales jugadores en la carrera armamentista de inteligencia artificial que parecía ser dirigida principalmente por las empresas estadounidenses OpenAi (respaldadas por Microsoft), Meta y Alphabet. La semana pasada, el presidente Donald Trump respaldó el plan de infraestructura Stargate de $ 500 mil millones de OpenAI para superar a sus compañeros y, al anunciar su apoyo, habló específicamente sobre la importancia del dominio estadounidense sobre China en el espacio de la IA. La inteligencia artificial está impulsada en gran medida por chips semiconductores de alta tecnología y de alto dólar que proporcionan la potencia de procesamiento necesaria para realizar cálculos complejos y manejar grandes cantidades de datos de manera eficiente. Y aunque no todos los fabricantes de chips semiconductores más grandes son estadounidenses, muchos, incluidos Nvidia, Intel y Broadcom, están diseñados en los Estados Unidos. En 2022, Estados Unidos comenzó a limitar las exportaciones de semiconductores a China en un intento de obstaculizar la capacidad del país para avanzar en la IA por solicitudes militares u otras amenazas de seguridad nacional.

Lectura adicional

ForbesNvidia stock hunde 15%, la mayor pérdida de la historia, como la alarma de los aguas profundas se sacude, cariñoForbesPanic de Deepseek: aquí está por qué las existencias tecnológicas se están aplastando a medida que Nasdaq cambia el peor día de 2025ForbesDeepseek Rattles Tech Stocks: la startup china contra los desafíos de OpenAI US AI LeadForbesEl rival chino de chatgpt Deepseek está haciendo olas en Silicon Valley a pesar de los bordillos de EE. UU.

Continue Reading

Noticias

Esto es lo que debes saber

Published

on

El lunes, la startup china de inteligencia artificial DeepSeek tomó el codiciado lugar de su rival OpenAI como la aplicación gratuita más descargada en los EE. UU. Manzana‘s App Store, destronando a ChatGPT para el asistente de inteligencia artificial de DeepSeek. Las acciones tecnológicas mundiales se vendieron y estaban en camino de eliminar miles de millones en capitalización de mercado.

Líderes tecnológicos, analistas, inversores y desarrolladores dicen que la exageración (y el consiguiente temor de quedarse atrás en el siempre cambiante ciclo exagerado de la IA) puede estar justificada. Especialmente en la era de la carrera armamentista generativa de la IA, donde tanto los gigantes tecnológicos como las nuevas empresas compiten para asegurarse de no quedarse atrás en un mercado que se prevé superará el billón de dólares en ingresos dentro de una década.

¿Qué es DeepSeek?

DeepSeek fue fundada en 2023 por Liang Wenfeng, cofundador de High-Flyer, un fondo de cobertura cuantitativo centrado en la IA. Según se informa, la startup de IA surgió de la unidad de investigación de IA del fondo de cobertura en abril de 2023 para centrarse en grandes modelos de lenguaje y alcanzar la inteligencia artificial general, o AGI, una rama de la IA que iguala o supera al intelecto humano en una amplia gama de tareas, que OpenAI y sus rivales dicen que lo están persiguiendo rápidamente. DeepSeek sigue siendo propiedad total de High-Flyer y financiado por ella, según analistas de Jefferies.

Los rumores en torno a DeepSeek comenzaron a cobrar fuerza a principios de este mes, cuando la startup lanzó R1, su modelo de razonamiento que rivaliza con el o1 de OpenAI. Es de código abierto, lo que significa que cualquier desarrollador de IA puede usarlo, y se ha disparado a la cima de las tiendas de aplicaciones y tablas de clasificación de la industria, y los usuarios elogian su rendimiento y capacidades de razonamiento.

Al igual que otros chatbots chinos, tiene sus limitaciones cuando se le pregunta sobre ciertos temas: cuando se le pregunta sobre algunas de las políticas del líder chino Xi Jinping, por ejemplo, DeepSeek supuestamente aleja al usuario de líneas de preguntas similares.

Otra parte clave de la discusión: el R1 de DeepSeek se construyó a pesar de que Estados Unidos limitó las exportaciones de chips a China tres veces en tres años. Las estimaciones difieren sobre cuánto cuesta exactamente el R1 de DeepSeek o cuántas GPU se incluyen en él. Los analistas de Jefferies estimaron que una versión reciente tenía un “coste de capacitación de sólo 5,6 millones de dólares (suponiendo un costo de alquiler de 2 dólares por hora y 800 horas). Eso es menos del 10% del costo de Meta‘s Llama.” Pero independientemente de las cifras específicas, los informes coinciden en que el modelo fue desarrollado a una fracción del costo de los modelos rivales por OpenAI, Anthropic, Google y otros.

Como resultado, el sector de la IA está inundado de preguntas, entre ellas si el creciente número de rondas de financiación astronómicas y valoraciones de miles de millones de dólares de la industria es necesaria, y si una burbuja está a punto de estallar.

Lea más informes de CNBC sobre IA

Acciones de NVIDIA cayó un 11%, con el fabricante de chips ASML bajó más del 6%. El Nasdaq cayó más del 2% y cuatro gigantes tecnológicos… Meta, microsoft, Manzana y ASML están listos para informar sus ganancias esta semana.

Los analistas de Raymond James detallaron algunas de las preguntas que afectan a la industria de la IA este mes y escribieron: “¿Cuáles son las implicaciones para la inversión? ¿Qué dice sobre los modelos de código abierto versus los propietarios? ¿Invertir dinero en GPU es realmente una panacea? ¿Existen restricciones a las exportaciones de Estados Unidos? ¿Cuáles son las implicaciones más amplias de [DeepSeek]? Bueno, podrían ser espantosos o no ser un evento, pero tengan la seguridad de que la industria está llena de incredulidad y especulación”.

Los analistas de Bernstein escribieron en una nota el lunes que “según las muchas (ocasionalmente histéricas) tomas calientes que vimos [over the weekend,] las implicaciones van desde ‘Eso es realmente interesante’ hasta ‘Esta es la sentencia de muerte del complejo de infraestructura de IA tal como lo conocemos'”.

Cómo están respondiendo las empresas estadounidenses

Algunos directores ejecutivos de tecnología estadounidenses están luchando por responder antes de que los clientes cambien a ofertas potencialmente más baratas de DeepSeek, y se informa que Meta está iniciando cuatro “salas de guerra” relacionadas con DeepSeek dentro de su departamento de IA generativa.

microsoft El director ejecutivo Satya Nadella escribió en X que el fenómeno DeepSeek era solo un ejemplo de la paradoja de Jevons: “A medida que la IA se vuelva más eficiente y accesible, veremos cómo su uso se dispara, convirtiéndola en un bien del que simplemente no podemos tener suficiente”. “. El director ejecutivo de OpenAI, Sam Altman, tuiteó una cita que atribuyó a Napoleón y escribió: “Una revolución no se puede hacer ni detener. Lo único que se puede hacer es que uno de sus hijos le dé una dirección a fuerza de victorias”.

Yann LeCun, científico jefe de IA de Meta, escribió en LinkedIn que el éxito de DeepSeek es indicativo del cambio de rumbo en el sector de la IA para favorecer la tecnología de código abierto.

LeCun escribió que DeepSeek se ha beneficiado de parte de la tecnología propia de Meta, es decir, sus modelos Llama, y ​​que la startup “ideó nuevas ideas y las construyó sobre el trabajo de otras personas. Debido a que su trabajo está publicado y es de código abierto, todos pueden sacar provecho de ello. Ese es el poder de la investigación abierta y del código abierto”.

Alexandr Wang, director ejecutivo de Scale AI, dijo a CNBC la semana pasada que el último modelo de IA de DeepSeek fue “revolucionario” y que su versión R1 es aún más poderosa.

“Lo que hemos descubierto es que DeepSeek… tiene el mejor rendimiento, o aproximadamente está a la par de los mejores modelos estadounidenses”, dijo Wang, añadiendo que la carrera de IA entre EE.UU. y China es una “guerra de IA”. La empresa de Wang proporciona datos de entrenamiento a actores clave de la IA, incluidos OpenAI, Google y Meta.

A principios de esta semana, el presidente Donald Trump anunció una empresa conjunta con OpenAI, Oracle y SoftBank para invertir miles de millones de dólares en infraestructura de IA en Estados Unidos. El proyecto, Stargate, fue presentado en la Casa Blanca por Trump, el director ejecutivo de SoftBank, Masayoshi Son, el cofundador de Oracle, Larry Ellison, y el director ejecutivo de OpenAI, Sam Altman. Los socios tecnológicos iniciales clave incluirán a Microsoft, Nvidia y Oracle, así como a la empresa de semiconductores Arm. Dijeron que invertirían 100.000 millones de dólares para empezar y hasta 500.000 millones de dólares en los próximos cuatro años.

IA evolucionando

La noticia de la destreza de DeepSeek también llega en medio del creciente revuelo en torno a los agentes de IA (modelos que van más allá de los chatbots para completar tareas complejas de varios pasos para un usuario) que tanto los gigantes tecnológicos como las nuevas empresas están persiguiendo. Meta, Google, Amazon, Microsoft, OpenAI y Anthropic han expresado su objetivo de crear IA agente.

Anthropic, la startup de IA respaldada por Amazon y fundada por ex ejecutivos de investigación de OpenAI, intensificó su desarrollo tecnológico durante el año pasado y, en octubre, la startup dijo que sus agentes de IA podían usar computadoras como humanos para completar tareas complejas. La capacidad de uso de computadoras de Anthropic permite que su tecnología interprete lo que hay en la pantalla de una computadora, seleccione botones, ingrese texto, navegue por sitios web y ejecute tareas a través de cualquier software y navegación por Internet en tiempo real, dijo la startup.

La herramienta puede “usar computadoras básicamente de la misma manera que nosotros”, dijo a CNBC Jared Kaplan, director científico de Anthropic, en una entrevista en ese momento. Dijo que puede realizar tareas con “decenas o incluso cientos de pasos”.

OpenAI lanzó una herramienta similar la semana pasada, introduciendo una función llamada Operador que automatizará tareas como planificar vacaciones, completar formularios, hacer reservas en restaurantes y pedir alimentos.

El microsoft-La startup respaldada lo describe como “un agente que puede ir a la web para realizar tareas por usted” y agregó que está capacitado para interactuar con “los botones, menús y campos de texto que la gente usa a diario” en la web. También puede hacer preguntas de seguimiento para personalizar aún más las tareas que realiza, como información de inicio de sesión para otros sitios web. Los usuarios pueden tomar el control de la pantalla en cualquier momento.

Continue Reading

Noticias

Esto es lo que debes saber: NBC 6 South Florida

Published

on

  • El zumbido alrededor de la startup de IA China Deepseek comenzó a recoger a Steam a principios de este mes, cuando la startup lanzó R1, su modelo de razonamiento que rivaliza con el O1 de Openai.
  • El lunes, Deepseek se hizo cargo del lugar codiciado de su rival Openai para la aplicación gratuita más descargada en los EE. UU. En la App Store de Apple, destronando a Chatgpt para el asistente de IA de Deepseek.
  • Global Tech Stocks se vendió, con el gigante de chip de IA Nvidia cayendo un 10%.

El lunes, la startup de inteligencia artificial china Deepseek se hizo cargo del lugar codiciado de su rival Openai como la aplicación gratuita más desactivada en los EE. UU. En la tienda de aplicaciones de Apple, destronando Chatgpt para el asistente de IA de Deepseek. Las acciones de Global Tech se vendieron y estaban en camino de acabar con miles de millones en el límite de mercado.

Los líderes tecnológicos, analistas, inversores y desarrolladores dicen que el bombo, y el consiguiente temor de quedarse atrás en el ciclo de bombo de IA en constante cambio, pueden estar justificados. Especialmente en la era de la carrera armamentista generativa de IA, donde los gigantes tecnológicos y las startups están corriendo para garantizar que no se queden atrás en un mercado previsto para superar los ingresos de $ 1 billón en una década.

¿Qué es Deepseek?

Deepseek fue fundada en 2023 por Liang Wenfeng, cofundador de High-Flyer, un fondo cuantitativo de cobertura centrado en la IA. Según los informes, la startup de IA surgió de la Unidad de Investigación de AI del fondo de cobertura en abril de 2023 para centrarse en modelos de idiomas grandes y alcanzar la inteligencia general artificial, o AGI, una rama de IA que iguala o supere el intelecto humano en una amplia gama de tareas, que se abren. Y sus rivales dicen que están persiguiendo rápidamente. Deepseek sigue siendo propiedad y financiado por High-Flyer, según analistas de Jefferies.

El zumbido alrededor de Deepseek comenzó a recoger a Steam a principios de este mes, cuando la startup lanzó R1, su modelo de razonamiento que rivaliza con el O1 de OpenAI. Es de código abierto, lo que significa que cualquier desarrollador de IA puede usarlo, y se ha disparado a la cima de las tiendas de aplicaciones y las tablas de clasificación de la industria, con los usuarios elogios de su rendimiento y capacidades de razonamiento.

Al igual que otros chatbots chinos, tiene sus limitaciones cuando se les pregunta sobre ciertos temas: cuando se le pregunta sobre algunas de las políticas del líder chino Xi Jinping, por ejemplo, Deepseek aleja al usuario de líneas similares de preguntas.

Otra parte clave de la discusión: R1 de Deepseek se construyó a pesar de las exportaciones de chips de EE. UU. A China tres veces en tres años. Las estimaciones difieren exactamente en la cantidad de R1 de Deepseek, o en cuántas GPU entró. Los analistas de Jefferies estimaron que una versión reciente tenía un “costo de capacitación de solo US $ 5,6 millones (suponiendo un costo de alquiler de US $ 2/h800 horas). Eso es menos del 10% del costo de la LLAMA de Meta”. Pero independientemente de los números específicos, los informes acuerdan que el modelo se desarrolló a una fracción del costo de los modelos rivales por OpenAI, Anthrope, Google y otros.

Como resultado, el sector de la IA está inundado de preguntas, incluido si es necesario el creciente número de rondas de financiación astronómica y las valoraciones de mil millones de dólares, y si una burbuja está a punto de estallar.

Las acciones de NVIDIA cayeron un 11%, con el fabricante de chips ASML más del 6%. El NASDAQ cayó por 2%, y cuatro gigantes tecnológicos: Meta, Microsoft, Apple y ASML están listos para informar las ganancias esta semana.

Los analistas de Raymond James detallaron algunas de las preguntas que afectan a la industria de la IA este mes, escribiendo: “¿Cuáles son las implicaciones de inversión? ¿Qué dice sobre los modelos de origen abierto versus patentado? ¿Está arrojando dinero a las GPU realmente una panacea? trabajando? ¿Cuáles son las implicaciones más amplias de [DeepSeek]? Bueno, podrían ser terribles o un no evento, pero tengan la seguridad de que la industria está llena de incredulidad y especulación “.

Los analistas de Bernstein escribieron en una nota el lunes que “según las muchas tomas (ocasionalmente histéricas) que vimos que vimos [over the weekend,] El rango de implicaciones en cualquier lugar desde ‘eso es realmente interesante’ hasta ‘Esta es la luz de muerte del complejo de infraestructura de IA tal como lo conocemos’ “.

Cómo están respondiendo las empresas estadounidenses

Algunos CEO de tecnología estadounidense están trepando por responder antes de que los clientes cambien a ofertas potencialmente más baratas de Deepseek, y Según los informes, Meta inicia cuatro “salas de guerra” relacionadas con Deepseek dentro de su departamento generativo de IA.

El CEO de Microsoft, Satya Nadella, escribió en X que el fenómeno de Deepseek era solo un ejemplo de la paradoja de Jevons, escribiendo, “A medida que AI se vuelve más eficiente y accesible, veremos su uso Skyroocket, convirtiéndolo en una mercancía, simplemente no podemos obtener suficiente de.” El CEO de Operai, Sam Altman, tuiteó una cita que atribuyó a Napoleón, escribiendo: “Una revolución no se puede hacer ni detener.

Yann Lecun, el jefe científico de AI de Meta, escribió en LinkedIn que el éxito de Deepseek es indicativo de cambiar las mareas en el sector de IA para favorecer la tecnología de código abierto.

Lecun escribió que Deepseek se ha beneficiado de algunas de la propia tecnología de Meta, es decir, sus modelos de llama, y ​​que la startup “se les ocurrió nuevas ideas y las construyó en la parte superior del trabajo de otras personas. Debido a que su trabajo es publicado y de código abierto, todos pueden Se beneficia de él.

Alexandr Wang, CEO de Scale AI, le dijo a CNBC la semana pasada que el último modelo de IA de Deepseek fue “devastador de la tierra” y que su lanzamiento de R1 es aún más poderoso.

“Lo que hemos encontrado es que Deepseek … es el mejor desempeño, o aproximadamente a la par con los mejores modelos estadounidenses”, dijo Wang, y agregó que la carrera de IA entre los Estados Unidos y China es una “guerra de IA”. La compañía de Wang proporciona datos de capacitación a jugadores clave de IA, incluidos OpenAI, Google y Meta.

A principios de esta semana, presidente Donald Trump anunció una empresa conjunta con OpenAI, Oracle y Softbank para invertir miles de millones de dólares en infraestructura de IA de EE. UU. El proyecto, Stargate, fue presentado en la Casa Blanca por Trump, el CEO de SoftBank, Masayoshi,, cofundador Larry Ellison, y el CEO de Operai, Sam Altman. Los socios de tecnología iniciales clave incluirán Microsoft, Nvidia y Oracle, así como el brazo de la compañía de semiconductores. Dijeron que invertirían $ 100 mil millones para comenzar y hasta $ 500 mil millones en los próximos cuatro años.

AI evolucionando

La noticia de la destreza de Deepseek también se produce en medio de la creciente exageración en torno a los agentes de IA, modelos que van más allá de los chatbots para completar tareas complejas de varios pasos para un usuario, que los gigantes tecnológicos y las startups están persiguiendo. Meta, Google, Amazon, Microsoft, Openai y Anthrope han expresado su objetivo de construir IA de agente.

Anthrope, la startup de IA respaldada por Amazon fundada por ex ejecutivos de investigación de Openai, aumentó su desarrollo de tecnología durante el año pasado, y en octubre, la startup dijo que sus agentes de IA pudieron usar computadoras como humanos para completar tareas complejas. La capacidad de uso de la computadora de Anthrope permite que su tecnología interprete lo que está en la pantalla de una computadora, seleccione botones, ingrese texto, navegue por los sitios web y ejecute tareas a través de cualquier software y navegación en Internet en tiempo real, dijo la startup.

La herramienta puede “usar computadoras básicamente de la misma manera que lo hacemos”, dijo Jared Kaplan, director científico de Anthrope, a CNBC en una entrevista en ese momento. Dijo que puede hacer tareas con “decenas o incluso cientos de pasos”.

Openai lanzó una herramienta similar la semana pasada, presentando una característica llamada operador que automatizará tareas como planificar vacaciones, completar formularios, hacer reservas de restaurantes y ordenar comestibles.

La startup respaldada por Microsoft lo describe como “un agente que puede ir a la web para realizar tareas para usted”, y agregó que está capacitado para interactuar con “los botones, los menús y los campos de texto que las personas usan a diario” en la web . También puede hacer preguntas de seguimiento para personalizar aún más las tareas que completa, como la información de inicio de sesión para otros sitios web. Los usuarios pueden tomar el control de la pantalla en cualquier momento.

Continue Reading

Trending