Noticias

El modelo de razonamiento O3-Mini de OpenAI llega para contrarrestar el consumo profundo

Published

1 año ago

31 enero, 2025

Únase a nuestros boletines diarios y semanales para obtener las últimas actualizaciones y contenido exclusivo sobre la cobertura de IA líder de la industria. Obtenga más información

Operai ha lanzado un nuevo modelo de IA patentado a tiempo para contrarrestar el rápido ascenso del rival de código abierto Deepseek R1, pero ¿será suficiente para afectar el éxito de este último?

Hoy, después de varios días de rumores y una anticipación creciente entre los usuarios de IA en las redes sociales, Openal está debutando a O3-Mini, el segundo modelo en su nueva familia de “razonadores”, modelos que tardan un poco más en “pensar”, analizar su propios procesos y reflexionar sobre sus propias “cadenas de pensamiento” antes de responder a las consultas y entradas de los usuarios con nuevas salidas.

El resultado es un modelo que puede funcionar a nivel de un estudiante de doctorado o incluso titular de titulares para responder preguntas difíciles en matemáticas, ciencias, ingeniería y muchos otros campos.

El modelo O3-Mini ya está disponible en ChatGPT, incluido el nivel gratuito y la interfaz de programación de aplicaciones de OpenAI (API), y en realidad es menos costoso, más rápido y más desempeñada que el modelo de alta gama anterior, OpenAi’s O1 y su más rápido, su Hermano de recuento de parámetros inferiores, O1-Mini.

Si bien inevitablemente se comparará con Deepseek R1, y la fecha de lanzamiento se ve como una reacción, es importante recordar que O3 y O3-Mini se anunciaron bien antes del lanzamiento de enero de Deepseek R1, en diciembre de 2024, y que el CEO de Operai Sam Altman declaró anteriormente en X que, debido a los comentarios de desarrolladores e investigadores, llegaría a ChatGPT y la API de OpenAI al mismo tiempo.

A diferencia de Deepseek R1, O3-Mini no estará disponible como modelo de código abierto, lo que significa que el código no se puede tomar y descargar para el uso fuera de línea, ni personalizado en la misma medida, lo que puede limitar su atractivo en comparación con Deepseek R1 para algunas aplicaciones.

Operai no proporcionó más detalles sobre el (presunto) modelo O3 más grande anunciado en diciembre junto con O3-Mini. En ese momento, el formulario desplegable de opción de OpenAI para probar O3 declaró que se sometería a un “retraso de varias semanas” antes de que los terceros pudieran probarlo.

Rendimiento y características

Similar a O1, Operai O3-Mini está optimizado para el razonamiento en matemáticas, codificación y ciencia.

Su rendimiento es comparable a OpenAI O1 cuando se usa un esfuerzo de razonamiento medio, pero ofrece las siguientes ventajas:

Tiempos de respuesta del 24% más rápidos en comparación con O1-Mini (OpenAi no proporcionó un número específico aquí, pero buscando pruebas de análisis artificial del grupo de evaluación de terceros, el tiempo de respuesta de O1-Mini es de 12.8 segundos para recibir y producir 100 tokens. Entonces, para O3-Mini, un aumento de velocidad del 24% reduciría el tiempo de respuesta a 10.32 segundos).
Precisión mejorada, con probadores externos que prefieren las respuestas de O3-Mini el 56% del tiempo.
39% menos errores importantes en preguntas complejas del mundo real.
Un mejor rendimiento en la codificación y las tareas STEM, particularmente cuando se usa un esfuerzo de razonamiento.
Tres niveles de esfuerzo de razonamiento (bajo, medio y alto), lo que permite a los usuarios y desarrolladores equilibrar la precisión y la velocidad.

También cuenta con impresionantes puntos de referencia, incluso superando a O1 en algunos casos, según la tarjeta del sistema O3-Mini OpenAi lanzado en línea (y que se publicó antes del anuncio oficial de disponibilidad del modelo).

La ventana de contexto de O3-Mini, el número de tokens combinados que puede ingresar/salir en una sola interacción, es de 200,000, con un máximo de 100,000 en cada salida. Eso es lo mismo que el modelo O1 completo y supera la ventana de contexto de Deepseek R1 de alrededor de 128,000/130,000 tokens. Pero está muy por debajo de la ventana de contexto de Google Gemini 2.0 Flash Thinking de hasta 1 millón de tokens.

Si bien O3-Mini se centra en las capacidades de razonamiento, todavía no tiene capacidades de visión. Los desarrolladores y usuarios que buscan cargar imágenes y archivos deben seguir usando O1 mientras tanto.

La competencia se calienta

La llegada de las marcas O3-Mini la primera vez OpenAI está haciendo que un modelo de razonamiento esté disponible para los usuarios gratuitos de ChatGPT. La familia de modelos O1 anteriores solo estaba disponible para pagar a los suscriptores de los planes ChatGPT Plus, Pro y otros planes, así como a través de la interfaz de programación de aplicaciones pagas de OpenAI.

Como lo hizo con los chatbots con el modelo de idioma grande (LLM) a través del lanzamiento de ChatGPT en noviembre de 2022, Operai esencialmente creó toda la categoría de modelos de razonamiento en septiembre de 2024 cuando presentó O1 por primera vez, una nueva clase de modelos con una nueva capacitación régimen y arquitectura.

Pero OpenAi, de acuerdo con su historia reciente, no hizo O1 Open Source, contrario a su nombre y misión de fundación original. En cambio, mantuvo el código del modelo propietario.

Y en las últimas dos semanas, O1 ha sido eclipsado por la startup china de IA Deepseek, que lanzó R1, un modelo de razonamiento de código abierto rival, altamente eficiente, en gran medida abierto, disponible gratuitamente para tomar, volver a entrenar y personalizar por cualquier persona en todo el mundo, así como Como uso de forma gratuita en el sitio web y la aplicación móvil de Deepseek, un modelo, según los informes, capacitado a una fracción del costo de O1 y otros LLM de los mejores laboratorios.

Los términos de licencia del MIT permisivos de Deepseek R1, la aplicación/sitio web gratuitos para los consumidores y la decisión de poner en código de código de R1 a disposición de la base y modificarlo a la vez que lo ha llevado a una verdadera explosión de uso tanto en los mercados de consumo como en las empresas, incluso el inversor de OpenAi Microsoft y el patrocinador antrópico Amazon se apresura a agregar variantes a sus mercados de nubes. La perplejidad, la compañía de búsqueda de IA, también agregó rápidamente una variante para los usuarios.

También destronó la aplicación ChatGPT iOS para el lugar número uno en la tienda de aplicaciones de Apple de EE. UU., Y es notable por superar a OpenAI conectando Deepseek R1 a la búsqueda web, algo que OpenAI aún no ha hecho para O1, lo que lleva a una mayor ansiedad techno entre tecnología. Los trabajadores y otros en línea que China se está poniendo al día o ha superado a los Estados Unidos en la innovación de IA, incluso la tecnología en general.

Sin embargo, muchos investigadores de IA y científicos y los principales VC como Marc Andreessen han acogido con beneplácito el aumento de Deepseek y su abastecimiento abierto en particular como una marea que levanta todos los barcos en el campo de la IA, aumentando la inteligencia disponible para todos al tiempo que reduce los costos.

Disponibilidad en chatgpt

El modelo ahora se está implementando a nivel mundial para usuarios gratuitos, además de Team, y Pro, con acceso a la empresa y la educación que llegará la próxima semana.

Los usuarios gratuitos pueden probar O3-Mini por primera vez seleccionando el botón “Razón” en la barra de chat o regenerando una respuesta.
Los límites de mensajes han aumentado 3 veces para los usuarios más y del equipo, de 50 a 150 mensajes por día.
Los usuarios profesionales obtienen acceso ilimitado tanto a O3-Mini como a una nueva variante, incluso de mayor condición, O3-Mini-High.

Además, O3-Mini ahora admite la integración de búsqueda dentro de ChatGPT, proporcionando respuestas con enlaces web relevantes. Esta característica todavía se encuentra en sus primeras etapas, ya que OpenAI refina las capacidades de búsqueda en sus modelos de razonamiento.

Integración y precios de API

Para los desarrolladores, O3-Mini está disponible a través de la API de finalización de chat, la API de asistentes y la API por lotes. El modelo admite llamadas de función, salidas estructuradas y mensajes de desarrollador, lo que facilita la integración en aplicaciones del mundo real.

Una de las ventajas más notables de O3-Mini es su eficiencia de costo: es un 63% más barato que OpenAI O1-Mini y 93% más barato que el modelo O1 completo, con un precio de $ 1.10/$ 4.40 por millón de tokens In/Out (con un descuento de 50% en caché ).

Sin embargo, todavía palidece en comparación con la asequibilidad de la oferta oficial de R1 de la API de DeepSeek a $ 0.14/$ 0.55 por millón de tokens. Pero Dado Deepseek se basa en China y viene con conciencia geopolítica y preocupaciones de seguridad sobre los datos del usuario/empresa que fluyen dentro y fuera del modelo, es probable que Operai siga siendo la API preferida para algunos clientes y empresas centradas en la seguridad en los Estados Unidos. y Europa.

Los desarrolladores también pueden ajustar el nivel de esfuerzo de razonamiento (bajo, medio, alto) en función de sus necesidades de aplicación, lo que permite un mayor control sobre las compensaciones de latencia y precisión.

Sobre seguridad, Operai dice que usó algo llamado “alineación deliberativa” con O3-Mini. Esto significa que se le pidió al modelo que razonara sobre las pautas de seguridad de autorización humana que se le dio, comprenden más de su intención y los daños que están diseñados para prevenir, y se les ocurre sus propias formas de garantizar que se eviten esos daños. Operai dice que permite que el modelo sea menos censurado cuando se discute temas delicados al tiempo que preserva la seguridad.

Operai dice que el modelo supera a GPT-4O en el manejo de los desafíos de seguridad y jailbreak, y que realizó una amplia prueba de seguridad externa antes de su lanzamiento hoy.

Un informe reciente cubierto en Cableado (Donde trabaja mi esposa) demostró que Deepseek sucumbió a cada aviso de jailbreak e intento de 50 probados por investigadores de seguridad, lo que puede darle a OpenAI O3-Mini la ventaja sobre Deepseek R1 en los casos en que la seguridad y la seguridad son primordiales.

Qué próximo?

El lanzamiento de O3-Mini representa el esfuerzo más amplio de Openai para hacer que el razonamiento avanzado AI sea más accesible y rentable frente a una competencia más intensa que nunca de R1 y otros de Deepseek, como Google, que recientemente lanzó una versión gratuita propia propia. Modelo de razonamiento rival Gemini 2 Flash Pensamiento con un contexto de entrada ampliado de hasta 1 millón de tokens.

Con su enfoque en el razonamiento y la asequibilidad STEM, OpenAI tiene como objetivo expandir el alcance de la resolución de problemas impulsada por la IA en aplicaciones de consumidores y desarrolladores.

Pero a medida que la compañía se vuelve más ambiciosa que nunca en sus objetivos, recientemente anunciando un proyecto de infraestructura de centros de datos de $ 500 mil millones llamado Stargate con el respaldo de SoftBank, la pregunta sigue siendo si su estrategia valdrá lo suficientemente bien como para justificar los multibonos hundidos en él. Inversores de bolsillo profundamente como Microsoft y otros VC.

A medida que los modelos de código abierto cierran cada vez más la brecha con OpenAi en el rendimiento y lo superan en el costo, según los informes, sus medidas de seguridad superiores, capacidades potentes, API fácil de usar e interfaces fáciles de usar ser suficientes para mantener a los clientes, especialmente en la empresa, en la empresa, ¿Quién puede priorizar el costo y la eficiencia sobre estos atributos? Informaremos sobre los desarrollos a medida que se desarrollen.

Insights diarias sobre casos de uso comercial con VB diariamente

Si quieres impresionar a tu jefe, VB Daily te tiene cubierto. Le damos la cuenta interior de lo que las empresas están haciendo con la IA generativa, desde cambios regulatorios hasta implementaciones prácticas, por lo que puede compartir ideas para el ROI máximo.

Lea nuestra Política de privacidad

Gracias por suscribirse. Mira más boletines de VB aquí.

Ocurrió un error.

Noticias de Inteligencia Artificial

Noticias

El modelo de razonamiento O3-Mini de OpenAI llega para contrarrestar el consumo profundo

Rendimiento y características

La competencia se calienta

Disponibilidad en chatgpt

Integración y precios de API

Qué próximo?

Leave a Reply

Leave a Reply

Trending

Rendimiento y características

La competencia se calienta

Disponibilidad en chatgpt

Integración y precios de API

Qué próximo?

Leave a Reply Cancelar respuesta

Leave a Reply

Trending

Leave a Reply