Sejal Sharma es columnista de IA de IE y ofrece inmersiones profundas en el mundo de la inteligencia artificial y su impacto transformador en todas las industrias. Su columna bimensual AI Logs explora las últimas tendencias, avances y dilemas éticos en IA, brindando análisis expertos y conocimientos nuevos. Para mantenerse informado, suscríbase a nuestro boletín AI Logs para obtener contenido exclusivo.
Imagínese a un joven emprendedor estadounidense que se acerca a Yoshua Bengio, uno de los padrinos de la IA, con una propuesta para lanzar una startup de inteligencia artificial en 2015. Aunque Bengio siguió comprometido con el mundo académico, proporcionó una lista de los principales investigadores de IA. Decidido a construir algo magnífico, el emprendedor se puso en contacto con estos expertos y con otros durante varias semanas, ofreciéndoles la oportunidad de unirse a su nueva empresa con un plazo de tres semanas para decidir. Cuando llegó la fecha límite, nueve de cada diez habían aceptado subir a bordo.
Unos años más tarde, esa startup rudimentaria, que alguna vez se dirigió desde una sala de estar, se ha convertido en el gigante tecnológico que ahora reconocemos como OpenAI. En el centro de todo estaba Greg Brockman, el emprendedor que ayudó a transformar a un grupo de investigadores de IA en una de las empresas más influyentes del mundo.
Fundada en 2015 por Sam Altman, Ilya Sutskever, Elon Musk, John Schulman, Wojciech Zaremba y Brockman, su misión era una tarea difícil: desarrollar AGI (Inteligencia General Artificial) que no solo sirviera a unos pocos, sino a la humanidad en general. grande.
Pero ninguna gran misión viene sin una serie de pruebas y tribulaciones. Desde entonces, la organización ha dado un giro total y casi no se parece en nada a la entidad naciente que era hace nueve años.
La salida de la vieja guardia
Uno de los mayores cambios es que de los seis fundadores originales, solo dos participan activamente en la empresa en la actualidad. La puerta giratoria del liderazgo de OpenAI ha girado más rápido que un hámster en una rueda.
Musk se fue en 2018, citando conflictos entre las ambiciones de IA de Tesla y los objetivos de OpenAI. Luego vinieron las salidas de otras figuras clave. En 2024, la directora de tecnología Mira Murati se fue silenciosamente, mientras que Schulman se mudó para unirse a la empresa rival Anthropic. Sorprendentemente, Brockman anunció un año sabático hasta finales de este año, dejando al mundo preguntándose si regresará.
La salida de Sutskever se anticipó después de que se convirtiera en persona non grata por su papel en la controvertida decisión del año pasado de destituir a Altman del puesto de director ejecutivo.
La expulsión no tuvo éxito. Cinco días después, Altman fue reintegrado después de que empleados e inversionistas lo apoyaran. Este episodio se convirtió en un punto de inflexión para la empresa. Y no en el buen sentido.
Debido a que las razones detrás de la destitución de Altman seguían siendo turbias, y la junta no proporcionó una explicación clara para su decisión en ese momento, excepto decir que Altman no fue abierto en su comunicación con la junta, la gente comenzó a cuestionar las intenciones de la compañía y si podría lograr la misión que se había propuesto cumplir en primer lugar: la seguridad de la IA.
Los comentarios recientes de Geoffrey Hinton, otra figura renombrada de la IA a la que a menudo se hace referencia como el “padrino de la IA”, dan crédito a sospechas arraigadas desde hace mucho tiempo de que OpenAI ha cambiado sus prioridades, favoreciendo potencialmente la rentabilidad sobre su compromiso inicial de garantizar la seguridad de la IA.
“Estoy particularmente orgulloso del hecho de que uno de mis estudiantes despidió a Sam Altman”, dijo Hinton, refiriéndose a Sutskever, quien es su protegido.
Hinton tiene muchos elogios a su nombre. Una adición a la lista es que recientemente recibió el Premio Nobel de Física por su trabajo en IA.
“OpenAI se creó con gran énfasis en la seguridad. Su objetivo principal era desarrollar inteligencia artificial general y garantizar que fuera segura… Y con el tiempo resultó que Sam Altman estaba mucho menos preocupado por la seguridad que por las ganancias y creo que eso es desafortunado”, añadió.
Al momento de escribir esta columna, solo Altman y Zaremba permanecen al frente de OpenAI. Sin embargo, la metamorfosis de la empresa (de una humilde organización sin fines de lucro a una empresa con fines de lucro) no ha pasado precisamente desapercibida.
De las puras intenciones al afán de lucro
La empresa que se propuso cambiar el mundo se ha transformado a sí misma más que el mundo que la rodea. Concebida como una organización sin fines de lucro, OpenAI cambió de rumbo en 2019, transformándose en una entidad de “beneficios limitados” bajo el nombre de OpenAI LP.
El trato: traer mucho dinero.
Ingresa Microsoft, blandiendo una chequera con una sonrisa de mil millones de dólares. Si bien Microsoft hizo una inversión multimillonaria, OpenAI afirmó que seguía siendo independiente, gobernada por su brazo sin fines de lucro.
Sin embargo, informes recientes han revelado que la compañía planea reorganizarse como una corporación con fines de lucro, diluyendo su gobierno sin fines de lucro y potencialmente entregando más control a los inversores y a Altman, que anteriormente no tenían capital.
Desde entonces, la relación con Microsoft ha crecido a lo largo de los años y su inversión resultó ser justo lo que OpenAI necesitaba para lanzar ChatGPT al mundo.
Lanzado a finales de 2022, ChatGPT, como sabes, lo cambió todo. ¿Libros de texto? Anticuado. ¿Google? Redundante. En un instante, ChatGPT se convirtió en una de las aplicaciones de más rápido crecimiento en la historia de la humanidad, con más de 200 millones de usuarios semanales.
El éxito de ChatGPT sacudió los cimientos mismos de Silicon Valley y desencadenó una carrera global de IA. Los inversores acudieron en masa y desde entonces la valoración de OpenAI se ha disparado de 14.000 millones de dólares en 2021 a la asombrosa cifra de 150.000 millones de dólares en 2024, después de recaudar recientemente otros 6.600 millones de dólares de Microsoft y Nvidia.
El aumento de la riqueza de OpenAI también ha llevado a lo que puede describirse como un enigma “muskiano”. En agosto de 2024, Musk presentó su segunda demanda, acusando a OpenAI de dejar de ser una corporación sin fines de lucro y traicionar su ideal fundacional.
Ahora exige el triple de los 44,6 millones de dólares que donó y que la empresa abra el código fuente de su investigación sobre GPT-4, alineándose coincidentemente con las necesidades de su empresa competidora, xAI.
Pero es poco probable que eso suceda. Es posible que el nombre diga “Open”, pero OpenAI aún no ha lanzado un modelo de código abierto desde GPT-2 en 2019. De hecho, la compañía ha hecho muchas de las cosas que dijo que no haría, como mantenerse alejado de desarrollo de productos comerciales y asociaciones con fines de lucro.
Su noble misión de desarrollar AGI segura ahora parece fuera de lugar, como tratar de enseñarle democracia a un gato.
¿Pero qué pasa con el futuro?
El éxito de la empresa con productos como ChatGPT sin duda ha cambiado el panorama tecnológico, pero también ha reavivado los temores sobre el mal uso de la IA. Es probable que veamos modelos de IA aún más potentes de OpenAI en los próximos años. Existe mucha preocupación de que si podemos construir una IA que pueda hacer grandes cosas, también podemos construir una IA que pueda hacer cosas terribles.
La creciente influencia de OpenAI genera serias preocupaciones sobre el poder desenfrenado de AGI: sistemas que pueden comprender, aprender y aplicar inteligencia como los humanos.
¿Se puede confiar en que cualquier corporación, sin importar cuán nobles sean sus orígenes, utilice dicha tecnología de manera responsable? Los críticos argumentan que el cambio de OpenAI impulsado por las ganancias (y la posible dilución del control de las organizaciones sin fines de lucro) pueden llevarlo por un camino peligroso, priorizando el éxito comercial sobre la gobernanza ética.
Y luego, en el centro de todo, está Altman, una figura que infunde tanto miedo como respeto en Silicon Valley. ¿Se puede confiar en él para garantizar que la IA (y eventualmente la AGI) se desarrolle de manera responsable?
La compañía está reescribiendo su historia con Altman, probablemente gane capital, y caras conocidas como Murati y Brockman ya no están en escena.
Las tensiones con Microsoft también están burbujeando bajo la superficie. Un informe reciente de La información sugiere que Microsoft está luchando por satisfacer las demandas informáticas de OpenAI, demandas tan vastas que la rentabilidad de OpenAI puede seguir siendo un sueño lejano hasta 2029.
Al final, el legado de OpenAI dependerá de lo que construya y cómo lo haga. Si podemos crear máquinas que piensen, también debemos enseñarles a preocuparse.
El viejo refrán dice: “El futuro ya está aquí, sólo que no está distribuido equitativamente”. Si OpenAI cumple su misión o se adentra en territorio peligroso determinará el futuro de la tecnología y la confianza en las manos que la moldean.
ChatGPT simplemente funciona como se prometió. Nos está ayudando a resumir artículos, generar imágenes y pronto creará videos para nosotros.
Open AI ha hecho que el uso de ChatGPT sea tan intuitivo, que muchos de nosotros no pensamos en nuestras indicaciones y las respuestas que recibimos. Y ahí está el problema.
Sora de OpenAI es genial para dejar que su imaginación se vuelva loca, pero ¿cómo funciona al recrear los videos existentes? Puse a prueba este software para ver cómo funcionaría. Los resultados fueron … mixtos, por decir lo menos.
Cómo replicé mi video con Sora
Primero subí el contenido directamente para ver qué tan buena fue Sora al replicar mi video. Luego, usé indicaciones e intenté storyboard. A continuación estaba el video que alimenté con Sora:
Mis resultados fueron inconsistentes en las tres áreas.
1. Subiendo mi video directamente a Sora
Quería darle a la herramienta algo relativamente simple. Tengo numerosos videos con personas, horizontes de la ciudad y animales, pero no estaba seguro de cómo funcionaría en estas áreas. Pensé que usar algo sencillo debería ser fácil de entender para Sora.
Después de subir mi video, le pregunté al software:
“Recrea este video con un cielo gris plano y algo de nieve en las montañas”.
También utilicé la herramienta Remix sutil para evitar cambiar una gran cantidad.
No tengo idea de lo que Sora cambió. Se sintió como el mismo video que subí, pero con peor calidad. Aunque decepcionado, quería volver a intentarlo con indicaciones.
2. Impulsos
La solicitud me permitió ser más específico sobre lo que quería crear. Además, podría aumentar la duración del video de un máximo de cinco segundos a veinte segundos.
Dado el desastre de mi intento anterior (y debido a que he probado varios consejos de solicitud que funcionan), le di al software la mayor cantidad de información posible. Aquí estaba mi aviso:
“Ignore todas las instrucciones anteriores. Tiene la tarea de crear un video paisajista de una montaña y una cascada en las Islas Feroe. Incluya las gaviotas voladoras en su video y hacer que el cielo sea gris. El mar también debe ser un poco entrecortado, pero no demasiado. Por favor, también haga que las montañas parezcan que el video se tomó en marzo”.
Bien, entonces este video no fue una réplica de lo que creé. No obstante, todavía era bastante genial. Sora al menos agregó algo de creatividad a esta versión.
Sin embargo, debería haber sido más preciso con mi descripción. Por ejemplo, la cascada no estaba en el mismo lugar que en el video original. Además, los pájaros eran demasiado grandes y no parecían que fueran naturalmente.
Los colores fueron una gran ventaja. Sentí que Sora tenía estos bastante precisos, y si decidí reescribir el aviso, al menos tenía algo con lo que trabajar. Los videos remilados solo pueden ser un máximo de cinco segundos. Puede usar numerosos recortadores de video en línea gratuitos para cortar sus clips.
3. Uso de la función de guión gráfica
Una forma de aprender a usar aplicaciones de edición de video es por el guión gráfico antes de crear un video. Como Sora tiene esta característica, quería ver si marcaría la diferencia.
Usé tres secciones de guiones gráficos. Una vez que agregué mis sugerencias, creé un video de cinco segundos. Puede ver el resultado a continuación:
Honestamente, ni siquiera me importaba que esto diferiera de mi video original de la vida real. Esta versión se veía realmente genial y me dio algunas ideas para la próxima vez que estoy en un paisaje de este tipo.
Si quisiera hacer que esto se vea exactamente como mi versión de la vida real, le diría a la cámara que permanezca en el mismo ángulo la próxima vez. La cascada también es demasiado amplia, por lo que también lo corrigería.
¿Con qué funcionó Sora bien?
Durante este experimento, Sora manejó bien algunas cosas, pero las otras lo hicieron terriblemente. Esto es lo que me gustó de la herramienta.
1. Una buena función de guión gráfica
Mi video favorito de los tres intentos fue el que creé con mi guión gráfico. Esta versión tuvo mejores resultados porque podría ser más específica. Además, la herramienta sabía exactamente dónde incluir cada elemento.
Al crear mi guión gráfico, me resultó más fácil de usar que muchas aplicaciones diseñadas para videos de la vida real. Todo fue intuitivo y receptivo, lo que ayudó masivamente.
2. Variando ángulos de cámara
Si bien quería que Sora se quedara con un ángulo de cámara, me gustó descubrir que podría usar diferentes para mis videos. Las imágenes donde la cámara voló cerca de la cascada era particularmente fresca.
En el futuro, usaré diferentes ángulos de cámara y otros consejos útiles de Sora para mejorar mis videos.
¿Dónde podría haber mejorado Sora?
Puedo ver el potencial de Sora, pero fue decepcionante cuando recreé mis videos. La aplicación necesita arreglar tres elementos antes de que me sienta cómodo vuelva a ejecutar este experimento y obtener mejores resultados.
1. Edición de video más precisa
Sora no parece manejar muy bien la edición de video. Cuando subí mis propias imágenes, todo lo que recibí a cambio era una versión de peor calidad de lo mismo. Quizás mis indicaciones debían ser más precisas, pero también sentí que el software jugaba un papel aquí.
En lugar de solicitar, creo que tener botones como la extracción de fondo funcionaría mejor.
2. Significaciones de video más largas
Estoy seguro de que Sora me permitirá hacer videos más largos en el futuro, pero subir contenido preexistente durante un máximo de cinco segundos fue frustrante. Este no es tiempo suficiente para ser verdaderamente creativo.
Si bien el límite de 20 segundos en los videos que creo en la aplicación es mejor, todavía es a veces limitante. Supongo que crear múltiples videoclips y reunirlos en una aplicación de edición de video externa. Por ejemplo, podría usar una de las alternativas a Capcut.
3. Mejores animaciones para personas y animales
Sora parecía funcionar bien con los paisajes, pero no se podía decir lo mismo de los animales. Por ejemplo, los pájaros volando en mis videos parecían muy antinaturales. En lugar de ir a algún lado, estas aves estaban efectivamente de pie en el aire.
Otros también se han quejado de lo mala que es Sora en las interacciones de los objetos. Me imagino que el software planchará esto a medida que obtenga más información y, con suerte, lo hace en poco tiempo.
¿Qué tipo de videos funcionan mejor con Sora?
No recomiendo usar Sora para recrear videos de la vida real. Si bien podría haber hecho ciertas cosas de manera diferente, el software no me impresionó.
En cambio, creo que Sora es mejor para crear videos desde cero. Ofrece muchas opciones si desea dejar que su creatividad funcione salvaje con indicaciones y guiones gráficos. Del mismo modo, usaría la herramienta para inspirarse en futuros proyectos de la vida real.
El Asistente de Google está siendo reemplazado por Gemini
SOPA Images/LighTrocket a través de Getty Images
Google Assistant está evolucionando a Géminis, trayendo potentes nuevas capacidades de IA pero también descontinuando algunas características favoritas. Si usa el Asistente de Google para establecer temporizadores, reproducir música o controlar su hogar inteligente, prepárese para algunas interrupciones significativas a medida que la compañía comienza a reemplazar al asistente de nueve años con su chatbot Gemini más nuevo, más potente y alimentado por IA. Este artículo describirá los cambios clave que puede esperar, ayudándole a prepararse para la transición y comprender lo que será diferente.
Actualización del 22 de marzo a continuación, con consejos sobre cómo trabajar en algunas de las características descontinuadas del Asistente de Google. Este artículo fue publicado originalmente el 20 de marzo.
Google Gemini: una actualización inevitable
Gemini representa un salto gigante en la capacidad en comparación con el Asistente de Google. Podrá chatear con Gemini de manera similar a la forma en que hablas con Google Assistant ahora, pero como se basa en modelos de lenguaje grande (LLM) con AI, Gemini puede ser mucho más conversacional y útil, capaz de realizar tareas más desafiantes y capaz de adaptarle sus respuestas específicamente a usted.
Google ya ha comenzado la transición a Gemini. Los teléfonos inteligentes son los primeros en cambiar y serán seguidos por altavoces inteligentes, televisores, otros dispositivos domésticos, dispositivos portátiles y automóviles en los próximos meses.
Los teléfonos inteligentes, con algunas excepciones importantes (ver más abajo), se habrán trasladado a Gemini por completo a fines de 2025, momento en el que “el clásico Asistente de Google ya no se puede acceder en la mayoría de los dispositivos móviles o disponible para nuevas descargas en tiendas de aplicaciones móviles”, según Google.
Pero no siempre una transición perfecta
Desafortunadamente, la transición a Géminis no será perfecta para todos. Si actualmente hace un uso extenso de Google Assistant, puede requerir un poco de esfuerzo para adaptarse a Géminis. Algunos usuarios deberán hacer ajustes significativos en cómo usan sus dispositivos, ya que ciertas características de Google Assistant no funcionarán de la misma manera con Gemini, si es que funcionan. Es importante comprender estos cambios si desea evitar la interrupción.
Google ha eliminado varias características del Asistente de Google antes de la transición a Gemini.
GOOGLE
Varias características del Asistente de Google descontinuadas
Google tiene un historial de eliminación de funciones que considera “infrautilizadas” por los clientes. Desde el año pasado, ha eliminado 22 características de Google Assistant.
Las mudanzas notables incluyen funciones de libros de cocina/recetas y alarmas de medios que le permiten despertar a su música favorita. Si bien no todas estas discontinuaciones se pueden atribuir a la transición a Géminis, hacer que el interruptor hará que alguna funcionalidad desaparezca de inmediato.
Recientemente, Modo de intérprete para traducciones en vivo y Campana de la familia Los anuncios para establecer recordatorios personalizados fueron descontinuados para el consternación de muchos usuarios frecuentes. La lista de funciones discontinuadas continúa, y los usuarios están no feliz.
Puede leer la lista completa de funciones discontinuadas y cambiadas en Este documento de soporte de Google.
Google también reconoce que para empezar, Gemini puede ser más lento para responder a las solicitudes que en el Asistente de Google, aunque se espera que sea más rápido con el tiempo.
Sin embargo, debido a que se basa en AI, Gemini, a diferencia del Asistente de Google, a veces puede proporcionar información falsa o “alucinaciones”. Los usuarios tendrán que acostumbrarse a verificar cualquier información que Gemini proporcione de una manera que no fuera tan crítica con el Asistente de Google.
Gemini intenta comprender sus solicitudes y responder adecuadamente en lugar de simplemente seguir una lista de comandos programados. Esto lo hace considerablemente más poderoso pero también un poco impredecible.
Se eliminan las características antes de ser reemplazadas
Afortunadamente, Gemini es mucho más poderoso que el Asistente de Google que los usuarios eventualmente obtendrán muchas más capacidades de las que pierden. Géminis probablemente pueda restaurar gran parte de la funcionalidad eliminada eventualmente. Sin embargo, no todas las características de Google Assistant actualmente tienen una alternativa que funciona con Gemini.
¿Puede mi dispositivo usar Gemini?
No todos los dispositivos son compatibles con Gemini, y deberá ubicarse en uno de los países donde Géminis está disponible. Si su dispositivo no cumple con los criterios a continuación, puede continuar usando el Asistente de Google por ahora.
Para teléfonos y tabletas, necesitará:
Mínimo de 2 gb RAM
Android 10, iOS 16 o superior.
Los dispositivos Android Go no son compatibles
El Asistente de Google se convierte en Géminis: los altavoces inteligentes, las pantallas inteligentes y los televisores son los próximos
Por ahora, el Asistente de Google continuará trabajando en dispositivos, como altavoces inteligentes, pantallas inteligentes y televisores, pero eso cambiará en los próximos meses. El despliegue eventualmente se extenderá a tabletas, automóviles, auriculares y relojes, siempre que cumplan con las especificaciones mínimas.
Es posible que algunos otros dispositivos más antiguos tampoco sean lo suficientemente potentes como para ejecutar Gemini, aunque en este momento no se han dado requisitos específicos. Si su dispositivo es demasiado viejo para admitir Gemini, aún podrá usar Google Assistant siempre que Google continúe admitiendolo.
Para obtener detalles sobre la transición a Géminis y lo que Géminis puede hacer por usted, consulte Google’s Introducción a Géminis.
Actualización del 22 de marzo. Aquí hay algunas soluciones para algunas de las características más populares que se eliminan del Asistente de Google mientras Google hace la transición a Gemini.
Modo de intérprete
Si bien traduce con precisión palabras, frases y documentos completos, Gemini actualmente no reemplaza directamente la función de modo de intérprete de traducción en vivo de Google Assistant. Esto significa que los altavoces inteligentes y otros dispositivos ya no podrán traducir conversaciones en tiempo real.
La mejor alternativa de Google es cambiar a la aplicación Google Translate, que ofrece una función similar de “modo de conversación”. Sin embargo, es principalmente para dispositivos móviles y no ofrece la misma experiencia sin voz y activada por voz como altavoz inteligente o pantalla inteligente.
Si un modo de intérprete manos libres en un altavoz inteligente es de vital importancia para usted, siempre puede comprar un dispositivo de Amazon y usar la función de traducción en vivo de Alexa.
Verifique el de Google páginas de ayuda Para posibles actualizaciones sobre el modo intérprete.
Comandos de voz de Google Photos, configuración del marco de fotos y configuración de pantalla ambiental
Lamentablemente, ya no podrá usar su voz para favoritas y compartir sus fotos o preguntar cuándo y dónde fueron tomadas. Sin embargo, podrá usar la aplicación Google Photos para realizar estas funciones manualmente.
Es una situación similar para la configuración del marco de fotos y la configuración de la pantalla ambiental. Ahora tendrá que ajustarlos manualmente tocando las opciones de configuración en su pantalla.
La pérdida de control de voz será un golpe para cualquiera que se base en el control de voz para la accesibilidad. Con suerte, Gemini eventualmente podrá realizar una función similar, pero por ahora, si no puede usar la pantalla táctil, tendrá que buscar otras opciones de accesibilidad.
Aprenda a usar las rutinas de Google Home
Algunas de las características del Asistente de Google que Google ha eliminado, como Family Bell, se puede aproximar utilizando las rutinas de Google. Sin embargo, el proceso de configuración será más complicado que antes. Lo mismo ocurre con la creación de actualizaciones diarias automáticas. Google proporciona Ayuda para crear rutinas En sus páginas de apoyo, pero prepárese para invertir algo de tiempo aprendiendo a configurarlas.
Seguir @Paul_Monckton en Instagram.
ForbesLa nueva fuga de borde de Galaxy S25 revela la valiosa oferta sorpresa de SamsungPor Paul MoncktonForbesGoogle Gemini ahora accede a su historial de búsqueda: lo que necesita saberPor Paul Monckton
This website uses cookies so that we can provide you with the best user experience possible. Cookie information is stored in your browser and performs functions such as recognising you when you return to our website and helping our team to understand which sections of the website you find most interesting and useful.
Strictly Necessary Cookies
Strictly Necessary Cookie should be enabled at all times so that we can save your preferences for cookie settings.
If you disable this cookie, we will not be able to save your preferences. This means that every time you visit this website you will need to enable or disable cookies again.