La mayor amenaza de OpenAI puede ser simplemente la IA abierta


Silicon Valley ha pasado gran parte de la semana pasada en alerta roja, digiriendo la llegada del Kimi K3 de Moonshot AIun modelo de IA chino que supuestamente puede superar algunos de los mejores sistemas construidos por empresas estadounidenses por una fracción del costo.

Su desempeño por sí solo habría sido suficiente para intensificar la rivalidad entre Estados Unidos y China. Pero el plan de Moonshot de liberar los pesos del modelo de forma gratuita (y su orientación clara a los usuarios de EE. UU. – ha alimentado una inquietud más profunda sobre si los modelos estadounidenses cerrados pueden seguir dominando a medida que ingresan al mercado alternativas abiertas cada vez más capaces.

Los modelos abiertos brindan a los desarrolladores un control mucho mayor que los sistemas propietarios, permitiéndoles inspeccionar cómo funciona la IA, ejecutar la IA localmente en su propia infraestructura, personalizar los sistemas y crear nuevos productos sin depender de un solo proveedor. También suelen ser mucho más baratos. Esto plantea una pregunta obvia: ¿por qué una empresa de IA gastaría grandes sumas de dinero en entrenar un modelo de IA y luego regalar algunas de las partes más valiosas?

Kimi K3, al igual que otros modelos de IA de peso abierto, no es completamente «abierto». En software, el “código abierto” tiene un lugar establecido. definición: El código fuente está disponible públicamente para su uso, modificación y redistribución libremente, solo se requiere que esto también se haga abiertamente. Los sistemas de IA son más complicados y muy pocos son verdaderamente abiertos en el sentido del software tradicional. En cambio, la mayoría de las empresas publican algo llamado pesos de modelo (los parámetros numéricos aprendidos durante el período de entrenamiento de una IA) mientras mantienen privados otros componentes cruciales, incluidos los datos de entrenamiento, el código, la arquitectura del modelo y los métodos de configuración. La mayoría también viene con licencias restrictivas que limitan su uso o redistribución.

En conjunto, esto significa que la IA de peso abierto no se puede recrear desde cero como lo hace el verdadero software de código abierto. Pero proporciona suficiente poder y flexibilidad para que una empresa pueda ganar dinero con él.

«Un juego de pesas gratuito no es un servicio de inteligencia artificial gratuito».

“Un juego de pesas gratuito no es un servicio gratuito de inteligencia artificial”, afirmó Chinmayi Sharma, profesor de la Facultad de Derecho de Fordham. «Una empresa puede regalar los pesos del modelo mientras gana dinero en otras partes de la pila». Hay amplias oportunidades para hacerlo. Ejecutar un modelo todavía requiere infraestructura informática, ingeniería, seguridad, mantenimiento y soporte, todo lo cual las empresas pueden cobrar a través de acceso alojado u otros acuerdos. Para algunas empresas, los beneficios pueden ser más amplios, como una mayor demanda de servicios de computación en la nube o chips informáticos avanzados.

La apertura también puede ser una estrategia poderosa para obtener una ventaja competitiva. Liberar los pesos de un modelo puede alentar a más empresas y desarrolladores a usarlo, lo que a su vez puede llevar a que se construya todo un ecosistema de herramientas e infraestructura a su alrededor. Con el tiempo, eso puede ayudar a que un modelo se convierta en un “estándar de facto”, dijo Sharma. Kyle Miller, analista de investigación senior del Centro de Seguridad y Tecnología Emergente de Georgetown, hizo una observación similar, citando la gran familia de Alibaba Modelos de IA de peso abierto Qwen en China como ejemplo de cuán profundamente arraigado puede llegar a ser un sistema abierto en una industria.

Esto crea un claro problema para los gigantes estadounidenses de la IA. Si una generación de herramientas y desarrolladores comienza a construir alrededor de modelos abiertos y capaces como Kimi K3, el centro de gravedad de la industria podría comenzar a alejarse de plataformas propietarias como Gemini, Claude y ChatGPT. Si bien queda por ver si los modelos de peso abierto de vanguardia son realmente más baratos de ejecutar en la práctica, históricamente han ofrecido una alternativa de menor costo a los sistemas propietarios. También ofrecen más libertad a los desarrolladores en un momento en que los laboratorios estadounidenses están apretando acceso e imponente barandillas más estrictas para sus últimos modelos. ya hay signos que algunas empresas estadounidenses están cambiando hacia modelos chinos más baratos.

No hay una única razón detrás del apoyo de China a la IA de peso abierto, pero parece ser una combinación de limitaciones prácticas y estrategia política. Un ecosistema abierto brinda a las empresas chinas una Manera de innovar cerca de la frontera. a pesar de un acceso más restringido a chips avanzados y potencia informática, al tiempo que encaja perfectamente en la estrategia industrial más amplia de Beijing de fomentar una adopción más amplia de modelos, herramientas e infraestructura chinos. El enfoque también es conveniente para expandir la influencia tecnológica de China en el extranjero, así como su influencia política. Por ejemplo, a principios de este mes, el presidente Xi Jinping desafiado abiertamente a Estados Unidos por el liderazgo de la IA en el escenario mundial, presentándose como un socio más igualitario dado el enfoque cerrado de Estados Unidos.

El aumento de modelos chinos de peso abierto y capaces también está aumentando la presión sobre los proveedores de modelos cerrados como OpenAI y Anthropic desde dentro de su propia industria. El prospecto El hecho de que Estados Unidos pudiera restringir el acceso a la IA de peso abierto a la luz de Kimi K3 provocó una rápida reacción en el sector tecnológico, apoyado por algunos de sus actores más importantes. Una coalición de 25 empresas de tecnología, incluidas IBM, Microsoft, Meta, Nvidia, Perplexity y Palantir, liberado una carta abierta instando a los responsables políticos a evitar «restricciones prematuras», argumentando que los modelos de IA de peso abierto son esenciales para garantizar el liderazgo estadounidense en IA y evitar que el poder y los beneficios de la tecnología se «concentren en unas pocas manos». La mayoría de esos gigantes anónimos, incluidos Google, OpenAI y Anthropic, estaban notoriamente ausentes de la lista original.

Eso presión intensificada nuevamente el lunes, cuando Nvidia, Microsoft, SpaceX y un grupo más amplio de importantes empresas tecnológicas pidieron un mayor apoyo de Estados Unidos a los modelos de peso abierto. La iniciativa fue una respuesta directa a las preocupaciones sobre la seguridad de los sistemas avanzados de IA después de un modelo fraudulento de OpenAI. escapó de la contención y atacó otra empresa durante las pruebas, que tuvo que confiar en un modelo chino de peso abierto para defenderse debido a las estrictas barreras de seguridad en los modelos fronterizos de Estados Unidos.

No está claro cuánto terreno están dispuestos a ceder los laboratorios de IA más grandes de Estados Unidos. Google y AbiertoAI Más tarde se unió a la advertencia contra las restricciones apresuradas a los modelos abiertos, aunque ninguno de los dos firmó la iniciativa centrada en el ciberespacio del lunes. Anthropic, en particular, no ha respaldado ninguno de los esfuerzos.

Miller dijo que es una “pregunta abierta” cómo se desarrollará todo esto a largo plazo. Las empresas estadounidenses podrían lanzar sus propios modelos de peso abierto más capaces, dijo, y señaló que la presión de las empresas chinas era en parte la razón por la que OpenAI liberado el GPT-OSS de peso abierto el año pasado. «Pero no creo que empresas como Anthropic vayan en esa dirección», afirmó. El peso abierto de Google Gema los modelos también son parcialmente visto como respuesta a la competencia china. Ninguno de los dos es tan capaz como el modelo insignia patentado de cualquiera de las dos compañías.

“La pregunta para las empresas estadounidenses puede ser cada vez más: ¿cuánta capacidad necesitamos liberar abiertamente para evitar que los modelos chinos se conviertan en la plataforma predeterminada para el ecosistema abierto?” Dijo Sharma. Un resultado más plausible podría ser una “estrategia de cartera”, dijo, en la que las empresas mantengan “su mejor modelo en propiedad y al mismo tiempo lancen modelos abiertos cada vez más capaces para mantener la adopción de los desarrolladores y la influencia del ecosistema”.

Tomará algún tiempo ver si Kimi K3 gana a los desarrolladores estadounidenses o no. Pero dado que Beijing defiende cada vez más la IA de peso abierto, es casi seguro que no será el último modelo que intentará conquistar a Estados Unidos. La pregunta que enfrentan las empresas de IA más grandes del país ya no es sólo cómo puede Estados Unidos mantenerse por delante de Chinapero si la IA cerrada puede (o debería) hacerlo.

Seguir temas y autores de esta historia para ver más como esto en el feed personalizado de su página de inicio y recibir actualizaciones por correo electrónico.




Fuente: The Verge

Compartir:

Deja una respuesta

Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *

Esta web utiliza cookies propias y de terceros para su funcionamiento, análisis, programas de afiliación y para mostrar publicidad personalizada basada en tu perfil y hábitos de navegación. Además, incluye enlaces a sitios externos con sus propias políticas de privacidad, las cuales podrás gestionar al visitarlos. Al hacer clic en Aceptar, consientes el uso de estas tecnologías y el tratamiento de tus datos para estos fines.   
Privacidad