Tecnología

El Tesoro amenaza con sanciones tras la acusación de la Casa Blanca de que Moonshot destiló el Fable de Anthropic

TechCrunchhace 1 h
Una sala de servidores que representa infraestructura informática de IA a gran escala
Una sala de servidores que representa infraestructura informática de IA a gran escalaPhoto: panumas nikhomkhai / Pexels

Una disputa entre Washington y un laboratorio chino de inteligencia artificial se intensificó esta semana después de que el Departamento del Tesoro de EE. UU. amenazara con sanciones por acusaciones de que la empresa china Moonshot destiló el modelo Fable de Anthropic sin autorización. La Casa Blanca ha respaldado públicamente la acusación, y el episodio ha intensificado un debate ya tenso en Washington sobre cómo debería responder el gobierno estadounidense a la creciente capacidad de los modelos de IA chinos de peso abierto.

La destilación de modelos es una técnica bien establecida en el desarrollo de IA en la que un modelo más pequeño y económico se entrena para imitar el comportamiento de uno más grande y capaz, a menudo aprendiendo de las salidas de este último. La técnica en sí no es intrínsecamente indebida y se usa de forma rutinaria en toda la industria de la IA, incluso por laboratorios que entrenan sus propios modelos pequeños a partir de sus propios modelos grandes. La disputa en este caso se centra en la acusación de la Casa Blanca de que Moonshot usó salidas del modelo Fable de Anthropic, un sistema propietario, sin autorización para entrenar o mejorar sus propios modelos.

Anthropic no ha detallado públicamente las pruebas específicas detrás de la acusación, y Moonshot no ha emitido una respuesta pública abordada directamente en la información de TechCrunch. Las acusaciones de destilación de este tipo son notoriamente difíciles de probar de forma concluyente desde fuera, ya que un modelo entrenado en parte con las salidas de otro modelo puede mostrar similitudes de comportamiento sin dejar una huella técnica clara que se asemeje a las pruebas típicas de copia, a diferencia del código fuente copiado o los datos de entrenamiento duplicados.

La amenaza de sanciones del Departamento del Tesoro representa una escalada más allá del tipo de disputa que normalmente se manejaría a través de canales legales corporativos o compromiso diplomático. Las sanciones son una herramienta que el gobierno estadounidense ha aplicado cada vez más a empresas tecnológicas chinas en los últimos años, sobre todo en torno a las exportaciones de semiconductores y, más recientemente, en torno al desarrollo de modelos de IA, lo que refleja la postura de Washington de que la capacidad avanzada de IA tiene implicaciones directas para la seguridad nacional.

El episodio llega en medio de un debate más amplio y continuo en Washington sobre el rápido ascenso de los modelos de IA chinos de peso abierto, sistemas cuyos parámetros subyacentes se publican abiertamente y pueden ser descargados, modificados y desplegados por desarrolladores en cualquier parte del mundo. Laboratorios chinos, incluido Moonshot, han lanzado una serie de modelos de peso abierto en los últimos dos años que han obtenido sólidos resultados en pruebas comparativas y una rápida adopción entre desarrolladores, alterando las suposiciones en Washington sobre qué país lleva la delantera en el desarrollo de la IA de vanguardia.

Algunos responsables de política estadounidenses ven la proliferación de capaces modelos chinos de peso abierto como una preocupación estratégica, argumentando que la adopción global generalizada de sistemas de IA fabricados en China podría extender la influencia tecnológica de Pekín incluso en países sin relación comercial directa con China, ya que un modelo de peso abierto puede descargarse una vez y ejecutarse en cualquier lugar. Otros en el debate de política sostienen que los modelos de peso abierto, sin importar su país de origen, en general benefician el desarrollo global de la IA al hacer que los sistemas capaces sean más ampliamente accesibles y auditables.

La acusación de destilación añade una nueva dimensión a ese debate: en lugar de preocupación por que los laboratorios chinos construyan modelos independientemente competitivos, plantea la cuestión de si los laboratorios chinos podrían estar usando las salidas de las principales empresas de IA estadounidenses como datos de entrenamiento, una práctica que, de confirmarse, complicaría el argumento de que los modelos chinos de peso abierto representan un logro técnico puramente independiente.

Para Anthropic, el episodio coloca a la empresa en el centro de una disputa con importantes implicaciones de política, poniendo a prueba los mecanismos realmente disponibles para que las empresas de IA estadounidenses respondan a acusaciones de uso no autorizado de las salidas de sus modelos por parte de competidores extranjeros, un escenario que los marcos legales aún no han abordado plenamente aunque se ha convertido en una preocupación cada vez más común en la industria.

Que la amenaza de sanciones se traduzca en una acción concreta del Tesoro probablemente dependerá de una investigación más profunda, y del cálculo diplomático y comercial más amplio entre Washington y Pekín en un momento en que la política de IA se ha entrelazado estrechamente con la relación comercial y tecnológica más amplia entre EE. UU. y China. Por ahora, el caso se erige como uno de los ejemplos más directos hasta la fecha de una disputa de destilación que alcanza el nivel de una amenaza formal de sanciones del gobierno estadounidense en lugar de seguir siendo un desacuerdo comercial privado.

Este artículo es un resumen editorial asistido por IA basado en TechCrunch. La imagen es una foto de archivo de panumas nikhomkhai en Pexels.

Para seguir leyendo

Equipo de examen oftalmológico en un entorno clínico
Más de Tecnología

El chip restaurador de la visión de Science Corporation obtiene la aprobación de la UE

Science Corporation, la startup biotecnológica fundada por el expresidente de Neuralink Max Hodak, ha obtenido la aprobación regulatoria europea para un implante retiniano diseñado para restaurar la visión parcial a personas que perdieron la vista por degeneración macular asociada a la edad. La aprobación marca un hito para una empresa que aún busca demostrar la viabilidad de un negocio basado en neurotecnología implantable.

TechCrunch
Ecuaciones matemáticas abstractas escritas en una pizarra
Tecnología

Qué es la Conjetura Jacobiana, y por qué una conversación de Tao con ChatGPT sobre ella se volvió viral

Una conversación compartida de ChatGPT en la que el matemático Terence Tao explora un posible contraejemplo a la Conjetura Jacobiana, de décadas de antigüedad, ha circulado ampliamente entre desarrolladores e investigadores. Esto es lo que realmente dice la conjetura, y por qué usar un chatbot de IA como caja de resonancia matemática se está volviendo más común entre los matemáticos en activo.

Hacker Newshace 1 h