Resumen
- Anthropic suaviza su compromiso de seguridad.
- La estricta congelación previa del desarrollo por parte de la compañía ha sido reemplazada por una promesa de mayor transparencia.
- Esta medida podría reducir los estándares de seguridad en la industria.
Anthropic, el creador del agente de IA Claude (uno de Nuestras herramientas de productividad favoritasUna de sus características principales es su compromiso inquebrantable con la seguridad. entrada en el blogLa compañía ha delineado su Política de Expansión Responsable (RSP) y los cambios incluidos en la versión 3.0.
![]()
Enlaces rápidos
¿Cuál era la antigua política de seguridad de Anthropic?
La empresa ha establecido un estándar industrial en garantías de seguridad.
Para comprender los cambios que Anthropic está implementando, es necesario comprender su Política de Escalado Responsable (RSP) original. En 2023, Anthropic se comprometió a dejar de entrenar modelos de IA si sus capacidades excedían la capacidad de la empresa para demostrar su seguridad. Las señales de alerta que podrían desencadenar esta interrupción incluyen las siguientes:
- Modelos que podrían ayudar en la creación o despliegue de armas químicas, biológicas o nucleares.
- Modelos que pueden mejorarse excesivamente.
- Modelos que pueden ayudar en los ciberataques.
- Modelos que pueden comportarse de determinadas maneras sin intervención humana, como “escapar” de sus entornos para evitar ser apagados.
La Política de Expansión Responsable (PRE) impuso un límite estricto a estos modelos: Anthropic detendría su desarrollo incluso si esto implicaba ser superada por la competencia. Fue una postura audaz en una industria donde todos parecían correr a una velocidad vertiginosa.
Nueva Política de Expansión Responsable (RSP) de Anthropic
La versión 3.0 relaja significativamente las reglas.
Anthropic mantiene una política de expansión responsable, pero con la versión 3.0, la compañía solo detendrá el desarrollo si considera que ya tiene una ventaja significativa sobre la competencia. La promesa vinculante de detenerse ha sido sustituida por una promesa de transparencia sobre si la compañía está cumpliendo sus objetivos de seguridad e igualando o superando la seguridad de la competencia. En otras palabras, básicamente ha asumido un compromiso de seguridad.
¿Qué motivó estos cambios? Anthropic afirma que su Compromiso de Seguridad (RSP) original no logró el impacto deseado. El RSP pretendía ser un ejemplo de seguridad para otras empresas. Desafortunadamente, la competencia no prestó atención a esta señal. La empresa considera que, al limitar sus propios esfuerzos, está permitiendo que competidores menos conscientes de la seguridad dominen el mercado y dicten el ritmo del desarrollo.
¿Qué significa esto para la industria?
Un gran paso atrás
Desafortunadamente, estos cambios podrían sentar un mal precedente en el campo de la inteligencia artificial. Anthropic era el estándar de oro en prácticas de seguridad, y con estos cambios, el listón se ha reducido considerablemente. Esto podría enviar un mensaje a los competidores de que la seguridad es secundaria a la innovación. Si bien esto podría ayudar a Claude a... Poniéndonos al día con ChatGPTSin embargo, todavía parece un paso en la dirección equivocada.
En definitiva, si queremos disipar los temores de los pesimistas sobre la IA, no bastará con una promesa de seguridad de una sola empresa: toda la industria debe unirse y marcar una línea. A estas alturas, parece cada vez más improbable que esto suceda.







