Claude Anthropic gestiona el 26 % de las actividades de I+D

¡No te pierdas las noticias!
Añade a Teknoblog como fuente preferida en la búsqueda de Google y nos verás más a menudo en las «Noticias más leídas».

Anthropic ha compartido datos reveladores sobre el grado de utilización de Claude en las actividades de investigación y desarrollo de inteligencia artificial de la empresa. Según una nueva entrada de blog publicada por la empresa, Claude es capaz de llevar a cabo en gran medida de principio a fin el 26 % de las actividades de I+D en inteligencia artificial de Anthropic, partiendo de un comando de alto nivel, mientras que los empleados humanos supervisan este proceso. Anthropic define este modelo de trabajo como «AI-led», es decir, dirigido por la inteligencia artificial. Según la información facilitada por la empresa, el papel de Claude no se limita únicamente a este 26 %. Los sistemas de inteligencia artificial llevan a cabo, al menos en gran parte, más del 90 % de las actividades de investigación de Anthropic bajo una estrecha supervisión humana.

Estas cifras muestran que Claude participa de alguna forma en la mayor parte de las tareas de investigación que realizan los empleados de la empresa. No obstante, Anthropic subraya que, en ninguna parte de las actividades de I+D en inteligencia artificial evaluadas, Claude opera de forma totalmente autónoma. En otras palabras, aunque el sistema pueda completar algunas tareas de principio a fin en gran medida por sí mismo, la supervisión humana no se ha eliminado del proceso. Incluso en el porcentaje del 26 % de «liderazgo» definido por la empresa, el control final recae en los trabajadores humanos. Esta distinción pone de manifiesto que, a la hora de medir la eficacia de las herramientas de inteligencia artificial en los procesos de investigación, no basta con fijarse únicamente en los índices de finalización de tareas.

Anthropic propone tres métodos para medir el desarrollo de la inteligencia artificial

Anthropic ha recopilado dichos datos en el marco del primero de tres métodos de medición cuyo objetivo es hacer que el ritmo de desarrollo de la inteligencia artificial resulte más comprensible y comparable. En este enfoque, denominado «AI-led AI R&D», se mide qué porcentaje de las actividades de investigación y desarrollo en inteligencia artificial lleva a cabo Claude. Para ello, la empresa ha combinado sus propios datos de uso con la escala de clasificación de automatización elaborada por Epoch AI. Gracias a este método, se ha elaborado un gráfico que muestra los niveles de automatización alcanzados por Claude desde agosto de 2025. Según Anthropic, otros desarrolladores de modelos avanzados de inteligencia artificial que utilicen sus propios datos también podrían aplicar una medición similar, y los resultados podrían ser verificados por terceros independientes.

PUEDE INTERESARTE

El segundo ámbito de medición propuesto por la empresa se centra en el grado de supervisión de los agentes de inteligencia artificial. En este sentido, se recomienda hacer un seguimiento de datos como qué porcentaje de las actividades de los agentes es supervisado por personas, en qué plazo se controlan las operaciones realizadas y con qué frecuencia se señalan como problemáticos los comportamientos del sistema. Anthropic considera que este tipo de indicadores pueden proporcionar información más concreta sobre el modo real de funcionamiento de los agentes de inteligencia artificial, que cada vez pueden actuar con mayor independencia. Además, defiende que, en lugar de limitarse a medir si un agente ha completado o no una tarea concreta, también debe registrarse en qué medida dicha tarea se ha llevado a cabo bajo supervisión. De este modo, se pretende crear un marco de seguridad y supervisión que permita realizar comparaciones más directas entre empresas.

La tercera métrica consiste en realizar un seguimiento de la capacidad computacional destinada a las actividades de investigación y desarrollo en inteligencia artificial. Anthropic señala que la divulgación de la cantidad de potencia computacional que las empresas asignan a sus actividades de I+D podría utilizarse para comprender a qué ritmo se desarrollan los modelos avanzados. Si estos datos se evalúan junto con las mediciones del nivel de automatización y el control humano, podría surgir una visión más amplia del ritmo de desarrollo del sector. La empresa considera que una mayor transparencia podría ayudar tanto a que la opinión pública siga mejor los procesos de desarrollo de la inteligencia artificial como a intervenir antes ante avances que pudieran salirse de control.

El Game Garaj Slayer R9T, con pantalla de 300 Hz, cuesta 10 049,90 TL en la cesta

Comprar

La barra de sonido LG S40T con 300 W de potencia, por 7.318,80 TL en la cesta

Comprar

Next Stick 4K con Google TV, con un descuento de 464,55 TL en la cesta

Comprar

Auriculares supraaurales QCY H3 con ANC de 43 dB por 1.398 TL en la cesta

Comprar

Auriculares Havit TW984 con ANC, a 636,65 TL con un 15 % de descuento en la cesta

Comprar

Ver todo Filtrar

Ver todas las ofertas

PUBLICIDAD — Este contenido incluye enlaces de afiliados. Teknoblog puede obtener una comisión por las compras realizadas a través de estos enlaces.

El director ejecutivo de Anthropic, Dario Amodei, también defiende que, en los últimos tiempos, es necesario adoptar medidas más estrictas en materia de seguridad de la inteligencia artificial y supervisión de los modelos avanzados. Según el texto original, OpenAI ya se ha mostrado a favor de la idea de que el desarrollo de la inteligencia artificial pueda ralentizarse cuando sea necesario. Por su parte, Anthropic se compromete a permitir que sus aplicaciones en desarrollo sean examinadas por evaluadores externos. No obstante, sigue sin estar claro cómo se configurarán los mecanismos de control vinculantes que se aplicarán en todo el sector. El texto original señala que el presidente de EE. UU., Donald Trump, evalúa los riesgos de la inteligencia artificial dentro de un marco más limitado; por ello, aún no existe un panorama claro sobre hasta qué punto el enfoque regulador irá más allá de los propios controles internos de las empresas.

La cifra del 26 % revelada por Anthropic es uno de los ejemplos concretos que muestran que los sistemas actuales de inteligencia artificial están empezando a dejar de ser meras herramientas auxiliares que se limitan a escribir código o a realizar tareas de investigación aisladas. No obstante, los propios datos de la empresa revelan que Claude no funciona como un investigador totalmente independiente, sino que la orientación y la supervisión humanas siguen siendo determinantes. Por ello, no es correcto interpretar directamente las cifras publicadas como que «una cuarta parte de las tareas se deja totalmente en manos de la inteligencia artificial». Una valoración más acertada sería que Claude es capaz de completar cada vez más tareas a partir de instrucciones de alto nivel, mientras que, por el contrario, la supervisión humana sigue siendo uno de los elementos fundamentales del proceso. En cuanto a si los estándares de medición propuestos por Anthropic se adoptarán en todo el sector, esto dependerá de hasta qué punto las empresas de inteligencia artificial estén dispuestas a compartir datos detallados.

Teknoblog ya está en WhatsAppRecibe en tu móvil las mejores ofertas tecnológicas del día y las noticias más importantes que no te puedes perder.

Únete al canal

We use cookies in order to give you the best possible experience on our website. By continuing to use this site, you agree to our use of cookies.
Accept