Claude Computer Use pasa a general y suma una herramienta de navegador

Anthropic convirtió Computer Use, la Skills API y la Files API en funciones oficiales al mismo tiempo, y sumó a Computer Use una nueva herramienta de navegador. Las tres funciones existían antes en versión beta: los desarrolladores debían incluir un encabezado beta en sus llamadas, y tanto la disponibilidad como los límites de tasa correspondían al trato propio de una beta.

El funcionamiento de Computer Use no cambió: al modelo se le entrega una captura de pantalla y este hace clic, escribe y desplaza la página como lo haría una persona frente al teclado. El cambio más práctico de esta actualización es poder ejecutar varias acciones en una sola ronda. Antes, cada llamada a la API devolvía una sola acción; hasta mover el ratón exigía un ida y vuelta completo. Ahora se pueden enviar varios pasos seguidos en una misma ronda, lo que reduce el tiempo total de la tarea. Al mismo tiempo, Computer Use quedó cubierto por un BAA que cumple con HIPAA, lo que retira una barrera de cumplimiento para los casos de salud y seguros.

La herramienta de navegador toma otro camino

El nuevo Browser Use extiende el control del computador a las aplicaciones Web, pero de una forma distinta a hacer clic sobre capturas de pantalla: el modelo lee la estructura de la página y ubica elementos concretos de forma directa, sin depender de coordenadas de píxeles.

Esa diferencia se amplifica mucho en entornos de producción. Un script que hace clic por coordenadas falla en cuanto cambia el tamaño de la ventana, varía el renderizado de la fuente o aparece un aviso de cookies, y falla de forma silenciosa: el modelo cree haber pulsado 'Enviar', pero en realidad tocó un espacio vacío, y todo el flujo sigue corriendo arrastrando un estado de error. Un modelo que ubica por elementos obtiene información del tipo 'este es un botón llamado submit', lo que facilita que los errores se detecten más arriba en el proceso.

El sector de la automatización ya vivió este mismo proceso en la era de Selenium, cuando pasó de la comparación de imágenes de vuelta a los selectores DOM. Esta ola de agentes partió de la captura de pantalla y ahora llega a la misma conclusión.

Los dos caminos tampoco son mutuamente excluyentes. El valor del control por captura de pantalla está en su cobertura: el software de escritorio, las terminales remotas y los clientes Windows antiguos no tienen un DOM que leer, solo se pueden operar 'mirando'. La herramienta de navegador resuelve la parte Web, y la Web es justamente la mayor porción de los sistemas internos de las empresas. Anthropic reunió ambos caminos bajo el mismo Computer Use, así que los desarrolladores no tienen que elegir entre dos API: el modelo cambia de método según el tipo de ventana objetivo.

Las habilidades pasan a funcionar por carga de archivos

La Skills API se encarga de otra cosa. Anthropic define una habilidad como una carpeta con instrucciones, scripts y plantillas, que el modelo solo carga cuando la tarea lo requiere. La API, ya oficial, simplifica la carga y el control de versiones; las habilidades corren dentro del sandbox de código propio de Claude, así que el desarrollador no necesita preparar su propio entorno de ejecución.

Quitarse de encima el alojamiento pesa bastante. Un equipo que quisiera convertir su proceso interno de generación de informes en una habilidad antes tenía que decidir en qué máquina correría el script, cómo aislarlo y cómo recuperarse de un error; ahora esa parte queda absorbida por la plataforma. El precio es entregar el entorno de ejecución a la otra parte: qué dependencias se pueden instalar y si hay salida a internet pasa a depender de las reglas de la plataforma.

La cuota de archivos sube a 1TB

Los cambios en la Files API se parecen más a un ajuste de infraestructura: los archivos ahora admiten expiración automática, el límite de tasa sube a 5 veces el anterior y cada organización recibe 1TB de almacenamiento. Tras subirlo una vez, el archivo se puede referenciar por ID en solicitudes posteriores, sin tener que volver a meter el mismo contrato o informe financiero en el contexto una y otra vez.

1TB sobra de largo para aplicaciones de texto; para aplicaciones que procesan escaneos, grabaciones de audio o fotogramas de video, la cuenta cambia. La expiración automática es fácil de pasar por alto, pero tacha la 'limpieza' de la lista de pendientes del desarrollador: los agentes que corren durante mucho tiempo ya no agotarán su cuota por olvidar borrar productos intermedios.

Los tres números de Asteroid

El caso de cliente que presenta Anthropic viene de Asteroid, una empresa de automatización de reclamos de seguros. El flujo de reclamos más largo bajó de 32 a 13 minutos, el costo por tarea cayó cerca de un 30% y la tasa de finalización llegó al 100%.

De los tres números, la tasa de finalización es la más difícil. El proceso de reclamos atraviesa varios sistemas internos, y un solo clic equivocado a mitad de camino rompe todo el flujo; el costo de que una persona tome el relevo termina siendo mayor que no automatizar en absoluto. Las mejoras en tiempo y costo se explican por las múltiples acciones por ronda y menos reintentos; la mejora en la tasa de finalización parece venir más de la herramienta de navegador.

Haciendo un cálculo aproximado con estas cifras públicas: un proceso de 32 minutos reducido a 13 significa que el mismo equipo puede procesar casi el doble de casos por día; con el costo bajando otro 30%, la cuenta marginal por caso empieza a cerrar. Los reclamos de seguros toleran muy poco error: pagar de más o de menos genera responsabilidades en ambos casos, y poder anunciar públicamente una tasa de finalización del 100% muestra que esta empresa se atreve a dejar correr el flujo hasta el final sin una compuerta manual en el medio.

Las tres funciones están disponibles actualmente en Claude Platform y en Microsoft Foundry, y Vertex AI de Google Cloud se sumará después. En el mismo periodo, otras plataformas también están avanzando en esta dirección: OpenAI ya había fusionado el razonamiento y el control de computador de Codex en un mismo modelo, lo que choca de frente con esta oficialización. Quién tenga el control más estable, al final, se decidirá por la tasa de finalización de este tipo de flujos que cruzan varios sistemas; las puntuaciones de benchmark tienen poco peso ahí.

Fuentes: anuncio oficial de Anthropic, CocoLoop, documentación de Claude Platform; las cifras sobre el múltiplo del límite de tasa, la cuota de almacenamiento y los tres indicadores del caso Asteroid se verificaron una por una.