Écrits

Ce que nous avons appris en déployant des agents sur une sandbox cloud

Nous avons testé une plateforme managée de conteneurs cloud sur des cas réels : le WebSocket persistant fonctionne parfaitement, la coupure totale du réseau sortant bloque les agents, et l’architecture a été adaptée en conséquence.

Le plan initial prévoyait une machine exécutant les agents avec réseau sortant totalement coupé. Les bancs d’essai réels ont révélé des contraintes différentes, conduisant à adapter l’architecture aux réalités du terrain.

A sealed machine with one channel through its wall, carrying frames both ways, and a second attempt refused for want of a token.controlsandboxwith a token403without one
Un canal unique à travers la frontière, transportant les trames dans les deux sens, strictement subordonné à un jeton d’accès valide.

Le rôle central du WebSocket

Les agents s’exécutent dans des terminaux interactifs, qui constituent des flux continus. La plateforme supporte parfaitement l’upgrade de protocole et le passage bidirectionnel des trames :

GET /?identifier=<id>&api-version=2024-02-02-preview
Authorization: Bearer <token>

101 Switching Protocols
  frames server to client, and client to server

Sans jeton, la requête est rejetée en 403 Unauthenticated, garantissant que la machine d’exécution ne présente aucune surface publique non filtrée.

L’impossibilité de couper le réseau sortant

Couper les accès réseau sortants empêche l’agent d’interroger les API des modèles (Anthropic, OpenAI), d’accéder au dépôt Git et de communiquer avec notre plan de contrôle.

L’isolation ne peut donc pas reposer sur une coupure réseau brutale. Elle repose sur la séparation des responsabilités : retirer la base de données et les clés maîtresses de la machine d’exécution.

La plateforme dicte l’architecture plus que les diagrammes théoriques.

Enseignements opérationnels

Mesurez toujours les caractéristiques réelles de votre infrastructure avant de figer vos choix d’architecture. Conservez les protocoles de communication indépendants du sens d’établissement de la connexion pour préserver votre liberté de déploiement.

Les conséquences architecturales de ces tests sont détaillées dans la machine qui exécute les agents ne détient aucun secret, et la gestion du flux dans observer un terminal distant.

Réponses directes

Peut-on exécuter des agents de code IA sur une sandbox cloud managée ?

Oui. Nos bancs de test confirment le maintien des connexions WebSocket persistantes indispensables aux terminaux.

Pourquoi tester plutôt que de se fier à la documentation ?

Certaines contraintes pratiques (comportement exact du proxy, audiences des jetons OAuth, durées de maintien des connexions) ne sont vérifiables qu’empiriquement.

Quels changements architecturaux en ont découlé ?

L’isolation a été déplacée au niveau applicatif (retrait des clés et de la base de données) plutôt que par un blocage réseau sortant qui empêchait les agents de contacter les modèles d’IA.