Módulo 3 · Parte A de 3 · Início de chamadas ao vivo

Conecte a stack do NemoClaw

Nos Módulos 1 e 2, mantivemos a orquestração no navegador, e cada workflow terminava quando a página deixava de manter suas mensagens, resultados intermediários ou o estado das ramificações. O Módulo 3 transfere os mesmos padrões de agentes para um launchable do NemoClaw no Brev.

Os principais componentes funcionais desta implantação são:

  • Endpoint do LLM. Transforma prompts e resultados de ferramentas em respostas semânticas, mas não preserva o estado da sessão do agente.
  • Harness do OpenClaw. Preserva o histórico da sessão, um workspace baseado em arquivos e o acesso a ferramentas.
  • Sandbox do OpenShell. Limita o que o agente em execução pode alcançar.
  • Blueprint do NemoClaw. Configura o OpenClaw e o OpenShell para trabalharem juntos.

Nesta lição, você conectará o navegador ao launchable, inspecionará suas quatro rotas de conexão, usará uma chamada direta ao modelo como controle, enviará um turno do agente com ferramentas pelo gateway e comprovará que uma sessionKey restaura o histórico que o cliente não reenviou.

Papéis do runtime no blueprint do NemoClaw, adaptados do workflow NemoClaw for OpenClaw da NVIDIA.

Inicie o launchable

  1. Abra o launchable do NemoClaw e faça login.
  2. Abra <launchable>/dashboard.
  3. Localize o cartão my-assistant em execução e selecione Chat with Agent.
  4. Volte para cá e informe a URL do launchable. Se o curso não for servido pelo launchable, cole também a sessão de acesso do navegador do launchable.

Copie a sessão de acesso ao launchable quando esta página estiver hospedada separadamente

O token do gateway e a sessão de acesso ao launchable autorizam coisas diferentes:

Quando este curso não for servido pelo launchable, copie esse cookie do navegador no campo Sessão de acesso abaixo:

  1. Mantenha aberta a guia do launchable em que você fez login. Use _pomerium para um host apps.run.brev.nvidia.com ou CF_Authorization para um host brevlab.com.
  2. Chrome, Edge ou Brave: abra as ferramentas do desenvolvedor, selecione Application (Aplicativo)Storage (Armazenamento)Cookies e escolha a origem do launchable.
  3. Firefox: abra as ferramentas do desenvolvedor, selecione Storage (Armazenamento)Cookies e escolha a origem do launchable.
  4. Safari: se necessário, ative os recursos para desenvolvedores web em Settings (Ajustes)Advanced (Avançado), abra o Inspetor Web e selecione Storage (Armazenamento)Cookies e a origem do launchable.
  5. Localize o nome do cookie correspondente e copie somente o Value (Valor) completo. Não copie o cabeçalho Cookie inteiro nem cole o valor em nenhum lugar além do campo Sessão de acesso desta página.
Se o teste do NemoClaw exceder o tempo limite ou retornar 502. É provável que o ambiente do agente ainda não tenha terminado de iniciar. Isso geralmente ocorre quando o launchable inicia antes que o OpenClaw termine de carregar a política YAML. Aguarde 30 segundos e teste novamente. Se continuar indisponível, use a célula Recuperar na seção do gateway antes de continuar.

Inspecione as quatro rotas de conexão

O teste de conexão e o código visível compartilham a conexão normalizada do launchable e a decisão do provedor. Execute a célula editável para testar, em ordem, os metadados do agente, o gateway, o terminal e o estado; depois, inspecione o resultado renderizado automaticamente com os dados sensíveis ocultos.

Um launchable com Pomerium mantém direto o tráfego de inicialização e WebSocket: as verificações HTTP são executadas pelo loopback do terminal. O Cloudflare envia as verificações HTTP pelo relay aprovado; os WebSockets tentam primeiro o launchable e podem usar o relay para recuperação. A verificação mostra a rota sem revelar a sessão.

Etapa 1 · Estabeleça o controle direto do modelo

As verificações anteriores do launchable comprovam que o stack em execução está acessível. Antes de enviar um turno do agente, faça uma solicitação direta de Chat Completions pela rota do modelo usada nos Módulos 1 e 2. Esse controle não tem sessão do OpenClaw nem ferramentas do gateway, para que a Etapa 2 mostre o que o harness adiciona. Ele não inspeciona nem reconfigura o modelo dentro do seu launchable.

Confirme a conexão direta com o modelo

O cartão de configurações reflete a rota do modelo do curso salva na página inicial ou no Módulo 1a. Altere-a somente se a sonda direta falhar. A rota do modelo do curso e a conexão com o launchable mantêm credenciais e estado separados.

Opcional · Compare a latência direta do modelo

O benchmark opcional obtém do catálogo os modelos correspondentes, transmite um prompt curto para cada um e registra o tempo até o primeiro token (TTFT) e o tempo total. Essas são medições diretas da API; elas não medem o planejamento, as ferramentas nem o trabalho de sessão adicionado pelo gateway do OpenClaw.

Passo 2 · Opere o agente por meio de seu gateway

O Passo 1 estabeleceu o controle exclusivo do modelo: uma solicitação POST de Chat Completions carregou o modelo, as mensagens e a autorização do chamador. O OpenClaw chama o modelo configurado dentro do launchable, mas esta página opera o agente em execução por outra interface.

O diagrama compara interfaces usadas em camadas distintas, não uma única rota de solicitação:

Três interfaces em camadas distintas: HTTP limitado para o modelo, integração de ferramentas via MCP dentro do runtime e o WebSocket ativo até o gateway do OpenClaw.

Autorize o gateway

Alcançar o launchable e operar seu gateway exigem credenciais distintas:

Após a autenticação no launchable, GET /api/agent retorna o token do gateway em agent.dashboardUrl. Deixe o campo do token vazio para que a sonda o preencha.

Esse token carrega o escopo operator.admin, a mesma autoridade que a UI Control detém. Com ele você pode:

Um único POST inicia um ciclo dentro do gateway; a chave da sessão leva a memória para a próxima chamada.

Verifique antes de alterar o runtime

Os launchables compatíveis do NemoClaw normalmente mostram tools.toolSearch=false. Uma configuração personalizada ainda pode ativá-lo; por isso, a verificação de integridade lê o valor ativo antes de Recuperar alterar qualquer coisa:

O caminho saudável usa exec diretamente. Recuperar altera toolSearch somente quando a verificação ativa o encontra ligado.

Com o runtime conectado, você pode enviar uma mensagem ao ciclo do agente. Execute as três células abaixo em ordem. A primeira conecta e lista modelos e tarefas cron. A segunda envia um turno de chat, e a última transmite o rastreamento. Leia-o linha por linha:

Cada chat verifica a própria integridade. Se registrar ⚠ DEGRADED, volte aqui, execute Recuperar e tente novamente.

Qualquer pessoa que possa ler o ambiente launchable pode ler esse token, e um leitor do token é um operador com tudo acima. Módulo 4 transforma isso de uma conveniência para a questão de segurança central.

Passo 3 · A memória vive na chave da sessão

Cada chat.send recebe uma sessionKey, que determina o que o turno recorda:

A primeira célula registra um fato e o solicita novamente com a mesma chave. O agente usa um turno que o cliente não reenviou, pois o gateway restaurou o histórico mantido no servidor. As outras duas células permitem gerenciar esse estado.

A chave de sessão é a única identificação da conversa enviada pelo cliente. A partir dela, o gateway recupera no servidor toda a sessão antes de cada chamada; o cliente não precisa reenviar a transcrição. Duas chaves diferentes sempre identificam sessões separadas, mesmo que as conversas tenham conteúdo idêntico.

O que vem a seguir

Módulo 3b abre os arquivos que moldam cada turno OpenClaw. O Módulo 3c adiciona skills e gatilhos agendados, então o Módulo 4 testa como OpenShell limita as ações que as instruções persistentes podem iniciar.

Referências

Lista completa em Próximos passos · Referências.

Experimente · fale com o seu launchable

Uma vez que a sonda acima é verde, este artefato abre o mesmo /cli/gateway WebSocket e permite que você converse com seu agente OpenClaw ao vivo. Ele transmite a resposta e mostra um chip sempre que o agente alcança uma ferramenta. Todas as respostas que vê aqui voltavam para aquela ligação ao vivo.

← Módulo 2c: Agentes profundos