Limites, cotas e suporte regional do Foundry Agent Service

O Serviço de Agente do Foundry impõe cotas e limites sobre artefatos de agente, uploads de arquivos, mensagens e registros de ferramentas. Entender esses limites ajuda você a projetar aplicativos que são dimensionados sem atingir os limites de serviço. Este artigo lista os limites padrão, as regiões com suporte, os modelos compatíveis e as diretrizes para lidar com erros de limite.

Nota

O Serviço de Agente do Foundry está em disponibilidade geral (GA). Algumas subfuncionalidades estão em prévia pública e podem ter restrições diferentes.

Pré-requisitos

  • Uma assinatura Azure.
  • Um projeto Microsoft Foundry.
  • Um modelo implantado compatível com o Serviço de Agente. A disponibilidade do modelo e da região pode variar.

Regiões com suporte

A tabela a seguir mostra o suporte regional para a API de Respostas, agentes e intervalos de endereços IP da classe A privada.

Region API de Respostas Agentes VNet privada Classe A*
Leste da Austrália Yes Yes Yes Yes
Sul do Brasil Yes Yes Yes Yes
Canadá Central Yes Yes Yes Yes
Leste do Canadá Yes Yes Yes Yes
EUA Central Yes Yes Yes Yes
Leste dos EUA Yes Yes Yes Yes
Leste dos EUA 2 Yes Yes Yes Yes
França Central Yes Yes Yes Yes
Centro-oeste da Alemanha Yes Yes Yes Yes
Norte da Itália Yes Yes Yes Yes
Leste do Japão Yes Yes Yes Yes
Oeste do Japão Yes Yes Yes Yes
Coreia Central Yes Yes Yes Yes
Centro-Norte dos EUA Yes Yes Yes Yes
Leste da Noruega Yes Yes Yes Yes
Polônia Central Yes Yes Yes Yes
Norte da África do Sul Yes Yes Yes Yes
Centro-Sul dos EUA Yes Yes Yes Yes
Sudeste Asiático Yes Yes Yes Yes
Sul da Índia Yes Yes Yes Yes
Espanha Central Yes Yes Yes Yes
Suécia Central Yes Yes Yes Yes
Norte da Suíça Yes Yes Yes Yes
Oeste da Suíça Yes Yes Yes Yes
Norte dos EAU Yes Yes Yes Yes
Sul do Reino Unido Yes Yes Yes Yes
Centro-oeste dos EUA Yes Yes Yes Yes
Oeste da Europa Yes Yes Yes Yes
Oeste dos EUA Yes Yes Yes Yes
Oeste dos EUA 3 Yes Yes Yes Yes

* Classe A refere-se ao suporte para intervalos de endereços IP de classe A privados (10.x.x.x). Para obter os requisitos de rede relacionados, consulte o suporte regional para rede privada.

Alguns Azure modelos OpenAI não estão disponíveis em todas as regiões. Para obter detalhes, consulte Disponibilidade por região para os Foundry Models comercializados pela Azure.

Importante

Nem todas as ferramentas estão disponíveis em todas as regiões. Por exemplo, a pesquisa de arquivos não está disponível no Norte da Itália e no Sul do Brasil. Para obter a matriz completa de ferramentas por região, consulte o suporte à Ferramenta por região e modelo.

Suporte regional para rede privada

Quando você usa uma configuração de rede privada, como um agente padrão protegido pela rede, os seguintes requisitos regionais se aplicam:

  • Recurso de Foundry e região da rede virtual. Você deve implantar o recurso Foundry na mesma região que sua rede virtual. Você pode implantar outros recursos Azure, como Azure Cosmos DB, Pesquisa de IA do Azure  e Armazenamento do Azure, em regiões diferentes. Considere as implicações de custo das implantações entre regiões.
  • Fundamentação com a Busca do Bing. Somente as seguintes regiões têm suporte: Europa Ocidental, Leste do Canadá, Norte da Suíça, Espanha Central, Norte dos Emirados Árabes Unidos, Coreia Central, Polônia Central, Sudeste Asiático, Oeste dos EUA, Oeste dos EUA 2, Oeste dos EUA 3, Leste dos EUA, Leste dos EUA 2, Eua Central, Sul da Índia, Leste do Japão, Sul do Reino Unido, França Central, Leste da Noruega, Leste da Austrália, Canadá Central, Suécia Central, Norte da África do Sul, Norte da Itália, Sul do Brasil.

Para obter mais informações, consulte Usar uma rede virtual com o Serviço do Foundry Agent.

Modelos com suporte

O Serviço de Agente oferece suporte a modelos do Azure OpenAI e a vários modelos do Foundry comercializados pela Azure. A disponibilidade do modelo pode mudar ao longo do tempo e varia de acordo com a região. Para ver a lista completa de modelos a serem implantados para seu projeto e região, use a experiência de modelo do portal do Foundry.

Nuvens soberanas

O Serviço de Agente do Foundry também está disponível no Azure Governamental (US Gov Virginia e US Gov Arizona) com apenas um subconjunto de tipos de agente e ferramentas. Para obter a lista completa de recursos com suporte, consulte a disponibilidade de recursos do Serviço do Foundry Agent em Azure Governamental.

Suporte à ferramenta por região e modelo

A região e o modelo determinam quais ferramentas estão disponíveis para seu agente. Nas tabelas a seguir, Sim significa totalmente compatível, Não significa que não há suporte e Limited significa suporte parcial que varia de acordo com a configuração da ferramenta. Verifique a documentação de ferramentas individuais para obter detalhes.

A tabela a seguir mostra quais ferramentas estão disponíveis em cada região com suporte. Essa tabela conta apenas com a disponibilidade do serviço, portanto, verifique se o modelo que você deseja usar também está disponível na mesma região.

Clique para expandir
Region Agent2Agent Pesquisa de IA do Azure  Automação do navegador Interpretador de códigos Uso do computador Agente de Dados do Fabric Pesquisa de Arquivo Função Introdução à Pesquisa Personalizada do Bing Fundamentação com a Pesquisa do Bing Geração de imagem MCP OpenAPI SharePoint Pesquisa na Web
Leste da Austrália yes yes yes yes no yes yes yes yes yes yes yes yes yes yes
Sul do Brasil yes yes yes yes no yes no no yes yes yes yes yes yes yes
Canadá Central yes yes yes yes yes yes yes yes yes yes yes yes yes yes yes
Leste do Canadá yes yes yes yes no yes yes yes yes yes yes yes yes yes yes
EUA Central yes yes yes yes yes yes yes yes yes yes yes yes yes yes yes
Leste dos EUA yes yes yes yes no yes yes yes yes yes yes yes yes yes yes
Leste dos EUA 2 yes yes yes yes yes yes yes yes yes yes yes yes yes yes yes
França Central yes yes yes yes no yes yes yes yes yes yes yes yes yes yes
Centro-oeste da Alemanha yes yes yes yes no yes yes yes yes yes yes yes yes yes yes
Norte da Itália yes yes yes yes no yes no yes yes yes yes yes yes yes yes
Leste do Japão yes yes yes yes no yes yes yes yes yes yes yes yes yes yes
Oeste do Japão yes yes no yes yes yes yes yes yes yes yes yes yes yes yes
Coreia Central yes yes yes yes no yes yes yes yes yes yes yes yes yes yes
Centro-Norte dos EUA yes yes yes yes no yes yes no yes yes yes yes yes yes yes
Leste da Noruega yes yes yes yes no yes yes yes yes yes yes yes yes yes yes
Polônia Central yes yes yes yes no yes yes yes yes yes yes yes yes yes yes
Norte da África do Sul yes yes yes yes no yes yes yes yes yes yes yes yes yes yes
Centro-Sul dos EUA yes yes yes yes no yes yes no yes yes yes yes yes yes yes
Sudeste Asiático yes yes yes yes no yes yes yes yes yes yes yes yes yes yes
Sul da Índia yes yes yes yes yes yes yes yes yes yes yes yes yes yes yes
Espanha Central yes yes yes yes no yes yes yes yes yes yes yes yes yes yes
Suécia Central yes yes yes yes yes yes yes yes yes yes yes yes yes yes yes
Norte da Suíça yes yes yes yes no yes yes yes yes yes yes yes yes yes yes
Oeste da Suíça yes yes no yes yes yes yes yes yes yes yes yes yes yes yes
Norte dos EAU yes yes yes yes no yes yes yes yes yes yes yes yes yes yes
Sul do Reino Unido yes yes yes yes no yes yes yes yes yes yes yes yes yes yes
Centro-oeste dos EUA yes yes no yes yes yes yes yes yes yes yes yes yes yes yes
Oeste da Europa yes yes yes yes yes yes yes yes yes yes yes yes yes yes yes
Oeste dos EUA yes yes yes yes no yes yes no yes yes yes yes yes yes yes
Oeste dos EUA 3 yes yes yes yes no yes yes yes yes yes yes yes yes yes yes

A tabela a seguir mostra quais ferramentas cada modelo dá suporte. Para a ferramenta de geração de imagens, você precisa do modelo gpt-image-1 e de um modelo de linguagem grande (LLM) como o orquestrador no mesmo projeto do Microsoft Foundry.

Clique para expandir
Model Agent2Agent Pesquisa de IA do Azure  Azure Functions Configuração personalizada do Bing Fundamentos da Pesquisa Bing Automação do navegador Interpretador de códigos Uso do computador Agente de Dados do Fabric Pesquisa de Arquivo Functions Geração de imagem MCP OpenAPI SharePoint Pesquisa na Web Work IQ (prévia)
Cohere-command-r No No No No No No Yes No No Yes No No No No No No No
Cohere-command-r-plus No No No No No No Yes No No Yes No No No No No No No
DeepSeek-R1-0528 No No No No No No Yes No No Yes No No No No No No No
DeepSeek-V3-0324 No Yes No Yes Yes Yes Yes No Yes Yes Yes No Yes Yes Yes Yes Yes
DeepSeek-V3.1 No No No Yes Yes Yes Yes No Yes Yes Yes No Yes Yes Yes Yes Yes
FW-DeepSeek-V3.1 No Yes No No No No Yes No Yes Yes No No Yes Yes No Yes Yes
FW-DeepSeek-V3.2 No Yes No No No No Yes No Yes Yes No No Yes Yes No Yes Yes
FW-GLM-4.7 No Yes No No No No Yes No Yes Yes No No Yes Yes No Yes Yes
FW-GLM-5 No Yes No No No No Yes No Yes Yes No No Yes Yes No Yes Yes
FW-GLM-5.1 No Yes No No No No Yes No Yes Yes No No Yes Yes No Yes Yes
FW-GPT-OSS-120B No Yes No No No No Yes No Yes Yes No No Yes Yes No Yes Yes
FW-Kimi-K2-Instruct-0905 No Yes No No No No Yes No Yes Yes No No Yes Yes No Yes Yes
FW-Kimi-K2-Raciocínio No Yes No No No No Yes No Yes Yes No No Yes Yes No Yes Yes
FW-Kimi-K2.5 No No No No No No Yes No Yes Yes No No Yes Yes No Yes Yes
FW-Kimi-K2.6 No No No No No No Yes No Yes Yes No No Yes Yes No Yes Yes
FW-MiniMax-M2.5 No Yes No No No No Yes No Yes Yes No No Yes Yes No Yes Yes
FW-Qwen3.5-122B-A10B No Yes No No No No Yes No Yes Yes No No Yes Yes No Yes Yes
FW-Qwen3.5-397B-A17B No Yes No No No No Yes No Yes Yes No No Yes Yes No Yes Yes
GROK-4-20-REASONING No Yes No Yes Yes Yes Yes No Yes Yes Yes No Yes Yes Yes Yes Yes
Llama-3.3-70B-Instruct No Yes No Yes Yes Yes Yes No Yes Yes Yes No Yes Yes Yes Yes Yes
Llama-4-Maverick-17B-128E-Instruct-FP8 No Yes No Yes Yes Yes Yes No Yes Yes Yes No Yes Yes Yes Yes Yes
Llama-4-Scout-17B-16E-Instruct No No No No No No Yes No No Yes No No No No No No No
MAI-DS-R1 Yes No No No No Yes Yes No No Yes Yes No Yes No No No No
Meta-Llama-3.1-405B-Instruct No No No No No No Yes No No Yes No No No No No No No
Mistral-large-2407 No No No No No No Yes No No Yes No No No No No No No
codex-mini No No No No No No Yes No No Yes No No No No No No No
computer-use-preview No No No No No No No Yes No No No No No No No No No
gpt-35-turbo No No No No No No Yes No No Yes No No No No No No No
gpt-4 No No No No No No Yes No No Yes No No No No No No Yes
gpt-4.1 Yes Yes No Yes Yes Yes Yes No Yes Yes Yes No Yes Yes Yes Yes Yes
gpt-4.1-mini Yes Yes No Yes Yes Yes Yes No Yes Yes Yes No Yes Yes Yes Yes Yes
gpt-4.1-nano Yes Yes No Yes Yes Yes Yes No Yes Yes Yes No Yes Yes Yes Yes Yes
gpt-4.5-preview No No No No No No Yes No No Yes No No No No No No No
gpt-4o Yes Yes No Yes Yes Yes Yes No Yes Yes Yes No Yes Yes Yes Yes Yes
gpt-4o-mini Yes No No Yes Yes Yes Yes No Yes Yes Yes No Yes Yes Yes Yes Yes
gpt-5 Yes Yes No Yes Yes Yes Yes No Yes Yes Yes Yes Yes Yes Yes Yes Yes
gpt-5-chat No No No No No No Yes No No Yes No No No No No No Yes
gpt-5-codex No No No No No No Yes No No Yes No No Yes No No No Yes
gpt-5-mini No No No No No No Yes No No Yes No No Yes No No Yes Yes
gpt-5-nano No No No No No No Yes No No Yes No No No No No No Yes
gpt-5-pro No No No No No No Yes No No Yes No No No No No No No
gpt-5.1 No Yes Yes No Yes No Yes No Yes Yes Yes No Yes Yes Yes Yes Yes
gpt-5.1-chat No No No No No No Yes No No Yes No No No No No No No
gpt-5.1-codex No No No No No No Yes No No Yes No No Yes No No No Yes
gpt-5.1-codex-max No No No No No No Yes No No Yes No No No No No No No
gpt-5.1-codex-mini No No No No No No Yes No No Yes No No No No No No No
gpt-5.2 No Yes Yes No Yes No Yes No Yes Yes Yes No Yes Yes Yes Yes Yes
gpt-5.2-chat Yes Yes No Yes Yes Yes Yes No Yes Yes Yes No Yes Yes No Yes Yes
gpt-5.2-codex No No No No No No Yes No No Yes No No Yes No No No Yes
gpt-5.3-chat Yes Yes No Yes Yes Yes Yes No Yes Yes No No Yes Yes Yes Yes Yes
gpt-5.3-codex Yes Yes No Yes Yes Yes Yes No Yes Yes No No Yes Yes Yes Yes Yes
gpt-5.4 Yes Yes No Yes Yes Yes Yes No Yes Yes No No Yes Yes Yes Yes Yes
gpt-5.4-mini Yes Yes No Yes Yes Yes Yes No Yes Yes No No Yes Yes Yes Yes Yes
gpt-5.4-nano Yes Yes No Yes Yes Yes Yes No Yes Yes No No Yes Yes Yes Yes Yes
gpt-5.4-pro Yes Yes No Yes Yes Yes Yes No Yes Yes No No Yes Yes Yes Yes Yes
gpt-5.5 Yes Yes No Yes Yes Yes Yes No Yes Yes No No Yes Yes Yes Yes Yes
gpt-chat-latest Yes Yes No Yes Yes Yes Yes No Yes Yes No No Yes Yes Yes Yes Yes
gpt-oss-120b No No No No No No Yes No No Yes Yes No Yes No No No Yes
grok-3 No Yes No Yes Yes Yes Yes No Yes Yes Yes No Yes Yes Yes Yes Yes
grok-3-mini No Yes No Yes Yes Yes Yes No Yes Yes Yes No Yes Yes Yes Yes Yes
grok-4 No No No No No No Yes No No Yes No No No No No No No
grok-4-1-fast-non-reasoning No Yes No Yes Yes Yes Yes No Yes Yes Yes No Yes Yes Yes Yes Yes
grok-4-1-fast-reasoning No Yes No Yes Yes Yes Yes No Yes Yes Yes No Yes Yes Yes Yes Yes
grok-4-20-non-reasoning No Yes No Yes Yes Yes Yes No Yes Yes Yes No Yes Yes Yes Yes Yes
grok-4-20-reasoning No Yes No Yes Yes Yes Yes No Yes Yes Yes No Yes Yes Yes Yes Yes
grok-4-fast-non-reasoning No Yes No Yes Yes Yes Yes No Yes Yes Yes No Yes Yes Yes Yes Yes
grok-4-fast-reasoning No Yes No Yes Yes Yes Yes No Yes Yes Yes No Yes Yes Yes Yes Yes
mistral-small-2503 No No No No No No Yes No No Yes No No No No No No No
model-router No No No Yes Yes Yes Yes No Yes Yes Yes No Yes Yes Yes No Yes
o1 No Yes No Yes No Yes Yes No No Yes Yes No Yes No Yes Yes Yes
o1-mini No No No No No No Yes No No Yes No No No No No No No
o1-preview No No No No No No Yes No No Yes No No No No No No No
o3 Yes Yes No Yes No Yes Yes No Yes Yes Yes No Yes Yes No Yes Yes
o3-Pesquisa Profunda No No No No No No No No No No No No Yes No No Yes Yes
o3-mini Yes No No Yes Yes Yes Yes No Yes Yes No No No No No No Yes
o3-pro No No No No No No Yes No No Yes No No No No No No No
o4-mini Yes No No Yes Yes Yes Yes No Yes Yes Yes No Yes No Yes Yes Yes

Solucionando problemas

Um modelo ou versão não está disponível em sua região

  • Confirme se você selecionou a guia certa para o tipo de implantação (padrão global versus provisionado).
  • Experimente uma região diferente que dê suporte ao modelo e à API de Respostas.
  • Se você estiver usando modelos gpt-5, o registro será necessário. O acesso é concedido de acordo com os critérios de qualificação do Microsoft.

Uma ferramenta não está disponível em sua região

  • Nem todas as ferramentas têm suporte em todas as regiões. Por exemplo, a pesquisa de arquivos não está disponível no Norte da Itália e no Sul do Brasil.
  • Verifique o suporte à ferramenta por região e tabela de modelos para confirmar a disponibilidade antes de implantar.
  • Se uma ferramenta não estiver disponível, escolha uma região com suporte ou use uma ferramenta diferente.

A implantação de taxa de transferência provisionada falha

O agente recebe erros de limitação de taxa (429)

  • Implemente a retirada exponencial com tremulação em sua lógica de repetição de aplicativo.
  • Para cargas de trabalho com alta taxa de transferência contínua, considere implantações com taxa de transferência provisionada.
  • Revise as cotas e os limites do OpenAI do Azure para os tokens por minuto e os limites de solicitações por minuto da sua implantação.

Como o Serviço de Agente impõe limites

O Serviço de Agente do Foundry impõe limites em dois locais:

  • Limites de Serviço do Agente. Limites para artefatos de agentes e threads, como uploads de arquivo, anexos de repositórios de vetores, contagem de mensagens e registro de ferramentas.
  • Limites de modelo. Cotas e limites de taxa para as implantações de modelos chamadas pelos seus agentes.

Os artefatos que esses limites regem são armazenados no armazenamento gerenciado por Microsoft ou em seus próprios recursos Azure, dependendo da configuração.

Onde o Serviço de Agente armazena seus dados

O local em que os dados do agente residem depende de qual opção de configuração você escolher. A opção de instalação também determina a quais recursos as cotas e os limites neste artigo se aplicam.

  • Configuração básica armazena o estado do agente em um armazenamento seguro gerenciado pela Microsoft, logicamente separado. Esse é o padrão quando você não configura seus próprios recursos.
  • A instalação padrão armazena o estado do agente em recursos de Azure de locatário único gerenciados pelo cliente em sua própria assinatura, o que oferece controle total sobre a residência e o acesso aos dados.
Tipo de dados Configuração básica Configuração padrão
Arquivos, uploads e anexos armazenamento gerenciado por Microsoft Armazenamento do Azure (Armazenamento de Blobs)
Repositórios vetoriais, inserções e índices de recuperação pesquisa de vetor gerenciada por Microsoft Pesquisa de IA do Azure 
Tópicos, histórico de conversas, mensagens e definições de agentes armazenamento gerenciado por Microsoft Azure Cosmos DB

Os hosts de funcionalidade informam ao Serviço do Agente onde armazenar e processar uploads de arquivos, repositórios de vetores e histórico de conversas. Para armazenar dados do agente em seus próprios recursos, consulte a configuração do agente Standard.

Os pontos de extremidade do Serviço do Foundry Agent são regionais e os dados são armazenados na mesma região que o ponto de extremidade. Para obter mais informações, consulte a documentação sobre residência de dados do Azure.

Limites de serviço padrão

A tabela a seguir lista os limites padrão impostos pelo Serviço do Agente. Esses limites se aplicam a todos os projetos do Foundry, independentemente do tipo de assinatura ou região.

Nome do limite Valor limite
Número máximo de arquivos por agente/thread 10.000
Tamanho máximo do arquivo para agentes 512 MB
Tamanho máximo para todos os arquivos carregados para agentes 300 GB
Tamanho máximo do arquivo em tokens para anexação a um repositório de vetores 2.000.000 tokens
Número máximo de mensagens por thread 100,000
Tamanho máximo de text conteúdo por mensagem 1.500.000 caracteres
Número máximo de ferramentas registradas por agente 128
Número máximo de revisões de agente válidas por agente 1,000

Os limites do Serviço do Agente nesta tabela são fixos e aplicados uniformemente em todos os tipos de assinatura. A limitação de taxa para chamadas ao modelo é aplicada no nível da implantação do modelo; consulte cotas e limites do Azure OpenAI para limites de taxa específicos do modelo.

Referência de erro de limite

Quando você excede um limite, o Serviço de Agente retorna um erro. Manipule esses erros de forma elegante em seu aplicativo.

Cenário de erro Status HTTP Código de erro Ação recomendada
Arquivo muito grande 400 file_size_exceeded Dividir conteúdo em arquivos menores
Limite de tokens de armazenamento vetorial 400 token_limit_exceeded Reduzir o conteúdo do arquivo ou dividir arquivos
Limite de mensagem de tópico 400 message_limit_exceeded Criar um novo thread
Conteúdo da mensagem muito grande 400 content_size_exceeded Use a pesquisa de arquivos para conteúdos grandes
Muitas ferramentas 400 tool_limit_exceeded Remover ferramentas não utilizados
Limite de taxa excedido 429 rate_limit_exceeded Implementar retirada exponencial
Muitas versões válidas do agente 400 UserError Exclua versões mais antigas e crie uma nova versão. Esse erro é terminal— tentar novamente a mesma chamada de criação sem excluir versões continua falhando.

Por exemplo:

  • O arquivo excede o tamanho máximo. Falha ao carregar o arquivo. Divida o conteúdo em arquivos menores ou reduza o tamanho do arquivo antes de carregar.
  • Limite de tokens de armazenamento vetorial. A anexação de um arquivo a um repositório de vetores falhará se o arquivo exceder o limite de token. Reduza o conteúdo do arquivo ou divida-o em vários arquivos.
  • Limite de mensagem de thread. A adição de mensagens pode falhar depois que um thread atingir o limite de mensagens. Crie um novo thread para uma nova sessão de conversa ou arquive e gire threads como parte do design do aplicativo.
  • Tamanho do conteúdo da mensagem. A criação de uma mensagem poderá falhar se o text conteúdo for muito grande. Envie mensagens menores ou mova conteúdo grande para arquivos e use a pesquisa de arquivos.
  • Limite de registro da ferramenta. Criar ou atualizar um agente pode falhar se houver registro de muitas ferramentas. Registre apenas as ferramentas necessárias e prefira menos ferramentas reutilizáveis.
  • Limite de taxa excedido. As chamadas à API para a implantação do modelo são limitadas. Implemente a retirada exponencial com tremulação.
  • Limite de versão do agente válido. A criação de uma versão falha quando um agente atinge 1.000 revisões válidas. O serviço retorna HTTP 400 com a mensagem Maximum number of agent versions (1000) exceeded. Please delete older versions before creating new ones. Este erro é terminal, não um transitório, portanto, não tente novamente a mesma chamada. Exclua as versões que você não precisa mais liberar capacidade imediatamente e crie a nova versão.

Para cenários de pesquisa de arquivos, consulte armazenamento de vetores para pesquisa de arquivos para orientação sobre como gerenciar o crescimento do armazenamento de vetores.

Práticas recomendadas para se manter dentro dos limites

Adote as seguintes práticas para reduzir falhas relacionadas aos limites:

  • Mantenha os arquivos pequenos e focados. Prefira vários documentos menores em vez de um único documento grande.
  • Evite mensagens muito grandes. Coloque conteúdo longo em arquivos carregados e consulte-o usando a pesquisa de arquivo.
  • Planeje conversas longas. Trate os tópicos como estado de sessão e alterne para novos tópicos quando as conversas ficarem muito longas.
  • Registre apenas as ferramentas necessárias. Remova as ferramentas não utilizados das definições do agente.
  • Gerenciar versões do agente. Cada agente permite até 1.000 revisões válidas. Exclua ou rotacione versões que você não precise mais como parte do pipeline de implantação para que agentes ativos permaneçam bem abaixo do limite e não repita chamadas de criação que falhem com o erro de limite de versão até liberar a capacidade.
  • Monitorar tendências de uso. Acompanhe a atividade do agente usando as métricas do Foundry Agent Service para identificar o crescimento antes de atingir os limites.

Cotas e limites de taxa do modelo

Os agentes seguem as cotas e os limites de taxa para as implantações de modelos que usam.

Para cotas e limites de modelo atuais, consulte:

Para visualizar ou solicitar mais cotas de modelo, consulte Gerenciar e aumentar cotas para recursos com o Microsoft Foundry (projetos do Foundry).

Solicitar um aumento de limite

Os limites neste artigo são valores padrão para o Serviço do Foundry Agent. Se sua carga de trabalho exigir limites mais altos:

  • Cotas de modelo. Você pode solicitar aumentos para cotas de implantação de modelos. Consulte Gerenciar e aumentar as cotas de recursos com a Microsoft Foundry.
  • Limites de Serviço do Agente. Os limites de arquivo, mensagem e ferramenta listados neste artigo são limites de serviço fixos e não podem ser aumentados. Crie seu aplicativo para funcionar dentro dessas restrições usando as práticas recomendadas descritas anteriormente.