Install
npx skillscat add microsoft/ai-agents-for-beginners/translations-da-agents-skills-deploying-scalable-agents Install via the SkillsCat registry.
A companion skill for Lesson 16 of a Microsoft Foundry agents course, it guides learners in moving an agent from prototype to scalable production deployment on Foundry. It addresses hosting patterns, identity, state, cost control, evaluation gates, and human-in-the-loop approval. Use it when deploying, scaling, or adding observability to a Foundry-based agent.
Udrulning af skalerbare agenter med Microsoft Foundry
Følgesvendskompetence til Lektion 16 – Udrulning af skalerbare agenter.
Brug den til at hjælpe en lærende med at flytte en agent fra prototype til en skalerbar, observerbar
produktionsudrulning. Underbyg hver anbefaling med lektionens indhold og
den kørende notesbog; opfind ikke Foundry-API'er.
Triggere
Aktivér denne færdighed, når en lærende ønsker at:
- Udrulle en agent til Microsoft Foundry som en hostet agent og gøre den versionsstyret/observerbar.
- Vælge mellem klient-hostet, hostet agent og agent-workflow udrulningsmønstre.
- Tilføje modelruting, respons-caching eller begrænset samtidighed for at styre latenstid og omkostninger.
- Tilføje en evalueringsport så en dårlig agentversion ikke kan udgives.
- Tilføje et menneske-i-loop-godkendelsestrin for højrisikohandlinger.
- Instrumentere en agent med OpenTelemetry tracing til produktionsobserverbarhed.
- Røgt-test en udrullet agent som en hurtig port efter udrulning.
Kerne-mindre model
En produktionsagent er mest det operationelle skelet omkring modellen (~80%),
ikke selve modellen. Kortlæg hver anbefaling til en af disse bekymringer:
| Bekymring | Prototype → Produktion |
|---|---|
| Hosting | notesbog → versionsstyret hostet tjeneste |
| Identitet | din az login → administreret identitet + scoped RBAC |
| Status | in-memory → eksternt tråd-/hukommelseslager |
| Fejl | traceback → genforsøg, backoffs, alarmer |
| Omkostning | "et par cent" → sporet, rutet, cached, budgetteret |
| Kvalitet | øjekast → automatiseret evalueringsport |
| Tillid | du godkender → politik + menneske-i-loop |
Udrulningsmønstre (vælg et, eller kombinér)
- Klient-hostet — ræsonneringssløjfen kører i din proces. Maks kontrol; du ejer skalering/status.
- Hostet agent (Foundry Agent Service) — Foundry hoster sløjfen, gemmer tråde, håndhæver RBAC/indholdssikkerhed, viser agenten i portalen. Mindre kontrol, langt mindre operationsflade.
- Agent-workflow — flere agenter/værktøjer sammensat til en graf med forgreninger, godkendelsesnoder og holdbare checkpoints.
Livscyklus (sløjfen der leverer en agent)
opret → versioner → evaluer (port) → udrul hostet → observer online → indsamle fejl → gentag.
Offline evaluering er en port, ikke en eftertanke — en version udgives ikke
medmindre den klarer tærsklen. Online observerbarhed fodrer rigtige fejl tilbage
til den offline testsæt.
Skalerings- og omkostningshåndtag (i prioriteret rækkefølge)
- Vælg modelstørrelse korrekt — brug den mindste model der passerer evalueringsporten.
- Ruter efter kompleksitet — lille/hurtig model til simple forespørgsler, stor model til ægte ræsonnering (DIY klassifikator eller Foundry Model Router).
- Cache — betjen næsten-duplikat-forespørgsler uden modelopkald.
- Stateless design + begrænset samtidighed — eksternaliser status; genforsøg med udskydelse.
Nøglemønstre der skal genskabes
Peg den lærende hen imod disse fra notesbogen
`16-python-agent-framework.ipynb`:
- Forespørgselsbehandler: cache → rute efter kompleksitet → trace span → kør → cache.
- Evalueringsport: score et offline testsæt; returnér
pass_rate >= thresholdog udrul kun hvis sandt. - Menneskelig godkendelse:
@tool(approval_mode="always_require")til handlinger som store refunderinger. - Tracing: indpak hver forespørgsel i
tracer.start_as_current_span(...)og sæt attributter somrouted.model,customer.id.
Røg-test af en udrullet agent
Efter udrulning, bekræft at endpoint rent faktisk svarer (en grøn udrulning kan stadig være
stille). Brug AI Smoke Test
handlen via `.github/workflows/smoke-test.yml`
med kataloget i `tests/`. Køreren POST'er hver
prompt til POST {project_endpoint}/agents/{agent_name}/endpoint/protocols/openai/responses
og tjekker svarets tekst. Identiteten har brug for rollen Azure AI User på
Foundry projektomfang; token-auditoriet skal være https://ai.azure.com/.
Læg portene lagvis: røgtest (tilgængelig/svarende, ved hver udrulning) → offline
evaluering (god nok til udrulning, før forfremmelse) → online evaluering (hvordan
går det "derude", kontinuerligt).
Enterprise-kontroller
- RBAC: giv hver hostet agent en administreret identitet med mindst privilegium.
- MCP i produktion: behandl hver MCP-server som en ikke-pålidelig grænse — fastlås version, afgræns identitet, valider output, rate-limiting, udsæt aldrig hemmeligheder.
Vogtere for assistenten
- Foretræk det kanoniske
FoundryChatClient(...)+provider.as_agent(...)mønster brugt gennem kurset. - Lov ikke levende-Azure resultater, du ikke har verificeret; anbefal røgt-test workflowen for at bekræfte en udrulning.
- Hold evaluering og omkostningsråd bundet sammen: evaluering sætter kvalitetsgulvet, routing/caching holder omkostningerne tæt ved det gulv.
Ansvarsfraskrivelse:
Dette dokument er blevet oversat ved hjælp af AI-oversættelsestjenesten Co-op Translator. Selvom vi bestræber os på nøjagtighed, skal du være opmærksom på, at automatiserede oversættelser kan indeholde fejl eller unøjagtigheder. Det originale dokument på dets oprindelige sprog bør betragtes som den autoritative kilde. For kritisk information anbefales professionel menneskelig oversættelse. Vi påtager os intet ansvar for misforståelser eller fejltolkninger, der opstår som følge af brugen af denne oversættelse.