Přeskočit na hlavní obsah

Exploring Kaito to streamline AI inference model deployment in Azure Kubernetes

července 16, 2024 | 9:00 - 10:00 odp. (UTC) Koordinovaný univerzální čas

Jste připravení začít s AI a nejnovějšími technologiemi? Microsoft Reactor poskytuje události, školení a komunitní zdroje, které vývojářům, podnikatelům a startupům pomáhají rozvíjet technologie AI a další. Připojte se k nám!

Exploring Kaito to streamline AI inference model deployment in Azure Kubernetes

července 16, 2024 | 9:00 - 10:00 odp. (UTC) Koordinovaný univerzální čas

Jste připravení začít s AI a nejnovějšími technologiemi? Microsoft Reactor poskytuje události, školení a komunitní zdroje, které vývojářům, podnikatelům a startupům pomáhají rozvíjet technologie AI a další. Připojte se k nám!

Přejít zpět

Exploring Kaito to streamline AI inference model deployment in Azure Kubernetes

července 16, 2024 | 9:00 - 10:00 odp. (UTC) Koordinovaný univerzální čas

  • Formát:
  • alt##LivestreamŽivý přenos

Téma: Infrastruktura pro AI

Jazyk: Angličtina

About this session:
Roy Kim will be presenting Kaito, an operator streamlining AI/ML inference model deployment in Kubernetes. Discover how Kaito simplifies deployment of large open-source inference models like Falcon and LLAMA2. Learn its unique features: managing large model files with container images, preset GPU configurations, auto-provisioning GPU nodes, and hosting on Microsoft Container Registry (MCR). See how Kaito simplifies the workflow of onboarding large AI inference models in Kubernetes.

Learn more and develop your skills in Azure Kubernetes Service with this Microsoft Learn training module:
https://aka.ms/IntroToAKSLearn1

Přednášející

Části této stránky mohou být přeloženy strojově nebo AI.