Ir al contenido principal

Exploring Kaito to streamline AI inference model deployment in Azure Kubernetes

julio 16, 2024 | 9:00 - 10:00 p. m. (UTC) Hora universal coordinada

¿Está listo para empezar a trabajar con la inteligencia artificial y las tecnologías más recientes? Microsoft Reactor proporciona eventos, formación y recursos comunitarios para ayudar a los desarrolladores, empresarios y startups a basarse en la tecnología de inteligencia artificial y mucho más. ¡Acompáñenos!

Exploring Kaito to streamline AI inference model deployment in Azure Kubernetes

julio 16, 2024 | 9:00 - 10:00 p. m. (UTC) Hora universal coordinada

¿Está listo para empezar a trabajar con la inteligencia artificial y las tecnologías más recientes? Microsoft Reactor proporciona eventos, formación y recursos comunitarios para ayudar a los desarrolladores, empresarios y startups a basarse en la tecnología de inteligencia artificial y mucho más. ¡Acompáñenos!

Volver

Exploring Kaito to streamline AI inference model deployment in Azure Kubernetes

julio 16, 2024 | 9:00 - 10:00 p. m. (UTC) Hora universal coordinada

  • Formato:
  • alt##LivestreamLivestream

tema del evento: Infraestructura para IA

Idioma: Inglés

About this session:
Roy Kim will be presenting Kaito, an operator streamlining AI/ML inference model deployment in Kubernetes. Discover how Kaito simplifies deployment of large open-source inference models like Falcon and LLAMA2. Learn its unique features: managing large model files with container images, preset GPU configurations, auto-provisioning GPU nodes, and hosting on Microsoft Container Registry (MCR). See how Kaito simplifies the workflow of onboarding large AI inference models in Kubernetes.

Learn more and develop your skills in Azure Kubernetes Service with this Microsoft Learn training module:
https://aka.ms/IntroToAKSLearn1

Oradores

Partes de esta página pueden estar traducidas por máquina o IA.