Eigen RadarYapay Zekâ
Analiz

Broadcom, tesis içi çıkarım için VMware Private AI Cloud'u tanıttı

Broadcom, çıkarım yüklerini, eylemci uygulamalarını ve klasik kurumsal yükleri tek bir özel bulut platformunda çalıştıran VMware Private AI Cloud'u VMware Explore'da tanıttı. Yazılım tanımlı temel VMware AI Factory. Şirket, müşterilerin kendi tesislerinde 150'den fazla modeli çalıştırabileceğini söylüyor. Microsoft'un Foundry model yönlendiricisi ise istekleri gidere, niteliğe ya da gecikmeye göre dağıtarak küresel standart dağıtımlarda 2 bölgeden 28 bölgeye, veri bölgesi dağıtımlarında 21 bölgeye çıktı ve model havuzuna Claude Opus 4.8 ile GPT-5.6 ailesini ekledi.

Yapay Zekâ··Gece
Kapıdan görülen aydınlık makine odasında farklı sunucu dolapları arasındaki kaldırılmış zemin karosu, altındaki renkli kabloları ve yanındaki kaldırma aracını gösteriyor.

Tesiste 150'den fazla model

Broadcom, VMware Explore'da VMware Private AI Cloud'u tanıttı: çıkarım yüklerini, eylemci uygulamalarını ve klasik kurumsal yükleri tek bir özel bulut platformunda çalıştıran bir yığın. Yazılım tanımlı temeli, VMware Explore'da duyurulan VMware AI Factory. Şirket, VMware Cloud Foundation 9'un NVMe bellek katmanlaması ve küme genelinde yinelenen veri ayıklamasıyla donanım giderini düşürdüğünü, ayrıca belirteç izleme, çok kiracılı model paylaşımı ve bir ölçüm panosu eklediğini söylüyor. Müşteriler kendi tesislerinde 150'den fazla açık kaynaklı ve ticari modeli çalıştırabiliyor; aralarında Nemotron 3, Gemma 4, cotomi, Qwen 3.7-Max ve GLM 5.2 var. Güvenlik tarafında vDefend mikrobölütlemesi, Avi Load Balancer'ın web uygulaması güvenlik duvarı ve doğrulanabilir biçimde derlenmiş açık kaynak paketleri sunan TrueSource yer alıyor. Gider ve başarım anlatımı şirketin kendi bildirimi ve Las Vegas'taki konferansla birlikte yayımlandı.[1]

Foundry yönlendiricisi 2 bölgeden 28'e

İstekleri gidere, niteliğe ya da gecikmeye göre farklı modeller arasında dağıtan Foundry model yönlendiricisi, küresel standart dağıtımlarda 2 bölgeden 28 bölgeye, veri bölgesi dağıtımlarında ise 21 bölgeye genişledi. Model havuzu da yenilendi: Anthropic'in Claude Opus 4.8 modeli ile GPT-5.6 ailesi eklendi; ömrünü tamamlayan gpt-5-chat, gpt-5.2-chat, gpt-5.3-chat ve DeepSeek-V3.1 havuzdan çıkarıldı. Microsoft'a göre uç nokta sabit kaldığı için ekiplerin güncellemeyi almak üzere yönlendiriciyi yeniden dağıtması gerekmiyor. Bir Azure MVP'si, arayüzün sabit kalmasıyla davranışın sabit kalmasının ayrı şeyler olduğunu, yeni modellerin yanıt örüntülerini değiştirebileceğini söylüyor. Claude modelleri, yönlendiricinin erişebilmesi için aynı Foundry hesabına ayrıca dağıtılmak zorunda.[2]

Özel bulut yığını ve Azure yönlendiricisi

VMware Private AI Cloud, müşterinin tesisinde 150'den fazla modeli, çıkarım yüklerini ve eylemci uygulamalarını bir özel bulut yığınında tutuyor. Foundry model yönlendiricisi ise istekleri gidere, niteliğe ya da gecikmeye göre 28 küresel standart bölgede modeller arasında dağıtıyor ve havuza Claude Opus 4.8 ile GPT-5.6 ailesini ekliyor. İkisi de kurumun birçok model arasından nasıl geçeceğini yöneten bir denetim katmanı olarak duruyor olabilir; VMware yığını tesis içi özel bulutta kalırken Foundry yönlendiricisi Azure uç noktası olarak da ayrı duruyor olabilir. Claude modellerinin Foundry hesabına ayrıca dağıtılması, yönlendiricinin o modellere kendiliğinden ulaşmadığını gösteriyor.[1], [2]

Kaynakça

  1. Haber kaynağıBroadcomBroadcom, VMware Explore'da VMware Private AI Cloud'u tanıttı↩1↩2
  2. Haber kaynağıInfoQMicrosoft'un Foundry model yönlendiricisi 2 bölgeden 28 bölgeye çıktı↩1↩2