Ми використовуємо файли cookie для нашого веб-сайту.Продовжуючи перегляд сайту, ви погоджуєтеся з використанням нами файлів cookie.

Головна Блог Новини Explore 2026: VMware AI Factory та ШІ-інновації у VCF

Explore 2026: VMware AI Factory та ШІ-інновації у VCF

Джерело: blogs.vmware.com

Хоча штучний інтелект відкриває трансформаційний потенціал, його впровадження на рівні підприємств залишається обмеженим. Конфіденційність, захист інтелектуальної власності (IP) та відповідність нормативним вимогам становлять серйозні екзистенційні загрози. Організації повинні забезпечувати деталізовані межі доступу та захищати власні дані. Стрімкий перехід до агентного штучного інтелекту значно посилює ці фундаментальні проблеми, створюючи критичні виклики для операційної діяльності, витрат і управління. На відміну від традиційних моделей інференсу (inference) із поодинокими викликами, автономні агенти працюють у динамічних циклах, що спричиняють непередбачуване, нелінійне зростання вартості токенів і перевантажують застарілу ІТ-інфраструктуру.

Нові виклики в епоху агентного ШІ

В епоху агентного ШІ компанії стикаються з додатковими викликами, які необхідно подолати.

  • Операційна складність: Навантаження агентного ШІ (Agentic workloads) поводяться інакше, ніж традиційні запити інференсу. Агенти об’єднують у ланцюжки десятки викликів моделей, інструментів та циклів міркування. Традиційна інфраструктура просто не була розрахована на такий тривалий, динамічний попит. Виклики розгортання включають:
    • Розгортання Day 0: обчислювальні ресурси, мережі, сховища даних, Kubernetes та мережева інфраструктура.
    • Експлуатація Day 2: управління життєвим циклом, включно з патчінгом, оновленням, версіонуванням моделей та міграцією фреймворків, перетворюється на безперервні паралельні цикли, а не окремі проекти.
  • Зростання вартості токенів: ШІ-агенти працюють у зациклених ітераціях, тому споживання токенів зростає нелінійно.  Насправді, за прогнозами, вартість токенів може зрости у 24 рази до 2030 року. Роздування контексту, комунікація між кількома агентами, виправлення помилок, рефлексія та підказки для внутрішнього розмірковування — це приклади того, чому витрати на токени непередбачувано зростають. Публічні хмарні LLM з оплатою за кожний токен зазнали несподіваного стрибка витрат.
  • Прогалини в управлінні (governance): Інженерні команди створюють додатки та розгортають автономних агентів швидше, ніж процеси конфіденційності, безпеки, управління та операційної діяльності встигають за ними. Це створило роздроблене середовище, де керівники можуть не мати централізованого уявлення про те, які саме моделі, інструменти та агенти використовуються і як саме інфраструктура повинна забезпечувати деталізовані механізми контролю доступу до конфіденційності, інфраструктури та даних, які обмежують те, до чого кожен агент може мати доступ і що може змінювати, навіть якщо сама базова модель є довіреною.

VMware Private AI Cloud

Щоб вирішити ці виклики, Broadcom представила VMware Private AI Cloud, що дозволяє підприємствам рентабельно масштабувати ШІ, працювати безпечніше та швидко впроваджувати інновації. Створена на основі передових програмних можливостей Broadcom, платформа VMware Private AI Cloud надає організаціям готовий до використання у продакшені шлях для безпечного створення, запуску та управління навантаженнями інференсу, агентними додатками та традиційними корпоративними робочими навантаженнями разом на VCF, пропонуючи широкий вибір апаратного забезпечення, моделей та прискорювачів.

  • Вигідно масштабуйте ШІ: VMware Private AI Cloud вирішує проблему трьох основних факторів витрат на ШІ: капітальних витрат на обладнання (CapEx), операційної складності та токеноміки (tokenomics).  VCF підтримує GPU, CPU та прискорювачі від провідних постачальників, а також серверне обладнання від основних OEM- та ODM-виробників, що дозволяє клієнтам економічно вигідно запускати гетерогенні кластери. Для оптимізації токеноміки та використання ресурсів вона пропонує моніторинг токенів, мультитенантне використання моделей (multi-tenant model sharing), розширене відстеження GPU/vGPU та дашборд спостережуваності метрик ШІ. Однією з ключових інновацій VMware Private AI Cloud є VMware AI Factory, що забезпечує швидкий шлях від розгортання на «чистому залізі» (bare metal) до першого розгортання моделі.
  • Працюйте безпечніше: Розроблений із застосуванням підходу глибинного захисту (defense-in-depth) відповідно до NIST CSF 2.0, VCF захищає від загроз, посилених ШІ, мінімізуючи площину атаки та забезпечуючи безперервну відповідність нормам. Автоматизовані оновлення без зупинки роботи підтримують системи в актуальному стані, тоді як VMware vDefend використовує віртуальне патчіння та горизонтальну безпеку (lateral security) на рівні гіпервізора з мікросегментацією для впровадження Zero Trust та блокування експлойтів. Крім того, багаторівневий захист від загроз vDefend та фаєрвол веб-додатків (WAF) і захист API від VMware Avi Load Balancer запобігають складним атакам.
  • Швидко впроваджуйте інновації в епоху агентного ШІ: На відміну від традиційних додатків, автономні ШІ-агенти можуть діяти безконтрольно, виходити за межі повноважень або неправильно тлумачити інструкції. Отже, довіра залежить від надійних контролів та цілісності даних. VMware Tanzu Platform разом із VMware vDefend надає основу для надійних корпоративних агентів завдяки архітектурі «заборонено за замовчуванням» (deny-by-default), попередньо налаштованому обв’язувальному середовищу (harness) та відібраному маркетплейсу.

Розглянемо детальніше VMware AI Factory — ключову інновацію в VMware Private AI Cloud.

VMware AI Factory: рушійна сила VMware Private AI Cloud

VMware AI Factory — це програмно-визначена основа VMware Private AI Cloud. Вона надає клієнтам спрощений шлях до продуктивного ШІ завдяки новим інноваціям автоматизації для розгортання інфраструктури, готової до ШІ, та підтримки операцій Day 2. Завдяки VMware AI Factory клієнти можуть швидше перейти до першого розгортання моделі та краще керувати токеномікою ШІ.

VMware AI Factory переносить ШІ-додатки безпосередньо до приватних даних підприємства у безпечному середовищі приватної хмари. Унікальні можливості автоматизації інфраструктури VCF дозволяють скоротити час від розгортання сервера на bare metal до обслуговування першої ШІ-моделі з кількох тижнів до лічених годин. VMware AI Factory оптимізує управління ШІ-інфраструктурою шляхом повної автоматизації виділення апаратних ресурсів (provisioning), активації програмного стеку та наскрізного управління життєвим циклом. Інтегруючи операції з апаратним та програмним забезпеченням у єдине автоматизоване рішення, організації можуть стрімко масштабувати навантаження ШІ, мінімізуючи операційну складність.

Щоб зробити побудову IT-інфраструктури швидкою та бепзпечною, довірте розгортання VCF професіоналам. Зверніться за консультацією до експертів Wise IT — офіційного партнера VMware by Broadcom, щоб спроєктувати надійну та оптимізовану інфраструктуру для ваших інновацій. Зв’яжіться з нами вже сьогодні та розкрийте потенціал штучного інтелекту для вашого бізнесу без зайвих ризиків:

Партнерства, що забезпечують роботу VMware AI Factory  

VMware AI Factory поєднує VCF із сертифікованими серверами Dell PowerEdge та VCF AI ReadyNodes від Cisco, Lenovo, Supermicro та інших,  а також із бажаним програмним забезпеченням ШІ та архітектурами прискорювачів клієнтів. 

Broadcom та AMD співпрацюють над створенням VMware AI Factory, що поєднує VCF із графічними процесорами AMD Instinct та відкритою програмною екосистемою AMD ROCm. Автоматичне розгортання без утручання (zero-touch provisioning) оркеструватиме наскрізне розгортання всього стеку: від vSphere і vSAN до Kubernetes та оператора AMD GPU, а драйвер AMD DVX зможе приєднувати GPU до великих VM, які використовуються кластером VMware vSphere Kubernetes Service.

Щоб ще більше спростити розгортання VCF AI Factory, Broadcom оголосила про нове партнерство з MetalSoft для надання інтегрованої гетерогенної автоматизації bare metal для VCF, яка скорочує час надання фізичних серверів з тижнів до хвилин. Ця інтеграція допоможе ІТ-фахівцям розгортати або повністю переналаштовувати (repave) фізичні сервери від різних постачальників безпосередньо через консоль управління VCF, об’єднуючи життєвий цикл програмного та апаратного забезпечення в єдину операційну модель та усуваючи потребу у вендорозалежних інструментах для управління обладнанням і прошивками.

Нові можливості в VMware AI Factory  

Послуги VMware Cloud Foundation (VCF) Private AI Services допомагають зробити ШІ операційним, керованим та економічно вигідним і входять до складу VCF. VMware by Broadcom продовжує розширювати кількість послуг, що пропонуються через VCF Private AI Services. Розглянемо ці можливості детальніше.

Загальнодоступні (Generally Available)

Мультитенантне використання моделей (Multi-tenant Model Sharing)

У релізі VCF 9.1.1 середовище виконання моделей (Model Runtime) було вдосконалено, що дозволяє безпечно використовувати ШІ-моделі між тенантами або окремими бізнес-підрозділами у їхніх просторах імен (namespaces), зберігаючи при цьому повну конфіденційність даних для кожного з них. На практиці це означає, що підприємства та постачальники хмарних послуг тепер можуть мати одну службу Model Runtime, яка запускає та масштабує моделі для всієї організації, а кожна команда чи підрозділ може мати окремі приватні та безпечні простори імен для своїх конфіденційних даних. Ця можливість усуває потребу в розгортанні надлишкових копій моделі, що призводило до марного витрачання ресурсів GPU та інфраструктури. Вона також підтримує конфіденційність та ізоляцію даних, оптимізуючи сукупну вартість володіння (TCO).

Можливості майбутніх релізів

ШІ-шлюз (AI Gateway)

Щоб збалансувати сучасні потреби в оптимізації вартості токенів, сценаріях використання та продуктивності, підприємствам потрібні як хмарні, так і локальні (on-premises) моделі. Хмарні LLM можуть мати високе споживання токенів, тому управління має першочергове значення. Функціонал AI Gateway суттєво допоможе у вирішенні цих компромісних завдань. Розглянемо деталі: 

  • Інтелектуальна маршрутизація промптів: динамічно розподіляє вхідні запити між найбільш відповідними локальними або хмарними моделями на основі таких факторів, як сценарії використання, доменна спеціалізація та вартість токенів для оптимізації продуктивності.
  • Обмеження використання та токенів: обмеження використання та токенів на рівні користувача допомагає мінімізувати споживання токенів.
  • Авторизація додатків: ідентифікує додаток, що надсилає запит, перед маршрутизацією промпту. AI Gateway використовує авторизацію на основі токенів OpenID Connect для забезпечення контролю доступу.

Фреймворк безпеки агентів (Secure Agent Framework)  

Автономні ШІ-агенти динамічно генерують та виконують код, що створює значні ризики безпеки за відсутності суворого контролю. Непідконтрольний агент без детермінованих обмежень щодо доступу може випадково виконати катастрофічні команди, такі як видалення віртуальних машин або знищення локальних баз даних, як було продемонстровано тестовими агентами кількох постачальників хмарного ШІ, які вийшли з-під контролю. 

Ми випустимо 2 суміжні можливості для забезпечення контролю та захисту ШІ-агентів:

  • Пісочниця (Sandboxing): це створить безпечний віртуалізований контейнерний простір, де динамічно згенерований агентом код ізолюється та виконується без впливу на загальне середовище.
  • Обв’язувальне середовище агента (Agent Harness): це створить шар управління, який визначає, як викликаються агенти, до яких інструментів вони мають доступ, як вони взаємодіють між собою та як їхні результати перевіряються перед виконанням дій.

Автомасштабування моделей (Model Autoscaling)

Навантаження ШІ не можуть динамічно реагувати на раптові сплески запитів або агентні цикли. Щоб вирішити це, ми впроваджуємо автомасштабування моделей (Model Autoscaling). Завдяки цій можливості адміністратор або оператор ШІ зможе встановити порогові значення для затримки (latency) та сесій, і модель ШІ автоматично масштабуватиметься при досягненні цих порогів для дотримання SLA затримки та продуктивності. Коли використання падає нижче порогу, навантаження масштабується у бік зменшення.

Завдяки цій можливості підприємства отримають підвищення продуктивності та нижчу TCO завдяки масштабуванню на основі подій, яке утримує низьку затримку токенів і запобігає надлишковому виділенню ресурсів GPU. Організації зможуть додатково оптимізувати свої інвестиції в ШІ завдяки більш ефективному спільному використанню дорогих ресурсів GPU між різними навантаженнями.

Додаткові інновації ШІ та анонси з Explore  

Підтримка широкого спектра моделей від Broadcom через VCF

Сфера ШІ стрімко розвивається та вимагає наявності різноманітних моделей. Потреба в різноманітності ШІ-моделей виникає через кілька факторів, таких як конфіденційність, безпека, управління, вартість токенів, спеціалізація та доменна експертиза. 

Broadcom прагне допомогти підприємствам подолати ці фактори, підтримуючи моделі з відкритими ваговими коефіцієнтами (open-weight models) та суто комерційні рішення. VMware AI Factory надає підприємствам готовий до використання шлях для запуску провідних ШІ-моделей локально. Використання vLLM як середовища виконання моделей за замовчуванням дає клієнтам можливість запускати понад 150 моделей з відкритим вихідним кодом, оптимізованих за продуктивністю на VCF. Сьогодні Broadcom оголошує, що наступні моделі пройшли тестування для запуску на VCF:

  • Nemotron 3: Сімейство відкритих мультимодальних моделей NVIDIA Nemotron 3 забезпечує провідну точність та ефективність, допомагаючи агентам швидше виконувати завдання. Поєднуючи гібридну архітектуру Mamba-Transformer MoE, контекстне вікно на один мільйон токенів та навчання з підкріпленням у кількох середовищах, Nemotron 3 забезпечує масштабовані, тривалі агентні робочі процеси в корпоративних додатках.
  • Gemma 4: Найновіше сімейство мультимодальних моделей від Google DeepMind з відкритим вихідним кодом та відкритими ваговими коефіцієнтами, створене спеціально для розробників та дослідницької спільноти для забезпечення локального виконання, що дозволяє підприємствам створювати та розгортати автономних ШІ-агентів.
  • cotomi: Власна ШІ-модель NEC, оптимізована для японської мови, навчена на відібраних, високонадійних наборах даних. Вона розширює можливості підприємств, плавно поєднуючи високошвидкісну обробку з покращенням ефективності токенів на 40%.
  • Qwen3.8-27B: Модель Qwen3.8-27B від Alibaba — це щільна (dense) візуально-мовна модель з відкритими вагами серії Qwen. Вона підходить для написання коду, професійних робочих процесів, досліджень, мультимодальної взаємодії та тривалих завдань агентів, із гнучким мисленням, яке можна вмикати або вимикати. Це нативна мультимодальна щільна модель із 27 мільярдами параметрів, розроблена для ефективного локального розгортання та комерційного використання.
  • GLM 5.2: Загальна мовна модель (General Language Model) з відкритим вихідним кодом від Z.ai (раніше Zhipu AI) дозволяє підприємствам розгортати агентів для написання коду та міркування локально для багатокрокових автономних робочих процесів із забезпеченням суверенітету даних та оптимальної продуктивності обладнання.

VCF отримує сертифікацію NVIDIA: підтверджено продуктивність навантажень ШІ на рівні, близькому до bare metal

Нещодавно NVIDIA запустила програму NVIDIA-Certified Hypervisors. Ця програма сертифікує, що гіпервізори, включені до неї, працюють з продуктивністю, близькою до рівня «чистого заліза» (bare metal) для навантажень ШІ та високопродуктивних обчислень (HPC).

VMware vSphere 9.1 (і всі майбутні релізи vSphere 9) отримали сертифікацію NVIDIA-Certified Hypervisor. Навантаження ШІ та HPC на VCF тепер сертифіковані для роботи з продуктивністю, близькою до bare metal. Ця сертифікація дозволяє клієнтам упевнено використовувати VCF як оптимізовану за продуктивністю платформу приватної хмари з підтримкою основних партнерів екосистеми для забезпечення роботи ШІ та прискорених обчислювальних додатків у корпоративних центрах обробки даних.

Партнери, додані до екосистеми VCF Private AI Services

VMware by Broadcom продовжує зміцнювати екосистему ШІ для підприємств. Окрім базових функцій, VCF Private AI Services розширює свій вплив завдяки новим стратегічним союзам:

  • Appian: Appian забезпечує автоматизацію ШІ для критично важливих завдань, автоматизуючи складні процеси у великих підприємствах та державних установах. Платформа Appian відома своєю унікальною надійністю та масштабованістю, підкріпленими понад 25-річним глибоким досвідом у корпоративних операціях. Документація з встановлення Appian на VCF.
  • ClearML: ClearML надає рівень оркестрації ШІ для керування доступом до GPU, моделями та агентами у VMware Cloud Foundation. Це підвищує ефективність використання GPU та знижує вартість запуску робочих навантажень ШІ, надаючи підприємствам вбудований шлях до ШІ як послуги (AI-as-a-Service). Дізнайтеся більше про ClearML тут.
  • Eve Security:  Eve забезпечує управління, спостережуваність та контроль під час виконання (runtime control), необхідні підприємствам для безпечного масштабування ШІ-агентів. Завдяки наявності агента в контурі (agent in the loop) вона автоматично перевіряє високоризикову або аномальну діяльність, збагачує рішення контекстом із систем ідентифікації, DLP та базових систем, а також застосовує заходи контролю в режимі реального часу за потреби. Дізнайтеся більше про Eve Security тут. 
  • Solo.io: створює агентну інфраструктуру з відкритим вихідним кодом для підприємств, які використовують ШІ у продакшені. Середовище виконання kagent та площина даних (data plane) agentgateway дають платформам можливість розгортати ШІ-агентів та управління кожною моделлю, інструментом та викликом між агентами на власній інфраструктурі. Для отримання додаткової інформації про Solo.io та Broadcom прочитайте цей допис.
  • TrueFoundry: TrueFoundry надає ШІ-шлюз (AI Gateway) корпоративного рівня, який включає LLM Gateway, MCP Gateway та Agent Gateway, дозволяючи підприємствам підключати, спостерігати та управляти агентними ШІ-додатками від різних постачальників із єдиної площини управління (control plane). Додаткові деталі про TrueFoundry дивіться тут.

Щоб зробити побудову IT-інфраструктури швидкою та бепзпечною, довірте розгортання VCF професіоналам. Зверніться за консультацією до експертів Wise IT — офіційного партнера VMware by Broadcom, щоб спроєктувати надійну та оптимізовану інфраструктуру для ваших інновацій. Зв’яжіться з нами вже сьогодні та розкрийте потенціал штучного інтелекту для вашого бізнесу без зайвих ризиків: