Промышленное внедрение, а не пилоты, теперь определяет корпоративный ИИ. На симпозиуме Dell Technologies AI Leadership Symposium в Сан-Хосе аналитики и поставщики заявили, что спор сместился с моделей и GPU к вопросам, кто контролирует ИИ, где он работает и по чьим правилам действует. Dell сообщила о поставке 350 стоек за две недели благодаря партнерству с производителями чипов, и это показывает, что скорость развертывания и стоимость эксплуатации важнее экспериментов.
Как обсуждали внедрение, голос и агентов
Dell Technologies переносит акцент с proof-of-concept на промышленные внедрения при поддержке экосистемы, которая теперь охватывает и венчурный капитал. Шон О’Коннор, региональный менеджер Dell по крупным корпоративным клиентам, связал это преимущество с давним партнерством с производителями чипов, которое позволило отгрузить 350 стоек за две недели. Смысл в том, что поставки в масштабе стоек зависят от партнеров, а не только от наличия оборудования.
Deepgram обучает свои модели speech-to-text, text-to-speech и голосовых агентов на инфраструктуре Dell, при этом значительная часть клиентов размещает эти модели самостоятельно. Ник Манн, технический программный менеджер Deepgram, сказал, что следующий шаг — нативный запуск моделей в изолированном режиме на ноутбуках с поддержкой ИИ. Такая схема переносит обработку голоса туда, где работают люди, без постоянного соединения с центром обработки данных.
Управление во время выполнения становится условием для корпоративных ИИ-агентов. Виктор Якубюк из MisaLabs, Шив Агарвал из Singulr AI и Шри Вишванат из Sycamore Labs заявили, что предприятия хотят удерживать агентов в собственных virtual private cloud. Контроль смещается от фиксированных правил к наблюдению за поведением агентов в реальном времени, и причина — постоянно работающие автономные агенты. Sycamore Labs входит в число стартапов, которые привлекают средства на создание слоев управления для агентов.
Что это значит для бюджетов на ИИ
Расходы на токены меняют место выполнения нагрузок. Хелен О’Салливан из Dell и Тим Вуд из Intel сообщили, что клиенты, расходующие месячные бюджеты на токены за недели, тестируют нагрузки в собственной инфраструктуре. Совмещение данных и ИИ, включая AI PC, снижает эти регулярные платежи. Для компаний это означает более широкий выбор между публичными API и собственным инференсом.
CPU возвращается в архитектуру агентного ИИ. Dell и Intel связали этот сдвиг с агентами, которые координируют инструменты, обращаются к данным и работают длительное время, а не выполняют одну крупную задачу обучения. Небольшие компании ощутят это через AI PC и модели с самостоятельным размещением, а крупные — через планирование стоек, контроль частных облаков и тесную работу с поставщиками чипов. При выборе поставщика теперь важны сроки поставки и поддержка экосистемы.
Индикатором станет то, превратятся ли локальные тесты в постоянный перенос нагрузок. Если все больше голосовых моделей и агентов останется в частных облаках, на локальных серверах или на изолированных ноутбуках после перерасхода бюджетов на токены, стоимость и контроль зададут следующий стандарт развертывания. theCUBE, платный медийный партнер мероприятия, сообщил о скорой публикации полных интервью с симпозиума, которые покажут, какие проекты перешли этот рубеж.
