Itinai.com it development details code screens blured futuris c6679a58 04d0 490e 917c d214103a6d65 1

Новая модель регрессии Google AI для предсказания производительности промышленных систем

Itinai.com it development details code screens blured futuris c6679a58 04d0 490e 917c d214103a6d65 1

Преобразование прогнозирования производительности промышленных систем с помощью RLM от Google AI

Современные промышленные системы требуют точных прогнозов производительности для оптимизации работы и снижения затрат. Однако традиционные методы часто сталкиваются с трудностями, связанными с необходимостью обширной обработки данных и жесткими форматами. Здесь на помощь приходит новая модель регрессии от Google AI — Regression Language Model (RLM), которая позволяет предсказывать производительность систем непосредственно из сырых текстовых данных.

Проблемы традиционного прогнозирования

Прогнозирование производительности крупных промышленных систем, таких как вычислительные кластеры Google, требует значительных усилий по обработке данных. Логи, конфигурационные файлы и данные о нагрузках сложно адаптировать для классических регрессионных моделей. Это приводит к тому, что оптимизация и моделирование становятся медленными и затратными, особенно при изменении типов нагрузок или аппаратного обеспечения.

Основная идея: текстовая регрессия

Модель RLM переосмысляет регрессию как задачу генерации текста. Все данные о состоянии системы, включая конфигурации, логи и профили нагрузки, преобразуются в структурированные текстовые форматы, такие как YAML или JSON. Модель регрессии выдает числовые показатели, такие как метрики эффективности, в виде текстовых строк.

  • Отсутствие необходимости в табличных признаках: Этот подход исключает необходимость в предопределенных наборах признаков и нормализации.
  • Универсальная применимость: Любое состояние системы может быть представлено в виде строки, что позволяет поддерживать гетерогенные и динамически развивающиеся характеристики.

Технические детали: архитектура и обучение

Модель RLM использует относительно небольшой энкодер-декодер (60 миллионов параметров), который обучается с помощью кросс-энтропийной потери на строковых представлениях входных и выходных данных. Модель не предварительно обучена на общих языковых моделях, что позволяет начать обучение с случайной инициализации и сосредоточиться на корреляции состояний системы с числовыми результатами.

  • Эффективная токенизация: Результаты токенизируются для представления чисел с плавающей запятой в словаре модели.
  • Быстрая адаптация: Предобученные RLM могут быть быстро адаптированы к новым задачам с минимальным количеством примеров.
  • Обработка длинных последовательностей: Модели могут обрабатывать очень длинные текстовые вводы, что обеспечивает полное наблюдение за сложными состояниями.

Результаты на кластере Borg

Тестирование на кластере Borg показало, что RLM достигает корреляции Спирмена до 0.99 между предсказанными и истинными значениями метрик производительности. Модели также позволяют количественно оценивать неопределенность, поддерживая вероятностное моделирование систем и байесовскую оптимизацию.

Сравнение RLM с традиционной регрессией

Модель RLM предлагает значительные преимущества по сравнению с традиционными методами:

  • Формат данных: Структурированный текст против плоских тензоров.
  • Обработка признаков: Отсутствие необходимости в ручной обработке.
  • Адаптивность: Высокая адаптивность к новым условиям.
  • Производительность: Почти идеальные ранговые показатели.
  • Неопределенность: Полный спектр оценки неопределенности.

Применения и выводы

RLM имеет значительные приложения в различных областях:

  • Облачные вычисления: Прямое прогнозирование производительности для динамичной инфраструктуры.
  • Производство и IoT: Универсальные симуляторы для предсказания результатов в различных промышленных процессах.
  • Научные эксперименты: Моделирование, где входные состояния сложны и разнообразны.

Этот новый подход, рассматривающий регрессию как языковое моделирование, устраняет давние барьеры в моделировании систем, позволяет быстро адаптироваться к новым условиям и поддерживает надежные предсказания с учетом неопределенности. Это особенно важно для следующего поколения промышленных ИИ.

Новости в сфере искусственного интеллекта