Представляем Fireworks AI в Microsoft Foundry: высокопроизводительный вывод открытой модели с малой задержкой в ​​Azure

Мы объявляем об общедоступной предварительной версии Fireworks AI на Microsoft Foundry, которая обеспечивает высокопроизводительный вывод открытых моделей в Azure. Эта интеграция отражает более широкое направление Microsoft Foundry: предоставление единого места, где разработчики могут не только эффективно запускать открытые модели, но также настраивать и внедрять их в рамках полного жизненного цикла искусственного интеллекта, готового к использованию на предприятии.

В разных отраслях организации все активнее стандартизируют открытые модели, чтобы получить больший контроль над производительностью, стоимостью, настройкой, а также безопасностью и соответствием требованиям, необходимыми для корпоративного развертывания. Открытые модели дают командам возможность выбирать правильную архитектуру для каждой рабочей нагрузки и избегать привязки к одному поставщику моделей по мере развития их потребностей.

Однако по мере роста внедрения одной производительности уже недостаточно. Командам нужен единый способ быстрой оценки моделей, их безопасной эксплуатации в производстве и постепенного улучшения без перестройки инфраструктуры или фрагментации инструментов. Слишком часто организации вынуждены собирать индивидуальные стеки обслуживания, замедляя инновации и затрудняя масштабирование и усугубление прогресса.

Microsoft Foundry призвана решить эту проблему. Он служит единой системой учета и управления предприятием для ИИ, объединяя модели, агенты, оценку, развертывание и управление в едином интерфейсе. С помощью Microsoft Foundry команды могут уверенно переходить от экспериментов к производству, используя модели и платформы, которые лучше всего соответствуют их требованиям, полагаясь при этом на последовательную операционную основу.

Сегодня мы объявляем об общедоступной предварительной версии Fireworks AI на Microsoft Литейный заводобеспечивая высокопроизводительный вывод открытых моделей в Azure. Эта интеграция отражает более широкое направление Microsoft Foundry: предоставление единого места, где разработчики могут не только эффективно запускать открытые модели, но также настраивать и внедрять их в рамках полного жизненного цикла искусственного интеллекта, готового к использованию на предприятии.

Read more:  «ИИ угрожает рабочим местам, но не всем»

Модели Fireworks AI в Microsoft Foundry: единое место для открытых моделей

Fireworks AI обеспечивает лучший в отрасли вывод для открытых моделей, а Microsoft Foundry позволяет использовать эту производительность в масштабе предприятия. Доступ к ИИ Fireworks через Microsoft Foundry дает командам единую надежную плоскость управления для оценки, развертывания, настройки и эксплуатации открытых моделей вместе с остальным стеком ИИ.

По мере развития открытых моделей кастомизация все больше выходит за рамки обучения. Командам нужны последовательные способы настройки, развертывания, оптимизации, управления и итерации моделей в рабочей среде без фрагментации инструментов или инфраструктуры. Microsoft Foundry предоставляет среду, в которой эти рабочие процессы настройки и эксплуатации стандартизированы, а Fireworks AI обеспечивает производительность и эффективность, необходимые для запуска открытых моделей в большом масштабе. Это означает, что команды могут переходить от экспериментов к производству, используя открытые модели, не объединяя воедино отдельные инструменты, контракты и пути развертывания.

Вместе Fireworks AI и Microsoft Foundry обеспечивают более полный и устойчивый подход к работе с открытыми моделями, сочетающий быстрый и эффективный вывод с платформой, предназначенной для поддержки операций с открытыми моделями предприятия с течением времени.

С помощью Fireworks AI в Foundry разработчики могут получите доступ к лучшим в своем классе средствам вывода для открытых моделейвключая оптимизированное развертывание для моделей настраиваемого веса. Fireworks AI — лидер рынка высокопроизводительных логических выводов для открытых моделей. Его механизм уже работает в масштабах Интернета, обрабатывая более 13Т токенов ежедневно, поддерживая около 180 тысяч запросов в секунду и генерируя более 1000 токенов в секунду на крупных моделях, что подтверждается ведущими показателями производительности на Искусственный анализ. Это представление теперь доступно на Foundry.

Разработчики могут войти в Foundry и получить доступ к этим открытым моделям с помощью Fireworks AI уже сегодня:

  • ДипСик V3.2
  • OpenAI gpt-oss-120b
  • Как К2.5
  • МиниМакс М2,5 (новый)

Благодаря этому в Foundry появилась новая открытая модель (MiniMax M2.5) с бессерверной поддержкой и оптимизированный вывод для уже популярных открытых моделей.

Read more:  Победа зеленых на дополнительных выборах показывает, что избирательная система Великобритании опускается до статуса третьего мира, говорит Найджел Фарадж

С помощью Fireworks AI в Microsoft Foundry разработчики могут:

  • Оценивайте модели быстрее благодаря доступу и поддержке с самого начала: Начните разработку немедленно, получив доступ к новейшим открытым моделям Fireworks AI через единую конечную точку Azure через Foundry.
  • Оптимизировать вывод: Запросы на открытие моделей обслуживаются высокопроизводительным стеком вывода Fireworks, что обеспечивает высокую производительность и управление на уровне Azure.
  • Запустите модели, которым вы уже доверяете: С помощью «принеси свои веса» (BYOW) вы можете загружать и регистрировать квантованные или точно настроенные веса, обученные где-то еще, не меняя стек обслуживания.
  • Выберите правильную модель ценообразования для вашей рабочей нагрузки: используйте бессерверный вывод с оплатой за токен, чтобы безопасно и быстро экспериментировать с Стандарт зоны данных или выберите подготовленные единицы пропускной способности (PTU) для предсказуемой стабильной производительности с базовыми или настраиваемыми моделями. Независимо от того, оптимизируете ли вы гибкость или эффективность, вы получаете гибкость без управления инфраструктурой.
  • Работайте с корпоративным доверием и масштабированием: Мы стремимся предоставить клиентам возможность быстро создавать готовые к использованию приложения искусственного интеллекта, сохраняя при этом высочайший уровень безопасности. Foundry предоставляет комплексное рабочее пространство для разработки, оценки и развертывания агентов, включая унифицированное управление, возможность наблюдения и готовые инструменты для агентов.

Будущее Fireworks и варианты использования искусственного интеллекта

Microsoft Foundry развивается, чтобы поддерживать полный жизненный цикл открытых моделей — от ранней оценки до производственной эксплуатации и постоянной оптимизации. По мере того как команды масштабируют использование открытых моделей, наличие согласованной, готовой к корпоративному использованию основы становится все более важным.

Интегрировав Fireworks AI в Microsoft Foundry, разработчики сегодня получают доступ к высокопроизводительным выводам, одновременно создавая платформу, предназначенную для поддержки более глубокой настройки и корпоративных операций с течением времени. Такой подход дает командам уверенность в том, что они смогут применять открытые модели не только для того, что они могут делать сейчас, но и для того, как они могут расти, адаптироваться и надежно работать по мере расширения их амбиций в области ИИ. Мы с нетерпением ждем возможности увидеть, как разработчики и предприятия используют искусственный интеллект Fireworks в Microsoft Foundry для создания интеллектуальных приложений следующего поколения.

Read more:  Межсетевые экраны LLM становятся новым уровнем безопасности ИИ

Чтобы начать:

  1. Перейти к Microsoft Литейный завод модели и выберите открытые модели Fireworks AI в коллекции каталога моделей.
  2. Выберите открытую модель, размещенную в Fireworks.
  3. Посмотреть карточку модели.
  4. Выберите вариант развертывания — бессерверное или PTU — и выполните развертывание.

Узнайте больше о Fireworks в Microsoft Foundry.

2026-03-11 18:20:00


1773309476
#Представляем #Fireworks #Microsoft #Foundry #высокопроизводительный #вывод #открытой #модели #малой #задержкой #Azure

По теме

Leave a Comment

This site uses Akismet to reduce spam. Learn how your comment data is processed.