Openai идет против LLAM и DeepSeek. Он выпускает две открытые модели ИИ, которые каждый может использовать – živě.cz

Openi еще раз получила свое имя и публикует что -то открытое. Модели с открытым исходным кодом, выпущенные по лицензии Apache 2.0 GPT-OS-120B а GPT-OSS-20BПолем Оба могут быть загружены и использованы без ограничений для коммерческих целей, но также доступны веб -версияПолем

GPT-OS-12B использует 117 миллиардов параметров, а GPT-OS-20B-21 миллиард. Но они не все доступны одновременно. OpenAI использует метод MOE (смеси экспертов), который также можно найти в открытых альтернативах LLAM 4, DeepSeek или Mistral. Входные данные не обрабатывают одну большую нейронную сеть, а несколько небольших экспертов с различными специализациями. Затем специальный маршрутизатор позаботится о том, какая запись отправит эксперту. Те специализированные могут быть десятки или сотни.

Большая из моделей на токен провоцирует 4 эксперта (из 128) и работает с 5,1 миллиардами параметров. Меньшие также будут использовать 4 эксперта (из 32), но с 3,6 миллиардами параметров на токен. Контекстное окно имеет 128 тысяч токенов на обеих моделях. Согласно Openai, более крупная модель может быть запускается на ускорителях с 80 ГБ памяти, меньше до 16 ГБ, поэтому ее можно дешево использовать в домашних условиях.

Openai снова открыт

Компания выпускает модели с открытым исходным кодом для шепота для транскрипции речи в текст или клипа, чтобы распознать изображения. Однако из языковых моделей с открытым исходным кодом был последний GPT-2 с 2019 года.

Компания утверждает, что модели, обученные в основном на наборах текстовых данных и английском языке. Но то, какие наборы данных обучались GPT-OSS, уже секрет.

Оба, кстати, рассмотрим (используйте REAPSONING) и в общих критериях для достижения производительности, сравнимой с проприетарными моделями O3-Mini и O4-Mini. “GPT-OS-20B преодолевает OpenAI O3-Mini и преодолевает или преодолевает OpenAI O4-Mini в конкурентном программировании (CodeForces), общее решение проблем (MMLU и Vise) и использование инструментов (Taubench). Кроме того, он делает даже лучше, чем O4-Mini в вопросах здоровья (HealthBench) и в конкурентной математике (AIME 2024 и 2025). Несмотря на его небольшой размер, GPT-OS-20B равен или преодолевается OpenAI O3-Mini в тех же тестах и даже преодолевает его в конкурентной математике и темах здоровья,“Openai говорит.

OpenAI работал над оптимизацией с NVIDIA, AMD, Cerebras и Groq. Microsoft даже готовится к Windows меньше GPT-OS-20B, модифицированной для работы на обычных компьютерах. Nvidia заявляет, что GeForce RTX 5090 обрабатывает до 250 токенов в секунду. Это около 190 слов на английском языке.

Read more:  Tech & Learning объявляет даты проведения серии региональных саммитов лидеров в 2026 году

Источники и другая информация: Openai

2025-08-06 10:44:00


1754496226
#Openai #идет #против #LLAM #DeepSeek #Он #выпускает #две #открытые #модели #ИИ #которые #каждый #может #использовать #živě.cz

Ещё по этой теме

Leave a Comment

This site uses Akismet to reduce spam. Learn how your comment data is processed.