Компания OpenAI продолжает расширять свои разработки в области искусственного интеллекта, запуская новые модели с открытым исходным кодом. В преддверии ожидаемого выпуска GPT-5 OpenAI представила две новые модели — GPT OSS-120B и GPT OSS-20B, доступные для скачивания через Hugging Face под лицензией Apache 2.0. Это делает инструменты доступными для разработчиков и предприятий по всему миру.
Технические характеристики и особенности моделей
Генеральный директор OpenAI Сэм Альтман в публикации на платформе X.com отметил, что gpt-oss-120b демонстрирует сопоставимый уровень производительности с предыдущими моделями, особенно в решении сложных задач в области здравоохранения.
GPT OSS-120B оптимизирован для работы на одной видеокарте NVIDIA, что облегчает его интеграцию. Модель GPT OSS-20B предназначена для запуска на потребительских ноутбуках с памятью 16 ГБ, что существенно расширяет круг пользователей. Обе модели основаны исключительно на текстовом формате и не поддерживают мультимодальные функции, такие как генерация изображений или аудио.
Архитектура Mixture-of-Experts (MoE)
Модели построены на архитектуре Mixture-of-Experts (MoE), которая активирует лишь небольшой набор параметров для каждого токена, обеспечивая повышенную эффективность и быстродействие. К примеру, у GPT OSS-120B задействуется около 5.1 миллиарда параметров из общего объема в 120 миллиардов, что позволяет оптимизировать вычислительные ресурсы.
Производительность и проблемы с точностью
Согласно заявлению OpenAI, эти модели устанавливают новый стандарт в категории с открытыми весами. На программном тесте Codeforce GPT-OSS-120B показала результат 2622, а упрощенная версия — 2516.
Тем не менее, одна из существенных проблем — галлюцинации, то есть генерация недостоверной или ошибочной информации. Отчет TechCrunch показал, что GPT-OSS-120B ошибается примерно в 49% случаев на тесте PersonaQA, а GPT-OSS-20B — в 50% случаев.
Безопасность и этические принципы
OpenAI подчёркивает, что обе модели прошли строгую тренировку по безопасности. Данные, связанные с биологическими, радиологическими, химическими и ядерными угрозами были удалены из обучающих наборов. Модели также настроены на отказ от выполнения запросов с небезопасным содержанием и защищены от атак с использованием вводных подсказок (prompt injections).
Заключение: Значение новых моделей для сообщества разработчиков
Выпуск GPT OSS-120B и GPT OSS-20B представляет собой важный шаг в области открытого искусственного интеллекта. Благодаря лицензии Apache 2.0 и возможности запуска на обычном оборудовании, эти модели становятся доступными не только крупным компаниям, но и независимым разработчикам и исследователям.
Хотя текущие модели еще испытывают трудности с точностью выдаваемой информации, их способность эффективно обрабатывать сложные задачи и расширяемость архитектуры MoE открывают новые перспективы для развития интеллектуальных систем. Безопасность и этичность остаются главными приоритетами OpenAI, что особенно важно на фоне растущих опасений относительно возможных рисков, связанных с использованием ИИ.
Перспективы развития технологий ИИ
С выходом GPT-5 и дальнейшими усовершенствованиями в сфере обучения моделей и контроля качества можно ожидать значительного снижения негативных эффектов, таких как галлюцинации. В будущем интеграция мультимодальных возможностей и более глубокое понимание контекста позволят искусственному интеллекту стать еще более полезным инструментом для людей в различных отраслях — от медицины и образования до бизнеса и науки.
Таким образом, запуск новых открытых моделей GPT от OpenAI является не только техническим достижением, но и важным шагом к более демократичному и безопасному использованию искусственного интеллекта в масштабах всего мира.
Прокомментировать в Телеграм: https://t.me/n8nhow
Подписаться на канал обучения n8n: https://t.me/n8ncoaching

