Новости LLM

Все новости и обновления по теме LLM

AWS представил open-source инструмент для бенчмаркинга моделей OpenAI на Bedrock

AWS опубликовал открытый инструмент для тестирования моделей OpenAI на Amazon Bedrock. Он помогает выбирать модель не только по цене за токен, но и по реальной

11 сентября 2026 г.AI-Sphere5 мин чтения

Artificial Analysis обновила Intelligenсe Index до версии 4.2

Artificial Analysis выпустила версию 4.2 своего Intelligence Index для оценки AI-моделей. Что изменилось в методологии — читайте в материале AI-Sphere.

5 сентября 2026 г.AI-Sphere4 мин чтения

LiteLLM на AWS ECS с Fargate: новый способ доступа к OpenAI через Amazon Bedrock

AWS опубликовала архитектуру для развертывания LiteLLM gateway на ECS с Fargate, позволяющую подключаться к моделям OpenAI через Amazon Bedrock. Разбираем детали и

4 сентября 2026 г.AI-Sphere6 мин чтения

Z.ai подтвердила, что Ox Alpha — новейшая версия серии GLM

Z.ai официально подтвердила, что модель Ox Alpha является последней итерацией серии GLM. Это заявление проясняет статус модели в линейке китайских AI-решений.

26 августа 2026 г.AI-Sphere2 мин чтения

Qwen3.8-Flash-Next: 125 миллиардов параметров с активацией 6 миллиардов на токен

Модель Qwen3.8-Flash-Next имеет 125 миллиардов параметров, активируя только 6 миллиардов на токен. Детали и контекст для AI-Sphere.

26 августа 2026 г.AI-Sphere2 мин чтения

Thomson Reuters потратила $40 млн на разработку собственной AI-модели

Thomson Reuters вложила около $40 млн в разработку AI-модели за два года. Средства пошли на персонал и вычислительные мощности.

24 августа 2026 г.AI-Sphere2 мин чтения

Profemina появляется в 17% ответов AI: результаты расследования AlgorithmWatch

Расследование AlgorithmWatch показало, что организация Profemina упоминается в 17% ответов AI-моделей. Это указывает на возможное смещение в данных.

24 августа 2026 г.AI-Sphere3 мин чтения

Ramp запускает собственный AI-роутер Router

Ramp представила Router — собственный AI-роутер для выбора моделей. Запуск состоялся 20 августа 2026 года. Подробности пока не раскрыты.

20 августа 2026 г.AI-Sphere3 мин чтения

OpenAI запускает Private Safety Processing для корпоративных клиентов

OpenAI анонсировала Private Safety Processing — автоматическую систему мониторинга злоупотреблений для корпоративных клиентов, которая не сохраняет данные.

19 августа 2026 г.AI-Sphere2 мин чтения

GLM-5.3 набрал 60 баллов в индексе Artificial Analysis Intelligence

Китайская модель GLM-5.3 достигла 60 баллов в рейтинге Artificial Analysis Intelligence Index, что свидетельствует о её высокой производительности и конкурентоспособности.

19 августа 2026 г.AI-Sphere2 мин чтения

16 августа 2026 года состоялся релиз Qwen 3.8 27B

16 августа 2026 года вышла новая модель Qwen 3.8 27B. Подробности пока не раскрыты, следите за обновлениями на ai-sphere.ru.

16 августа 2026 г.AI-Sphere2 мин чтения

Computer History в ChatGPT: запись действий пользователя на Mac

ChatGPT вводит функцию Computer History для Mac: запись кликов, клавиш и переключений приложений. Подробности, сравнение и значение для пользователей.

15 августа 2026 г.AI-Sphere3 мин чтения

OpenAI представила режим Ultrafast для GPT-5.6 Sol с рекордной скоростью генерации

OpenAI запустила режим Ultrafast для GPT-5.6 Sol, обеспечивающий скорость до 750 токенов в секунду. Подробности о новом режиме инференса.

14 августа 2026 г.AI-Sphere2 мин чтения

Qwen 3.8 — плотная модель с 27 миллиардами параметров

Qwen 3.8 — плотная модель с 27 миллиардами параметров. Разбираем, что это значит для производительности и требований к ресурсам.

14 августа 2026 г.AI-Sphere2 мин чтения

Zhipu AI выпустила GLM-5.3

14 августа 2026 года Zhipu AI объявила о выпуске GLM-5.3 — новой версии языковой модели. Подробности о характеристиках пока не раскрыты.

14 августа 2026 г.AI-Sphere2 мин чтения

Palmyra X6: новая модель на базе открытой GLM-5.2 от Z.ai

Модель Palmyra X6 создана как пост-тренировочная вариация открытой модели GLM-5.2. Подробности о модели и её значении для AI-сообщества.

13 августа 2026 г.AI-Sphere3 мин чтения

Microsoft представила MAI Code 1.1 Flash: на 25% эффективнее по токенам

Microsoft выпустила MAI Code 1.1 Flash, который на 25% эффективнее по токенам предшественника. Обновление нацелено на разработчиков и оптимизацию затрат.

12 августа 2026 г.AI-Sphere3 мин чтения

Meta представила Muse Glimmer — 30-миллиардную модель для локальных AI-агентов

Meta выпустила Muse Glimmer — 30-миллиардную модель с открытой лицензией Apache 2.0, предназначенную для работы локальных AI-агентов. Модель доступна на Hugging Face.

10 августа 2026 г.AI-Sphere3 мин чтения

Выпущена новая версия LLM 0.32

Вышла версия LLM 0.32, названная самым значительным обновлением с момента запуска проекта. Подробности в статье.

4 августа 2026 г.AI-Sphere2 мин чтения

Alibaba представила новую модель Qwen 3.8 для автономных задач

Alibaba представила Qwen 3.8 — новую языковую модель, способную автономно выполнять задачи, пока человек занимается хобби. Подробности и контекст.

3 августа 2026 г.AI-Sphere3 мин чтения

Inkling Small: открытая модель с меньшим размером и улучшенными тестами

Модель Inkling Small с открытыми весами менее чем в 3 раза меньше оригинального Inkling, но превосходит его в тестах по коду и рассуждениям.

31 июля 2026 г.AI-Sphere3 мин чтения

NVIDIA научила ИИ самостоятельно калибровать квантовые компьютеры: представлена открытая модель Ising Calibration

NVIDIA представила Ising Calibration — open-source Vision Language Model, которая автоматически интерпретирует диагностические данные квантовых процессоров и корректирует параметры, полностью устраняя ручную калибровку.

27 июля 2026 г.AI-Sphere8 мин чтения

Консенсусный фреймворк оценки LLM: как панель из пяти моделей заменяет статические бенчмарки

Новый подход к оценке языковых моделей: вместо абсолютной правильности — относительное предпочтение, измеряемое через консенсус панели LLM в пяти доменах.

27 июля 2026 г.AI-Sphere10 мин чтения

NVIDIA Nemotron 3 Ultra возглавляет рейтинг открытых моделей в агентном RTL-кодировании

NVIDIA представила Nemotron 3 Ultra — открытую модель, которая в связке с ACE-RTL агентом достигает 94,3% проходимости в задачах проектирования микросхем, обходя GLM 5.2 и Kimi K2.6 при вдвое меньшем расходе токенов.

27 июля 2026 г.AI-Sphere5 мин чтения

Паника вокруг китайского ИИ: хайп или реальная угроза?

Аналитический разбор паники в Кремниевой долине после выхода Moonshot AI Kimi K3. Почему китайские модели пугают инвесторов и стоит ли ожидать повторения сценария DeepSeek.

27 июля 2026 г.AI-Sphere5 мин чтения