AWS представил open-source инструмент для бенчмаркинга моделей OpenAI на Bedrock
AWS опубликовал открытый инструмент для тестирования моделей OpenAI на Amazon Bedrock. Он помогает выбирать модель не только по цене за токен, но и по реальной
Все новости и обновления по теме LLM
AWS опубликовал открытый инструмент для тестирования моделей OpenAI на Amazon Bedrock. Он помогает выбирать модель не только по цене за токен, но и по реальной
Artificial Analysis выпустила версию 4.2 своего Intelligence Index для оценки AI-моделей. Что изменилось в методологии — читайте в материале AI-Sphere.
AWS опубликовала архитектуру для развертывания LiteLLM gateway на ECS с Fargate, позволяющую подключаться к моделям OpenAI через Amazon Bedrock. Разбираем детали и
Z.ai официально подтвердила, что модель Ox Alpha является последней итерацией серии GLM. Это заявление проясняет статус модели в линейке китайских AI-решений.
Модель Qwen3.8-Flash-Next имеет 125 миллиардов параметров, активируя только 6 миллиардов на токен. Детали и контекст для AI-Sphere.
Thomson Reuters вложила около $40 млн в разработку AI-модели за два года. Средства пошли на персонал и вычислительные мощности.
Расследование AlgorithmWatch показало, что организация Profemina упоминается в 17% ответов AI-моделей. Это указывает на возможное смещение в данных.
Ramp представила Router — собственный AI-роутер для выбора моделей. Запуск состоялся 20 августа 2026 года. Подробности пока не раскрыты.
OpenAI анонсировала Private Safety Processing — автоматическую систему мониторинга злоупотреблений для корпоративных клиентов, которая не сохраняет данные.
Китайская модель GLM-5.3 достигла 60 баллов в рейтинге Artificial Analysis Intelligence Index, что свидетельствует о её высокой производительности и конкурентоспособности.
16 августа 2026 года вышла новая модель Qwen 3.8 27B. Подробности пока не раскрыты, следите за обновлениями на ai-sphere.ru.
ChatGPT вводит функцию Computer History для Mac: запись кликов, клавиш и переключений приложений. Подробности, сравнение и значение для пользователей.
OpenAI запустила режим Ultrafast для GPT-5.6 Sol, обеспечивающий скорость до 750 токенов в секунду. Подробности о новом режиме инференса.
Qwen 3.8 — плотная модель с 27 миллиардами параметров. Разбираем, что это значит для производительности и требований к ресурсам.
14 августа 2026 года Zhipu AI объявила о выпуске GLM-5.3 — новой версии языковой модели. Подробности о характеристиках пока не раскрыты.
Модель Palmyra X6 создана как пост-тренировочная вариация открытой модели GLM-5.2. Подробности о модели и её значении для AI-сообщества.
Microsoft выпустила MAI Code 1.1 Flash, который на 25% эффективнее по токенам предшественника. Обновление нацелено на разработчиков и оптимизацию затрат.
Meta выпустила Muse Glimmer — 30-миллиардную модель с открытой лицензией Apache 2.0, предназначенную для работы локальных AI-агентов. Модель доступна на Hugging Face.
Вышла версия LLM 0.32, названная самым значительным обновлением с момента запуска проекта. Подробности в статье.
Alibaba представила Qwen 3.8 — новую языковую модель, способную автономно выполнять задачи, пока человек занимается хобби. Подробности и контекст.
Модель Inkling Small с открытыми весами менее чем в 3 раза меньше оригинального Inkling, но превосходит его в тестах по коду и рассуждениям.
NVIDIA представила Ising Calibration — open-source Vision Language Model, которая автоматически интерпретирует диагностические данные квантовых процессоров и корректирует параметры, полностью устраняя ручную калибровку.
Новый подход к оценке языковых моделей: вместо абсолютной правильности — относительное предпочтение, измеряемое через консенсус панели LLM в пяти доменах.
NVIDIA представила Nemotron 3 Ultra — открытую модель, которая в связке с ACE-RTL агентом достигает 94,3% проходимости в задачах проектирования микросхем, обходя GLM 5.2 и Kimi K2.6 при вдвое меньшем расходе токенов.
Аналитический разбор паники в Кремниевой долине после выхода Moonshot AI Kimi K3. Почему китайские модели пугают инвесторов и стоит ли ожидать повторения сценария DeepSeek.