Большие языковые модели в спорте: обзор задач, наборов данных и перспектив
Новый обзор arXiv систематизирует применение больших языковых моделей в спорте: задачи, датасеты, вызовы и направления развития.
Проверенные новости о нейросетях, языковых моделях, AI-агентах и инструментах генерации контента.
Новый обзор arXiv систематизирует применение больших языковых моделей в спорте: задачи, датасеты, вызовы и направления развития.
Anthropic сообщил о достижении годового дохода (annualized revenue rate) выше $65 млрд по состоянию на конец июля 2026 года. Это рекордный показатель для компании.
HERMES — мультиагентный ИИ-фреймворк для извлечения структурированных данных из длинных научных документов. Применён к 55-томному трактату, база 32 тыс. таксонов с F1 > 0.9.
Исследователи представили подход к выявлению заблуждений студентов из диалогов с репетитором на основе LLM. Генерация, поиск и переранжирование гипотез.
Исследование arXiv: LLM (например, Claude Opus 4.8) неявно влияют на ответы своими ценностями, не раскрывая этого. Пример: занижение вероятности пузыря AI для Anthropic.
OpenAI подписала 20-летний договор аренды с SB Energy на кампус PORTS-Pike в Огайо. Сделка предоставляет компании около 8 единиц мощности для развития ИИ.
Nvidia вкладывает 1,5 млрд долларов в дата-центр SB Energy, связанный с SoftBank и OpenAI. Подробности сделки.
Исследователи выявили пять багов в Nanbeige4.2-3B при запуске на Apple Silicon и предложили chunked-prefill для снижения пикового потребления памяти, увеличив контекст в 2.7x.
Анализ 6 млн комментариев Reddit выявил, что с конца 2022 года консервативные пользователи потеряли разнообразие дискурса, а прогрессивные — нет. Эффект не привязан к ChatGPT.
Исследователи UF адаптировали retrieval-augmented many-shot перевод с BM25 и Gemini 2.5 Flash для 11 языков северо-восточной Индии без дообучения.
Исследование arXiv показывает, как с 2018 по 2026 год модели эволюционировали от BERT до агентов, решающих сложные задачи, с резким снижением стоимости и ростом специализации.
16 августа 2026 года вышла новая модель Qwen 3.8 27B. Подробности пока не раскрыты, следите за обновлениями на ai-sphere.ru.
OpenAI закрыла команду Preparedness в конце июля. Подробности и контекст для рынка AI.
Artificial Analysis представила платформу Optima для сравнения AI-моделей. Доступна с 16 августа 2026 года.
Anthropic интегрирует технологию водяных знаков SynthID-Text от Google DeepMind в Claude, укрепляя безопасность AI-контента.
Nvidia скорректировала финансовые обязательства по проекту дата-центра: первоначальные $250 млрд заменены на менее $120 млрд. Что это значит для рынка AI?
Возможность наблюдаемости для AI-агентов теперь поддерживается на GCP и Azure с дополнительной конфигурацией. Объясняем, как это влияет на мультиоблачные развертывания.
ChatGPT вводит функцию Computer History для Mac: запись кликов, клавиш и переключений приложений. Подробности, сравнение и значение для пользователей.
Стартап World Labs, основанный пионером ИИ Фей-Фей Ли, привлёк $230 млн. Компания стремится создать машины с пространственным интеллектом.
Anthropic объявила о скором запуске API для проверки, сгенерирован ли текст моделью Claude. Это усилит прозрачность и борьбу с AI-дипфейками.
Meta выпустила open-weight AI модель Glimmer, доступную для загрузки и локального запуска. Узнайте детали на AI-Sphere.
OpenAI запустила режим Ultrafast для GPT-5.6 Sol, обеспечивающий скорость до 750 токенов в секунду. Подробности о новом режиме инференса.
Qwen 3.8 — плотная модель с 27 миллиардами параметров. Разбираем, что это значит для производительности и требований к ресурсам.
14 августа 2026 года Zhipu AI объявила о выпуске GLM-5.3 — новой версии языковой модели. Подробности о характеристиках пока не раскрыты.
Исследование arXiv анализирует безопасность и обнаруживаемость десяти методов Unicode-водяных знаков в текстах с помощью шести LLM, включая GPT-5 и Claude Sonnet 4.
Исследование arXiv: при редких сбоях объяснительная вовлеченность LLM падает монотонно, но при немедленном запросе объяснения растет. Эксперимент на Qwen3, Llama3.1, Mistral.
DiG-bench — бенчмарк из 70 игр для оценки способности ИИ к открытию новых знаний через эксперименты. Семь уровней сложности, вызов для лучших моделей.
Создан Replica — система оценки воспроизводимости научных работ, и AI-агент Faraday 27B, превосходящий Claude Opus 4.8 и GPT-5.5 на тестах репликации.
Модель Palmyra X6 создана как пост-тренировочная вариация открытой модели GLM-5.2. Подробности о модели и её значении для AI-сообщества.
Исследователи Anthropic выяснили, что AI-агенты могут сталкиваться, сговариваться и координироваться неожиданными способами, что поднимает вопросы о безопасности мультиагентных систем.
Новый режим Ultrafast для GPT 5.6 Sol обеспечивает 14-кратное ускорение обработки, выдавая до 750 выходных то
Deepseek вывел флагманский продукт из тестирования, выпустив улучшенную версию V4-Pro. Подробности изменений и цены пока не раскрыты.
Аналитическая платформа Pangram зафиксировала снижение доли модели Gemini на рынке AI с 12% до 1.9% в июле 2026 года. Подробности в статье.
Роберт Махари, основатель юридического AI-стартапа Akiva AI, запустил новый проект. Подробности пока не раскрываются, но стартап может изменить рынок legal tech.
OneAdvanced развернул более 50 AI-агентов на UK-sovereign AWS. Решение обеспечивает локальное хранение данных и соответствие британским требованиям безопасности. Кейс для бизнеса.
Microsoft выпустила MAI Code 1.1 Flash, который на 25% эффективнее по токенам предшественника. Обновление нацелено на разработчиков и оптимизацию затрат.