AI SPHERE / NEWSROOM

Новости искусственного интеллекта — страница 6

Проверенные новости о нейросетях, языковых моделях, AI-агентах и инструментах генерации контента.

Исследования

Фиксация промежуточных выводов ухудшает работу LLM-судей: новое исследование

Исследование arXiv:2608.05353v2 показало, что принудительное сохранение промежуточных доказательств снижает согласие LLM-судей с человеческими оценками на 4–6 процентных пунктов.

AI-Sphere4 мин чтения
Исследования

Исследователи выявили наследуемость правдивости в модельных семействах LLM и MLLM

Новое исследование показывает, что способность LLM к контекстной правдивости наследуется внутри модельных семейств. Предложен метод TruthProbe для усиления правдивых голов.

AI-Sphere5 мин чтения
Исследования

LLM-рекомендатели не знают, когда галлюцинируют: новое исследование калибровки уверенности

Исследование arXiv:2608.10008v1 показывает, что LLM-рекомендатели (Mistral Large, Llama-3.3-70B, GPT-OSS-120B, Claude Sonnet 4.6) систематически недооценивают уверенность, даже при нулевых галлюцинаци

AI-Sphere5 мин чтения
Исследования

TRIBE: предсказание эффективности команды по паттернам общения

Исследователи представили TRIBE — метод, предсказывающий эффективность команды по паттернам общения уже на 10% выполнения задачи. Подход не требует знаний о задаче и позволяет своевременно вмешиваться

AI-Sphere4 мин чтения
Google / Gemini

Неподтверждённая информация о 1 миллиарде пользователей Gemini

11 августа 2026 года опубликована статья, заявляющая о достижении Gemini 1 миллиарда пользователей. Данные требуют подтверждения.

AI-Sphere2 мин чтения
OpenAI

Исследователи обнаружили уязвимость в API OpenAI, Anthropic и Google

Исследователи под руководством Александра Панфилова выявили уязвимость в API OpenAI, Anthropic и Google. Подробности пока не раскрыты.

AI-Sphere3 мин чтения
Исследования

Измерение токенизационной премии: как языки влияют на стоимость LLM

Новый бенчмарк TEA показывает, что токенизация неравномерно обрабатывает языки: Bengali требует больше токенов, увеличивая затраты API.

AI-Sphere4 мин чтения
Все новости

OpenAI представила Premium Seats для ChatGPT Team: $125 за пользователя в месяц

OpenAI ввела Premium Seats для ChatGPT Team по цене $125 за пользователя в месяц. Новая опция дороже стандартной и предназначена для расширенных возможностей.

AI-Sphere3 мин чтения
Исследования

Новый метод квантования Tied Trit-Planes сжимает DeepSeek-V4 до 4.0625 бит на вес

Исследователи представили Tied Trit-Planes — метод квантования для MoE-моделей, достигающий 4.0625 бит/вес. Применён к DeepSeek-V4-Flash-0731, обеспечивая однородное девятиуровневое квантование.

AI-Sphere5 мин чтения
Anthropic

Anthropic вводит глобальную маркировку продуктов Claude

Anthropic расширяет требование маркировки на все продукты Claude по всему миру. Нововведение действует для всех регионов, включая страны за пределами ЕС.

AI-Sphere3 мин чтения
Исследования

Дрейф показателей доверия в открытых LLM: аудит Yi, Qwen, Mistral и Gemma

Аудит четырёх открытых линий LLM показал, что показатели доверия между чекпоинтами одной линейки могут существенно отличаться, что ставит под сомнение использование единого значения для всей линейки.

AI-Sphere5 мин чтения
Исследования

Новые ИИ-модели галлюцинируют имена пакетов в 4-6% случаев, угроза сохраняется

Исследование показало: современные ИИ-модели галлюцинируют несуществующие имена пакетов в 4-6% случаев, что создаёт риск slopsquatting-атак.

AI-Sphere4 мин чтения
OpenAI

OpenAI запустила GPT-5.6-Cyber для программы Daybreak

OpenAI представила новую модель GPT-5.6-Cyber, доступную только на уровне Red программы Daybreak. Модель построена на базе GPT-5.6 и ориентирована на специализированные сценарии.

AI-Sphere3 мин чтения
Все новости

OpenAI запускает GPT-5.6-Cyber — модель для кибербезопасности

OpenAI представила GPT-5.6-Cyber — модель для выявления уязвимостей и разработки эксплойтов. Новая специализация в области кибербезопасности.

AI-Sphere4 мин чтения
LLM

Meta представила Muse Glimmer — 30-миллиардную модель для локальных AI-агентов

Meta выпустила Muse Glimmer — 30-миллиардную модель с открытой лицензией Apache 2.0, предназначенную для работы локальных AI-агентов. Модель доступна на Hugging Face.

AI-Sphere3 мин чтения
Исследования

Новая нейросетевая архитектура для анализа иерархических данных: Deep Generalised Mixed Models

Исследователи представили Deep Generalised Mixed Models — нейросеть для анализа иерархических данных, решающую проблему пропусков в лонгитюдных исследованиях.

AI-Sphere4 мин чтения
Исследования

Kimi K2.5: новая открытая мультимодальная модель для агентного ИИ

Представлена Kimi K2.5 — открытая мультимодальная модель с совместным обучением текста и зрения. Включает фреймворк Agent Swarm, ускоряющий выполнение задач до 4.5 раз.

AI-Sphere4 мин чтения
Исследования

Stoicheia: новая модель для восстановления и анализа древнегреческих текстов

Stoicheia — 405M-параметров character-level masked-diffusion encoder для древнегреческого, способный восстанавливать лакуны, расставлять диакритику и пунктуацию без перетокенизации.

AI-Sphere5 мин чтения
Anthropic

Anthropic включает авторежим по умолчанию для подписок Pro, Max и Team

Anthropic устанавливает авторежим как предустановленный для аккаунтов Claude Pro, Max и Team с 14 августа.

AI-Sphere2 мин чтения
Все новости

Рост числа судебных исков на 39% за год до марта 2026 года

Количество судебных исков выросло на 39% за год, закончившийся в марте 2026 года. Анализ влияния на рынок AI и рекомендации для пользователей AI-Sphere.

AI-Sphere1 мин чтения
OpenAI

Бывшие разработчики NextSlide присоединились к команде ChatGPT

Разработчики сервиса презентаций NextSlide перешли к работе над ChatGPT. Это может указывать на планы OpenAI по развитию функций создания презентаций.

AI-Sphere2 мин чтения
Anthropic

Claude Code включает Auto Mode по умолчанию для Pro, Max и Team

С 14 августа Claude Code будет поставляться с Auto Mode, включённым по умолчанию для тарифов Pro, Max и Team. Упрощение работы разработчиков.

AI-Sphere2 мин чтения
Все новости

Backflip AI: 3D-сканы превращаются в CAD-модели за минуты

Backflip AI преобразует 3D-сканы в редактируемые CAD-модели за минуты вместо часов. Изменения и значение для индустрии.

AI-Sphere2 мин чтения
Генерация изображений

Imagine Image 2.0 занимает второе место в мировых рейтингах AI-редактирования и генерации изображений

Быстрый режим Imagine Image 2.0 от Meta занял второе место в Image Edit Arena и Text-to-Image Arena по данным на 7 августа 2026 года.

AI-Sphere3 мин чтения
Anthropic

Энергопотребление AI-агентов в 600 раз выше обычных чатов

AI-агенты потребляют в 600 раз больше энергии на запрос, чем обычные чат-промпты. Разбираемся в причинах и последствиях для рынка.

AI-Sphere3 мин чтения
Все новости

OpenAI представила доклад о взломе промптов на Black Hat

OpenAI выступила на конференции Black Hat с докладом о взломе промптов. Подробности о проблеме безопасности AI-систем.

AI-Sphere3 мин чтения
OpenAI

OpenAI признала потенциально критический уровень риска кибербезопасности в новой модели Astra

OpenAI заявила о потенциально критическом уровне риска кибербезопасности в новой модели Astra. Внутренние тесты показали значительные улучшения в агентном кодировании.

AI-Sphere3 мин чтения
Все новости

Демо-чип достиг скорости инференса свыше 16 000 токенов в секунду на Llama 3.1-8B

Демо-чип показал более 16 000 токенов/с на пользователя при работе с Llama 3.1-8B — многократное превосходство над конкурентами.

AI-Sphere4 мин чтения
AI-агенты

Cloudflare запускает Kitesurf: новый AI-браузер для периферийных вычислений

Cloudflare представил Kitesurf — браузер на базе AI для периферийных вычислений. Новинка обещает изменить подход к обработке данных на границе сети.

AI-Sphere3 мин чтения
AI-агенты

Опубликован стандарт Agent Plugins версии 1.0.0

Вышла версия 1.0.0 стандарта Agent Plugins. Это первый стабильный релиз, задающий единый формат для подключения плагинов к AI-агентам.

AI-Sphere3 мин чтения
Исследования

Open-weight LLMs слабо справляются с верификацией Coq-доказательств: лучшая модель подтвердила лишь 12 из 100 теорем

Исследование arXiv оценило шесть open-weight LLM на CoqStoq: Gemma 4 верифицировала 12 из 100 теорем, Llama 3.3 — 8, остальные — менее 1. Результаты показывают ограничения LLM в формальной верификации

AI-Sphere5 мин чтения
OpenAI

AI-агенты создали доску с сотнями тысяч постов через Artifactory

AI-агенты использовали Artifactory для обмена сообщениями, что привело к созданию доски с сотнями тысяч постов. Подробности и влияние на рынок AI.

AI-Sphere2 мин чтения
Все новости

5 августа 2026 года: единственный подтверждённый факт в AI-сфере

5 августа 2026 года — дата, зафиксированная как подтверждённый факт. Другие события не имеют подтверждения.

AI-Sphere1 мин чтения
AI-агенты

Meta выпустила Muse Code

5 августа 2026 года Meta выпустила Muse Code. Подробности о возможностях и доступности пока не раскрыты. Следите за обновлениями на AI-Sphere.

AI-Sphere1 мин чтения
Генерация видео

FLUX 3 Video: генерация 20-секундного Full HD видео с аудио

Black Forest Labs представила FLUX 3 Video — модель для генерации видео до 20 секунд в Full HD с нативным аудио. Подробности в новости AI-Sphere.

AI-Sphere3 мин чтения
AI-агенты

Mythos 5: модель от Anthropic

Mythos 5 — модель искусственного интеллекта от Anthropic. Подтверждение принадлежности получено. Подробности о модели пока не раскрыты.

AI-Sphere2 мин чтения