AI SPHERE / NEWSROOM

Новости искусственного интеллекта — страница 4

Проверенные новости о нейросетях, языковых моделях, AI-агентах и инструментах генерации контента.

Все новости

DeepSeek выпускает V4-Flash-Vision-Exp с поддержкой изображений

Китайская компания DeepSeek представила экспериментальную мультимодальную модель V4-Flash-Vision-Exp, которая добавляет понимание изображений к тексту.

AI-Sphere2 мин чтения
AI-агенты

Claude Opus 5 показал 100% на ARC-AGI-3 с кастомным harness от Nvidia

Исследователи Nvidia использовали Claude Opus 5 с кастомным harness и получили 100% на тесте ARC-AGI-3. Результат показывает потенциал модели в решении задач абстрактного мышления.

AI-Sphere3 мин чтения
AI-агенты

Amazon ADOP: Сокращение сроков подключения данных с недель до часов

Amazon представил ADOP, сокращающий сроки подключения источников данных с недель до часов. Решение автоматизирует интеграцию, ускоряя аналитику.

AI-Sphere2 мин чтения
Все новости

Nvidia покупает активы стартапа Poolside за $6 миллиардов

Nvidia приобретает активы Poolside за $6 млрд. Подробности сделки, влияние на рынок AI практическое значение для пользователей AI-Sphere.

AI-Sphere3 мин чтения
OpenAI

OpenAI запустила GPT-5.6 Sol 9 июля 2026 года

OpenAI запустила GPT-5.6 Sol 9 июля 2026 года. Подробности о модели пока не раскрыты. Следите за обновлениями на AI-Sphere.

AI-Sphere2 мин чтения
Генерация изображений

OpenAI тестирует прозрачный фон для GPT-Image-2 через API

OpenAI предварительно анонсировала поддержку прозрачного фона для модели GPT-Image-2 через API. Генерация PNG без фона — новая возможность для разработчиков.

AI-Sphere2 мин чтения
Исследования

Непреднамеренная утечка контекста: языковые модели могут выдавать секреты через безобидные ответы

Исследование arXiv: языковые модели непреднамеренно раскрывают секреты из контекстного окна через обычные ответы. 2-значные секреты восстанавливаются с почти идеальной точностью.

AI-Sphere4 мин чтения
Все новости

OpenAI обгоняет Anthropic по темпам роста среди бизнес-пользователей Ramp

OpenAI демонстрирует более быстрый рост, чем Anthropic, среди бизнес-пользователей платформы Ramp в третьем квартале 2023 года. Детали в статье.

AI-Sphere3 мин чтения
LLM

Ramp запускает собственный AI-роутер Router

Ramp представила Router — собственный AI-роутер для выбора моделей. Запуск состоялся 20 августа 2026 года. Подробности пока не раскрыты.

AI-Sphere3 мин чтения
Исследования

Безопасность AI-компонентов в разработке: исследование рисков и решений

Исследование arXiv:2607.16660v2 выявило риски безопасности при интеграции LLM в софт. Интервью с 22 разработчиками показали пробелы в защите цепочки поставок.

AI-Sphere5 мин чтения
Все новости

GEN-1.5: AI-модель обучает роботов новым задачам с одной демонстрации

AI-модель GEN-1.5 способна обучить робота выполнению новой задачи после единственного показа, сокращая время обучения с тысяч примеров до одного.

AI-Sphere3 мин чтения
Исследования

Исследование выявило уязвимость в оценке точности объяснений нейросетей

Новое исследование показывает, что стандартный тест на точность объяснений нейросетей не чувствителен к ложным утверждениям. Предложены новые протоколы аудита.

AI-Sphere5 мин чтения
Anthropic

Внутренняя модель Anthropic Model 2: незначительный прирост по сравнению с Claude Mythos 5

Anthropic использует внутреннюю модель Model 2, превосходящую все публичные версии Claude, но прирост по сравнению с Mythos 5 незначителен — всего 1.5 балла по шкале AECI.

AI-Sphere4 мин чтения
AI-агенты

Agent OS от Binance: единая платформа для управления AI-агентами

Binance запустила Agent OS — платформу для управления AI-агентами, работающую с ChatGPT, Claude Code и Cursor.

AI-Sphere3 мин чтения
OpenAI

OpenAI представила систему безопасности Private Safety Processing без хранения данных

OpenAI анонсировала Private Safey Processing — систему безопастности, котора выявляет злоупотребления моделями ИИ без соранения пользовательских данных, повышая конфиденциальность.

AI-Sphere3 мин чтения
Исследования

Новое исследование: AI-агенты фиксируют стратегию обучения на старте, игнорируя эксперименты

Исследователи анализируют, как LLM-агенты post-train модели: стратегия блокируется в начале, а бюджет уходит на локальные правки. Изучены три возможных причины.

AI-Sphere5 мин чтения
Исследования

Новый метод PSS повышает устойчивость детекции AI-текста к парафразированию

Исследователи представили Pattern Stability Score (PSS) — метод обнаружения машинного текста, устойчивый к многократному парафразированию и коротким текстам.

AI-Sphere4 мин чтения
Исследования

Latent Space Refusal Anchoring: механическое восстановление безопасности моделей без дообучения

Исследователи представили LSR-Anchoring — метод восстановления отказов моделей для африканских языков без дообучения. Работает на Llama, Mistral, Qwen.

AI-Sphere4 мин чтения
Исследования

NINJA: Новый метод jailbreak-атак на длинноконтекстные языковые модели

Исследователи представили NINJA — метод jailbreak-атак, использующий длинный контекст для обхода защиты LLaMA, Qwen, Mistral и Gemini.

AI-Sphere4 мин чтения
Исследования

Эмодзи выявляют пробелы в безопасности LLM: исследование arXiv

Исследование arXiv показало, что эмодзи-промпты обходят защиту LLM. Gemma 2 9B и Mistral 7B уязвимы на 10%, Qwen 2 7B устойчив (0%). Оценки только по тексту недооценивают риски.

AI-Sphere4 мин чтения
Исследования

Атака на приватные модели ЭЭГ через публичные энкодеры: представлен SW-ProxyCE

Исследователи предложили SW-ProxyCE — метод атаки на приватные модели ЭЭГ через публичные энкодеры без запросов к жертве. Работа опубликована на arXiv.

AI-Sphere4 мин чтения
LLM

OpenAI запускает Private Safety Processing для корпоративных клиентов

OpenAI анонсировала Private Safety Processing — автоматическую систему мониторинга злоупотреблений для корпоративных клиентов, которая не сохраняет данные.

AI-Sphere2 мин чтения
Все новости

Spacex и Cognition: слухи о покупке опровергнуты CEO

Bloomberg сообщил о попытке SpaceX приобрести Cognition, но CEO компании опроверг эту информацию. Подробности и контекст для AI-Sphere.

AI-Sphere3 мин чтения
Google / Gemini

AI-визуализации в Google Search: интерактивные 3D-симуляции для сложных тем

В Google Search появились AI-сгенерированные интерактивные визуализации и 3D-симуляции. Они помогают понять сложные темы, например интерференцию, делая обучение нагляднее.

AI-Sphere2 мин чтения
Все новости

Anthropic впервые обогнал OpenAI по выручке

Компания Anthropic впервые превзошла OpenAI по выручке, что знаменует сдвиг в расстановке сил на рынке ИИ.

AI-Sphere3 мин чтения
Anthropic

Уровень успеха AI-системы достиг 35% — значительный прорыв в точности

Новый показатель точности AI-системы — 35% hit rate. Узнайте, почему это важный рубеж для индустрии и что значит для пользователей.

AI-Sphere3 мин чтения
LLM

GLM-5.3 набрал 60 баллов в индексе Artificial Analysis Intelligence

Китайская модель GLM-5.3 достигла 60 баллов в рейтинге Artificial Analysis Intelligence Index, что свидетельствует о её высокой производительности и конкурентоспособности.

AI-Sphere2 мин чтения
Исследования

Само-дистилляция может ухудшать рассуждения LLM: до 40% падения производительности

Исследование arXiv:2603.24472v4 показало, что само-дистилляция в математических рассуждениях снижает точность больших языковых моделей до 40% из-за подавления вербализации неуверенности.

AI-Sphere4 мин чтения
Исследования

Исследование: LLM демонстрируют систематическую религиозную предвзятость в финансовых советах

Новое исследование на 432 симулированных консультациях выявило, что LLM дают непредвзятые финансовые советы лишь в 12-18% случаев, систематически проявляя религиозные предубеждения.

AI-Sphere4 мин чтения
Исследования

ChatGPT научился предсказывать тренды фондового рынка по твитам: результаты исследования

Исследование arXiv показало, что ChatGPT может прогнозировать движения акций Microsoft и Google на основе анализа настроений в Twitter.

AI-Sphere4 мин чтения
Исследования

ArguLens: открытая система для автоматической оценки эссе с обратной связью

Представлена ArguLens — локально развертываемая система с открытым кодом для оценки эссе, генерации интерпретируемой обратной связи и снижения затрат на API.

AI-Sphere4 мин чтения
Все новости

Cursor запускает платформу для хостинга кода в конкуренцию GitHub

Cursor объявил о запуске собственной платформы для хостинга кода, которая составит конкуренцию GitHub. Подробности о функциях и дате выхода пока не раскрываются.

AI-Sphere3 мин чтения
AI-агенты

Amazon Bedrock AgentCore Payments стал общедоступен 18 августа 2026 года

Amazon объявил о GA сервиса Bedrock AgentCore Payments. Платежный AI-сервис теперь доступен всем пользователям AWS.

AI-Sphere2 мин чтения
AI-агенты

Опубликован бенчмарк Search Index для оценки поисковых API для AI-агентов

Artificial Analysis выпустила бенчмарк Search Index, оценивающий поисковые API для AI-агентов по качеству, стоимости и скорости. Новый инструмент помогает сравнивать провайдеров.

AI-Sphere2 мин чтения
OpenAI

ChatGPT for Teens: возрастные меры безопасности и родительский контроль

OpenAI представила ChatGPT for Teens с возрастными мерами безопасности, родительским контролем и учебными инструментами. Подробности в статье.

AI-Sphere3 мин чтения
OpenAI

OpenAI выпускает ChatGPT для подростков 13–17 лет

OpenAI анонсировал версию ChatGPT для пользователей от 13 до 17 лет. Новый продукт расширяет аудиторию AI-ассистента на школьников и студентов.

AI-Sphere2 мин чтения