DeepSeek выпускает V4-Flash-Vision-Exp с поддержкой изображений
Китайская компания DeepSeek представила экспериментальную мультимодальную модель V4-Flash-Vision-Exp, которая добавляет понимание изображений к тексту.
Проверенные новости о нейросетях, языковых моделях, AI-агентах и инструментах генерации контента.
Китайская компания DeepSeek представила экспериментальную мультимодальную модель V4-Flash-Vision-Exp, которая добавляет понимание изображений к тексту.
Исследователи Nvidia использовали Claude Opus 5 с кастомным harness и получили 100% на тесте ARC-AGI-3. Результат показывает потенциал модели в решении задач абстрактного мышления.
Amazon представил ADOP, сокращающий сроки подключения источников данных с недель до часов. Решение автоматизирует интеграцию, ускоряя аналитику.
Nvidia приобретает активы Poolside за $6 млрд. Подробности сделки, влияние на рынок AI практическое значение для пользователей AI-Sphere.
OpenAI запустила GPT-5.6 Sol 9 июля 2026 года. Подробности о модели пока не раскрыты. Следите за обновлениями на AI-Sphere.
OpenAI предварительно анонсировала поддержку прозрачного фона для модели GPT-Image-2 через API. Генерация PNG без фона — новая возможность для разработчиков.
Исследование arXiv: языковые модели непреднамеренно раскрывают секреты из контекстного окна через обычные ответы. 2-значные секреты восстанавливаются с почти идеальной точностью.
OpenAI демонстрирует более быстрый рост, чем Anthropic, среди бизнес-пользователей платформы Ramp в третьем квартале 2023 года. Детали в статье.
Ramp представила Router — собственный AI-роутер для выбора моделей. Запуск состоялся 20 августа 2026 года. Подробности пока не раскрыты.
Исследование arXiv:2607.16660v2 выявило риски безопасности при интеграции LLM в софт. Интервью с 22 разработчиками показали пробелы в защите цепочки поставок.
AI-модель GEN-1.5 способна обучить робота выполнению новой задачи после единственного показа, сокращая время обучения с тысяч примеров до одного.
Новое исследование показывает, что стандартный тест на точность объяснений нейросетей не чувствителен к ложным утверждениям. Предложены новые протоколы аудита.
Anthropic использует внутреннюю модель Model 2, превосходящую все публичные версии Claude, но прирост по сравнению с Mythos 5 незначителен — всего 1.5 балла по шкале AECI.
Binance запустила Agent OS — платформу для управления AI-агентами, работающую с ChatGPT, Claude Code и Cursor.
OpenAI анонсировала Private Safey Processing — систему безопастности, котора выявляет злоупотребления моделями ИИ без соранения пользовательских данных, повышая конфиденциальность.
Исследователи анализируют, как LLM-агенты post-train модели: стратегия блокируется в начале, а бюджет уходит на локальные правки. Изучены три возможных причины.
Исследователи представили Pattern Stability Score (PSS) — метод обнаружения машинного текста, устойчивый к многократному парафразированию и коротким текстам.
Исследователи представили LSR-Anchoring — метод восстановления отказов моделей для африканских языков без дообучения. Работает на Llama, Mistral, Qwen.
Исследователи представили NINJA — метод jailbreak-атак, использующий длинный контекст для обхода защиты LLaMA, Qwen, Mistral и Gemini.
Исследование arXiv показало, что эмодзи-промпты обходят защиту LLM. Gemma 2 9B и Mistral 7B уязвимы на 10%, Qwen 2 7B устойчив (0%). Оценки только по тексту недооценивают риски.
Исследователи предложили SW-ProxyCE — метод атаки на приватные модели ЭЭГ через публичные энкодеры без запросов к жертве. Работа опубликована на arXiv.
OpenAI анонсировала Private Safety Processing — автоматическую систему мониторинга злоупотреблений для корпоративных клиентов, которая не сохраняет данные.
Bloomberg сообщил о попытке SpaceX приобрести Cognition, но CEO компании опроверг эту информацию. Подробности и контекст для AI-Sphere.
В Google Search появились AI-сгенерированные интерактивные визуализации и 3D-симуляции. Они помогают понять сложные темы, например интерференцию, делая обучение нагляднее.
Компания Anthropic впервые превзошла OpenAI по выручке, что знаменует сдвиг в расстановке сил на рынке ИИ.
Новый показатель точности AI-системы — 35% hit rate. Узнайте, почему это важный рубеж для индустрии и что значит для пользователей.
Китайская модель GLM-5.3 достигла 60 баллов в рейтинге Artificial Analysis Intelligence Index, что свидетельствует о её высокой производительности и конкурентоспособности.
Исследование arXiv:2603.24472v4 показало, что само-дистилляция в математических рассуждениях снижает точность больших языковых моделей до 40% из-за подавления вербализации неуверенности.
Новое исследование на 432 симулированных консультациях выявило, что LLM дают непредвзятые финансовые советы лишь в 12-18% случаев, систематически проявляя религиозные предубеждения.
Исследование arXiv показало, что ChatGPT может прогнозировать движения акций Microsoft и Google на основе анализа настроений в Twitter.
Представлена ArguLens — локально развертываемая система с открытым кодом для оценки эссе, генерации интерпретируемой обратной связи и снижения затрат на API.
Cursor объявил о запуске собственной платформы для хостинга кода, которая составит конкуренцию GitHub. Подробности о функциях и дате выхода пока не раскрываются.
Amazon объявил о GA сервиса Bedrock AgentCore Payments. Платежный AI-сервис теперь доступен всем пользователям AWS.
Artificial Analysis выпустила бенчмарк Search Index, оценивающий поисковые API для AI-агентов по качеству, стоимости и скорости. Новый инструмент помогает сравнивать провайдеров.
OpenAI представила ChatGPT for Teens с возрастными мерами безопасности, родительским контролем и учебными инструментами. Подробности в статье.
OpenAI анонсировал версию ChatGPT для пользователей от 13 до 17 лет. Новый продукт расширяет аудиторию AI-ассистента на школьников и студентов.