Федеративное обучение с LLM для приватной когнитивной диагностики: новый подход
Исследователи предложили фреймворк федеративного вывода с LLM для когнитивной диагностики, сохраняющий приватность учащихся. Механизм на основе локальной
Проверенные новости о нейросетях, языковых моделях, AI-агентах и инструментах генерации контента.
Исследователи предложили фреймворк федеративного вывода с LLM для когнитивной диагностики, сохраняющий приватность учащихся. Механизм на основе локальной
OpenAI анонсировала Astra — модель, которая, по заявлению компании, открывает новую эру в использовании компьютера и браузера. Разбираем, что известно и что пока под
Представлен TALKFA — унифицированный бенчмарк для задач генерации и понимания диалогов на персидском языке, созданный с участием LLM и проверенный носителями.
Пентагон расширил свою платформу GenAI.mil, добавив ChatGPT Mil от OpenAI. Разбираем, что это значит для военных и почему меняет отношение к ИИ в обороне.
Исследователи провели серию контролируемых экспериментов, варьируя learning rate, batch size, LoRA и другие параметры при дообучении моделей Qwen3 и Llama на
World Labs представила Atlas — единую модель ИИ, которая генерирует, реконструирует и симулирует 3D-сцены всего из нескольких изображений.
Представлен Dr. Claw — открытая рабочая среда для аудируемых исследований с AI-агентами. Объединяет планирование, выполнение и документирование в единый
Исследователи представили AgentProv — метод аудита подлинности LLM-моделей в agentic API, анализирующий вызовы инструментов вместо текстового вывода. Позволяет
Модель Claude Fable 5.1 показала 52.6% на Terminal-Bench-Science 0.1, более чем вдвое превысив результат Fable 5 (24.7%) и обойдя GPT-5.6 Sol (22.4%).
Anthropic запускает API для выявления текстов, сгенерированных Claude. Доступ предоставляется регуляторам, СМИ, фактчекерам и другим организациям по запросу.
Представлен ImageEval 2026 — набор задач для проверки культурной точности моделей, работающих с изображениями и арабским языком.
Новый бенчмарк GreenBench показал: инференс LLM на Apple M4 Pro потребляет в 30-40 раз меньше энергии, чем датацентровые GPU, при 0.47 Вт на пакет CPU+GPU.
Исследователи представили SciIG — задачу оценки LLM по генерации введений к научным работам. LLaMA-4 Maverick показал лучшие результаты.
Исследователи представили VibeJam — браузерную платформу с открытым кодом для онлайн-изучения взаимодействия разработчиков с AI-агентами при создании веб-сайтов.
Пентагон запустил защищённые версии ChatGPT и Grok — ChatGPT Mil и Grok for Government. Рассказываем, что известно о военных ИИ-ассистентах.
Исследователи представили Qwen-GuidePlay-2B — модель для диалоговых игр, обученную трёхэтапным методом. Модель заняла второе место в Playpen challenge, показав
Проект с открым исходным кодом OpenClaw выпустил крупнейший релиз 2.0 — с упрощённой настройкой, перестроенным браузерны приложением и поддержкой
Тестирование модели Codex выявило, что ИИ-агенты систематически завышают или занижают время выполнения задач в 6–10 раз. Это ставит под сомнение их автономность в
Google Research анонсировала WikiSkill — разработку для ИИ-агентов. Что известно и какие перспективы открывает направление — в материале AI-Sphere.
OpenAI объявила о прекращении контракта с Cursor с 12 ноября 2026 года. Разработчики сохранят доступ к моделям через собственные ключи API.
Anthropic заявляет о сокращении времени интеграции лабораторного оборудования с недель до часов благодаря новому протоколу, расширяющему Model Context Protocol.
OpenAI подтвердила тестирование Persistent Mode для Codex — режима, при котором AI-агент остаётся активным и может запускаться самостоятельно. Что это значит для
Вышел новый препринт CG4AI: ансамбль ИИ-моделей собирают под линейные ограничения. Разбираем суть метода, четыре сценария на MNIST и практическую пользу.
OpenAI собрал более 100 компаний для подписания открытого письма, предупреждающего о неизбежных кибератаках на критическую инфраструктуру с использованием ИИ.
Инцидент с участием 1200 изолированных AI-агентов, обменявшихся более 70 000 сообщений и файлов. Подробности и значение для безопасности AI.
Сатирический портал Felony Bench сообщил о восьми инцидентах с моделями Anthropic. Данные не подтверждены, но привлекли внимание к безопасности ИИ.
Исследователь 'roon' описал гипотетическую модель ИИ, работающую в 50 раз быстрее лучших современных систем. Это не реальный анонс OpenAI, а концептуальное рассуждение.
EDB является спонсором материала на AI-Sphere. Спонсорство подтверждено. Узнайте, что это значит для пользователей.
Исследование arXiv:2608.24901: декодируемое направление эмпатии в LLM не гарантирует контролируемое изменение эмпатии. Проверка на трёх моделях показала лишь частичный сдвиг.
Anthropic добавил встроенный браузер в боковую панель десктоп-приложения Claude Cowork для загрузки страниц, чтения и кликов.
Nvidia покупает Hugging Face за 12,9 млрд долларов — крупнейшая сделка в AI-секторе. Рассказываем, что это значит для рынка и пользователей.
Nvidia объявила о приобретении Hugging Face за 12.9 млрд долларов. Сделка объединяет производителя AI-чипов и платформу для моделей машинного обучения.
Обзор AI/ML Life Cycle Management для AI Native RAN: архитектура LCM, KPI-мониторинг, межвендорное взаимодействие в 3GPP Releases 17-20. arXiv preprint.
Организации в основном прикручивают разговорный ИИ к legacy-системам, что ограничивает его потенциал. Объясняем, почему такой подход вредит эффективности AI-агентов.
Z.ai официально подтвердила, что модель Ox Alpha является последней итерацией серии GLM. Это заявление проясняет статус модели в линейке китайских AI-решений.
OpenAI выпустила наиболее полный на сегодняшний день отчёт об инциденте безопасности. Разбираем, почему это важно для индустрии ИИ.