Новости ИИ: технологии, продукты, исследования
Здесь вы увидите самые свежие и интересные новости об искусственном интеллекте (ИИ)!
-
SWE-Perf: Первый бенчмарк для оптимизации производительности кода на уровне репозитория
Введение С ростом популярности больших языковых моделей (LLMs) в программной инженерии задачи оптимизации производительности стали актуальными как никогда. Исследователи TikTok вместе с другими организациями представили SWE-Perf — первый бенчмарк, разработанный для оценки способности LLM оптимизировать производительность кода на уровне репозиториев. Этот шаг призван преодолеть недостатки предыдущих бенчмарков, сосредоточенных на корректности или эффективности на уровне функций.…
-
Автономное Открытие: Инновационный Подход AI к Научным Исследованиям
Автономное открытие с помощью AutoDS Институт искусственного интеллекта Аллена (AI2) представил AutoDS (Автономное Открытие через Сюрприз) — прототип системы для открытого автономного научного открытия. В отличие от традиционных AI-ассистентов, которые опираются на заранее определенные цели, AutoDS самостоятельно генерирует, тестирует и уточняет гипотезы, измеряя и стремясь к «байесовскому сюрпризу» — показателю подлинного открытия, выходящему за рамки…
-
Умный конвертер кода Python в R с валидацией и обратной связью на основе AI Gemini
Создание Умного Конвертера Кода Python в R с Поддержкой Gemini AI В современном мире анализа данных, где Python и R являются двумя основными языками программирования, необходимость в эффективном конвертере кода становится все более актуальной. В этой статье мы рассмотрим, как создать умный конвертер кода Python в R, используя возможности Gemini AI для валидации и обратной…
-
MIRIX: Модульная система памяти для улучшенного долгосрочного мышления и персонализации в агентах на базе LLM
MIRIX: Модульная многопользовательская система памяти для улучшенного долгосрочного мышления и персонализации в LLM-агентах С развитием технологий искусственного интеллекта возникает всё больше решений для автоматизации бизнеса, и одно из них — MIRIX. Эта система предлагает уникальный подход к управлению памятью и взаимодействию с пользователями. В этой статье мы рассмотрим, как MIRIX может трансформировать работу LLM-агентов, делая…
-
Доверие к моделям вознаграждения LLM: Master-RM выявляет и исправляет уязвимости
Можно ли доверять моделям вознаграждения LLM? Master-RM раскрывает и исправляет их слабости В последние годы модели вознаграждения на основе больших языковых моделей (LLM) становятся все более популярными в области обучения с подкреплением с проверяемыми вознаграждениями (RLVR). Эти модели предпочитают использоваться для задач, требующих открытых или сложных ответов, поскольку они способны оценивать ответы, сравнивая их с…
-
Протокол Модельного Контекста (MCP) для Предприятий: Безопасная Интеграция с AWS, Azure и Google Cloud
Model Context Protocol (MCP) for Enterprises: Secure Integration with AWS, Azure, and Google Cloud — 2025 Update MCP: Обзор и экосистема Протокол контекста модели (MCP) — это открытый стандарт, основанный на JSON-RPC 2.0, который позволяет ИИ-системам, таким как крупные языковые модели, безопасно взаимодействовать с функциями, инструментами, API или хранилищами данных, предоставляемыми любым сервером, совместимым с…