Все темыТема

Модели

Новые модели ИИ, их возможности и ограничения: релизы, сравнения, результаты тестов и изменения в условиях доступа.

Новости и разборыНайдено: 43
Модели

Google выпустила EmbeddingGemma 2: модель для локального поиска по разным типам данных

EmbeddingGemma 2 преобразует текст, изображения, видео, аудио и код в векторы. Google заявляет, что модель с 740 млн параметров показывает результаты на мультимодальных тестах на уровне конкурентов вдвое крупнее.

2 мин чтения
Модели

TwelveLabs выпустила Pegasus 1.6 для разметки видео от первого лица

Модель сегментирует записи действий и формирует описания для подготовки данных обучения роботов. Однако преобразовать эти наблюдения в команды управления роботом разработчикам предстоит самостоятельно.

4 мин чтения
Модели

Reflection выпустила открытую модель Beam для программирования и ИИ-агентов

Модель с 501 млрд параметров активирует 23 млрд на каждый токен. Reflection утверждает, что на некоторых задачах Beam сопоставима с конкурентами при меньших вычислительных затратах; веса и документация должны появиться позднее.

3 мин чтения
Модели

Gemini 4 Argon догнала лидеров в ряде тестов, но расходует больше токенов

В рейтинге Artificial Analysis Gemini 4 Argon получила 53 балла и сравнялась с GPT-6 Astra и Claude Fable 5.1, но уступила Opus 5.5 и Sonnet 5.5. Вводный тариф ниже конкурентов, однако модель в среднем использовала больше выходных токенов на задачу.

2 мин чтения
Модели

Claude Sonnet 5.5 выполняет задачи до 30% дешевле

Anthropic выпустила Claude Sonnet 5.5: по заявлению компании, модель генерирует ответы более чем на 30% быстрее предыдущей версии и может снизить стоимость выполнения задачи максимум на 30%.

1 мин чтения
Модели

Nvidia выпустила открытую модель для распознавания до восьми собеседников

Nemotron 3 Diarization размечает говорящих в записи и живом аудио, включая одновременную речь. Модель насчитывает около 100 млн параметров; шум и большое число участников ухудшают точность.

1 мин чтения
Модели

Google добавила в Gemini 3.8 Live говорящего аватара

Google представила Live Avatar — анимированного персонажа, который в реальном времени отвечает собеседнику: двигает губами в такт речи и меняет выражение лица.

2 мин чтения
Модели

Google представила две TTS-модели Gemini с генерацией голосов по текстовому описанию

Flash TTS создаёт голос с заданными ролью, акцентом и тембром; обе модели поддерживают более 100 языков и режиссёрские указания для отдельных реплик. Голосовой клон требует 30-секундный образец и записанное согласие владельца голоса.

2 мин чтения
Модели

В Anthropic объяснили, почему новые Claude могут писать менее естественно

Инженер Anthropic Джексон Кернион связывает менее естественный стиль Claude с оптимизацией под код и технические объяснения. По его словам, Opus 5.5 нашла лучший баланс, но проблема не решена.

1 мин чтения
Модели

Anthropic выпустила Claude Opus 5.5 с более низкой ценой и меньшим расходом токенов

Anthropic утверждает, что новинка сопоставима с Fable 5.1 на большинстве задач и обходится примерно на 40% дешевле предшественника Opus 5. В бенчмарках модель лидирует по ряду сценариев, но GPT-6 Astra опережает её в автоматизации и научных исследованиях.

2 мин чтения
Модели

Anthropic усиливает защиту Claude Opus 5.5 от рискованных киберзадач

Anthropic заявляет, что Opus 5.5 реже пытается выйти из тестовой песочницы и получила лучший результат компании в комплексной проверке согласованности. Для части киберзапросов включается Opus 4.8, а для биологических запросов — Opus 5.

1 мин чтения