Темы

воскресенье, 15 марта 2026 г.

Запуск DeepSeek V4 и новой модели Hunyuan от Tencent запланирован на апрель

Запуск DeepSeek V4 и новой модели Tencent Hunyuan запланирован на апрель

DeepSeek V4 — мультимодальная модель с триллионом параметров, улучшенными возможностями программирования и долговременной памяти — ожидается к запуску в апреле вместе с новой моделью Hunyuan от Tencent, сообщает Whale Lab.

Модель Hunyuan от Tencent, разработкой которой руководит бывший исследователь OpenAI Шуню Яо, будет иметь около 30 миллиардов параметров и приоритезирует удобство использования в качестве агента, а не высокие места в рейтингах бенчмарков.

Сообщается, что DeepSeek оптимизировала V4 для отечественных чипов производства Huawei и Cambricon, а также установила партнёрство с Baidu для усиления возможностей поиска с ИИ.

[По словам источников, знакомых с ситуацией, компания DeepSeek планирует выпустить свою большую языковую модель V4 на этой неделе, что станет первым крупным запуском с января 2025 года. Ожидается, что лаборатория в Ханчжоу представит V4 как мультимодальную модель, способную генерировать текст, изображения и видео.

Источники сообщили, что DeepSeek сотрудничала с китайскими производителями чипов для искусственного интеллекта Huawei и Cambricon для оптимизации V4 для их новейшего оборудования. DeepSeek, Huawei и Cambricon не сразу ответили на запросы о комментариях.]

Нет прямой связи между DeepSeek V4 и новой моделью Hunyuan от Tencent. Это две независимые разработки от разных компаний: DeepSeek V4 создаётся под руководством Лян Вэньфэна в DeepSeek, а Hunyuan — под руководством Яо Шунью (бывший исследователь OpenAI) в Tencent.

Они упоминаются вместе в контексте того, что, согласно отчёту Whale Lab от 14 марта 2026 года, оба релиза ожидаются в апреле, что усиливает конкуренцию на рынке китайских ИИ-моделей.

Ранее Tencent интегрировал модели DeepSeek в свои сервисы (например, в Hunyuan), но новая Hunyuan — это самостоятельный проект Tencent объёмом около 30 млрд параметров, ориентированный на длинный контекст и задачи агентов.

Недавно появившиеся на OpenRouter загадочные модели Healer Alpha и Hunter Alpha также, по мнению сообщества, связаны с грядущими отечественными (китайскими) моделями следующего поколения. В целом, отечественные производители крупных моделей ускоряют новый виток конкуренции в области многомодальных возможностей, долговременной памяти и возможностей применения в реальных условиях.

OpenRouter — это не просто сообщество, а унифицированная платформа-агрегатор для доступа к сотням LLM-моделей (более 300–500 от 50+ провайдеров) через единый API, совместимый с OpenAI. Она позволяет разработчикам и пользователям тестировать модели вроде GPT, Claude, DeepSeek или Qwen без смены кода, с автоматической маршрутизацией, мониторингом и низкой задержкой.

Ключевые функции

Единый интерфейс для интеграции, где можно переключаться между моделями и сравнивать их по цене/качеству.Поддержка playground для тестов, BYOK (bring your own key) и edge-вычислений для скорости.

Часто там появляются новые или тестовые модели (как Healer Alpha и Hunter Alpha), что делает платформу хабом для спотов от AI-сообщества .

В контексте Китая это популярный инструмент для проверки "отечественных" релизов до официального анонса.

Источники и контекст 





Комментариев нет:

Отправить комментарий

Избранные

Квантовый компьютер на захваченных ионах моделирует физику частиц с помощью кубитов и фононов

Учёные из Университета Мэриленда впервые использовали колебательные фононные моды захваченных ионов как нативный бозонный регист...

Часто просматриваемве