
Три новых LLM за один день: Qwen 3.8‑Max, DeepSeek V4 Pro 0813 и Grok 4.6
Новые крупные языковые модели
Alibaba открыла открытые веса Qwen 3.8‑Max, 8‑биллионной модели с улучшенной контекстной обработкой. DeepSeek выпустила V4 Pro 0813 в виде API, обещая более быстрый отклик и поддержку до 128 k токенов. xAI анонсировала Grok 4.6, уже доступный в сервисе Grok‑Chat, с повышенной точностью в программировании.
Qwen 3.8‑Max
Модель построена на архитектуре Transformer‑XL, использует 8 млрд параметров и поддерживает контекст до 32 k токенов. Alibaba разместила веса в открытом репозитории, позволяя исследователям экспериментировать без ограничений.
DeepSeek V4 Pro 0813
API‑версия предлагает 4 млрд параметров, ускоренную инференцию на GPU A100 и возможность интеграции в корпоративные решения. DeepSeek заявила о снижении «галлюцинаций» на 30 % по сравнению с предыдущей версией.
Grok 4.6
Grok 4.6 ориентирован на агентные сценарии: автоматически генерирует код, управляет инструментами и планирует последовательные действия. По словам xAI, модель решает задачи в среднем на 20 % быстрее, чем Grok 4.5.
Все три релиза стремятся перейти от простого чат‑бота к самостоятельным агентам, способным выполнять длительные и сложные задачи.



Комментарии 0