Архивы multimodal - AI Founder

Seedance 2.5

ByteDance представила Seedance 2.5 — модель для генерации и редактирования видео со звуком. Она создаёт ролики длительностью до 30 секунд за один проход и поддерживает многократное продолжение сцен с сохранением персонажей, окружения и темпа повествования. За один запрос можно загрузить до 30 изображений, 10 видео и 10 аудиозаписей. Модель использует их как референсы для персонажей, … Читать далее

Qwen3.8-Max

Qwen Team представила Qwen3.8-Max — крупнейшую модель серии Qwen с 2,4 трлн параметров, из которых 95 млрд активны. Модель уже доступна через QwenCloud, а открытые веса обещают выпустить на следующей неделе. Qwen3.8-Max рассчитана на программирование, исследования, офисные задачи и длительную автономную работу. В одном эксперименте она более 16 дней развивала проект oh-my-cli, создав 265 commits, … Читать далее

Muse Spark

Meta представила Muse Spark — первую модель новой линейки Muse от Meta Superintelligence Labs. Это нативно мультимодальная reasoning-модель с поддержкой инструментов, visual chain of thought и multi-agent orchestration. Одновременно компания анонсировала Contemplating mode — режим, в котором несколько агентов думают параллельно над одной задачей. В Meta говорят, что это заметно усиливает модель на сложных тестах … Читать далее

Qwen3.6-Plus

Qwen представила Qwen3.6-Plus — новую модель, которую делает ставку на агентные задачи, кодинг и мультимодальность. Главный акцент — на работе с реальными сценариями, где модели нужно не просто отвечать, а планировать, помнить контекст и пользоваться инструментами. В компании особенно выделяют рост в agentic coding: от фронтенда до сложных задач на уровне целых репозиториев. Также модель … Читать далее