Kling AI
Kling AI — генеративный AI-сервис от китайской компании Kuaishou для создания видео и изображений по текстовым описаниям.
О компании
Kling AI — это генеративный AI-сервис, созданный пекинской технологической компанией Kuaishou, основанной в 2011 году. Первая версия Kling AI была запущена в июне 2024 года и стала доступна для публичного тестирования в рамках видеоредактора KuaiYing. Платформа позиционируется как «AI-студия нового поколения» для создания видео и изображений.
В основе Kling AI лежит архитектура диффузионного трансформера (DiT), дополненная собственной 3D-вариационной автоэнкодерной сетью (VAE) и механизмом пространственно-временного моделирования. Это позволяет генерировать видео с разрешением до 1080p, длительностью до 2 минут, точно воспроизводя сложные движения и физические взаимодействия объектов. Модели доступны в режимах Standard, Pro и Master.
С момента запуска платформа активно развивается: в декабре 2024 вышла версия Kling 1.6, затем Kling 2.0 и 2.1 в 2025 году, а в 2026 году — серия Kling 3.0 с единой мультимодальной архитектурой, поддерживающей генерацию видео, аудио и изображений в рамках одной системы.
Все модели Kling AI (9)
🎬Видео (9)
Флагман видеогенерации от Kuaishou (5 февраля 2026): до 15 секунд, нативные 4K и до 60 кадров/с, синхронное аудио прямо в кадре и до 6 разных планов в одном клипе с сохранением связности. Липсинк на 5 языках. Один из топ-3 видеогенераторов наравне с Sora и Veo. От $6.99/мес.
Управляемая версия Kling 3.0 (февраль 2026), официально — Video 3.0 Omni. Решает главную боль видеогенерации: удержание одного и того же персонажа между сценами. Загружаете видео или 1-3 фото — модель считывает внешность и голос и переносит их в новые кадры. Плюс правки готового видео с сохранением движения: сменить одежду, время суток или стиль.
Продвинутый контроль движений в Kling 3.0: управление камерой и объектами в Video-to-Video.
Версия, в которой Kling впервые научился генерировать звук вместе с картинкой за один проход (декабрь 2025): речь, шумы, окружение и даже пение, с точным попаданием губ в кадр. До 10 секунд в 1080p, озвучка на китайском и английском. Сегодня — недорогая альтернатива флагману 3.0, если 4K и 15 секунд не нужны.
Отдельная модель Kling под говорящие головы: даёте одно фото и аудиофайл — получаете видео, где человек на снимке произносит вашу запись с точным попаданием губ. Ключевое отличие от обычных видеомоделей — длительность до 5 минут вместо 10 секунд. Работает с фотографиями, рисованными персонажами и стилизованными аватарами.
Версия, которая сделала Kling массовым (23 сентября 2025): в три раза быстрее прошлых моделей и почти на 30% дешевле — 25 кредитов за 5 секунд в 1080p вместо 35. По официальным замерам Kuaishou обходила Veo 3 Fast и Seedance 1.0. Звука не умеет — он появился только в 2.6. Сегодня это самый выгодный вариант для немого видео.
Версия 2.6 с продвинутым контролем движения камеры и объектов в Video-to-Video режиме.
Версия мая 2025, в которой Kling впервые разделили на три режима — Standard, Pro и Master. Именно она починила главные болячки ИИ-видео того времени: ломающуюся физику, уползающий от промпта сюжет и мерцание кадра. Сегодня устарела: вышедшая следом 2.5 Turbo втрое быстрее и на 30% дешевле при лучшем качестве.
Версия декабря 2024 года, с которой Kling стал по-настоящему рабочим инструментом: сюда добавили фиксацию первого и последнего кадра — задаёте начало и конец пятисекундного ролика, а модель дорисовывает движение между ними. Сегодня безнадёжно устарела и держится в API только как самый дешёвый вариант для простых задач.