nopetnoget

LongCat-Video

LongCat-Video — це фундаментальна модель генерації відео від Meituan з 13.6 млрд параметрів. Унікальність полягає в єдиній архітектурі, яка нативно підтримує три задачі: генерацію відео за текстом, за зображенням та продовження існуючого відео. Модель спеціалізується на генерації довгих відеороликів — може виробляти контент тривалістю в кілька хвилин без зсуву кольорів та падіння якості. Інфраструктура реалізує коарс-туфайн стратегію генерації по часовій та просторовій осях, а Block Sparse Attention забезпечує ефективний інфренс. На 720p 30fps відео генерується за хвилини. Модель тренована з використанням multi-reward GRPO (Group Relative Policy Optimization), що дозволило досягти якості, порівнянної з лідерами open-source сегменту та комерційними рішеннями.

Dla kogo

ML-інженери, розробники AR/VR контенту, студії анімації та відеопродакшену, які працюють з синтезом відео. Підійде команді, що шукає open-source базу для кастомізації під специфічні задачі генерації. Цікава для дослідників, що вивчають world models та довгоконтекстну генерацію.

Opinie o projekcie

Nie ma jeszcze opinii — bądź pierwszy.

Zaloguj się, aby zostawić opinię.