Communitygithub.com

shutckin/aivfx-content-kit

Packages YouTube videos and Shorts: a pack of 3-4 thumbnail variants of one idea for choice and A/B testing, title and thumbnail as one unit, one idea per image, face and emotion, a large object, text up to 3-4 words or none, readable on a small phone screen. Works from own frames and screenshots plus references, generates or refines the frame with models (Nano Banana, Seedream, GPT-Image, Higgsfield and others) with the film-look style and logos in one pass, keeps a consistent channel series, checks the file with a script (size, weight, name), reviews the small view by eye on a contact sheet and shows options to the owner before upload. Triggers: 'YouTube thumbnail', 'video packaging', 'thumbnail A/B test', 'Shorts cover', 'title and thumbnail'. Triggers (RU): «сделай превью», «обложку для ролика», «обложку для YouTube», «упакуй ролик», «варианты для A/B-теста», «заголовок и превью», «обложку для Shorts», «серия превью для канала».

aivfx-content-kit란 무엇인가요?

aivfx-content-kit is a Claude Code agent skill that packages YouTube videos and Shorts: a pack of 3-4 thumbnail variants of one idea for choice and A/B testing, title and thumbnail as one unit, one idea per image, face and emotion, a large object, text up to 3-4 words or none, readable on a small phone screen. Works from own frames and screenshots plus references, generates or refines the frame with models (Nano Banana, Seedream, GPT-Image, Higgsfield and others) with the film-look style and logos in one pass, keeps a consistent channel series, checks the file with a script (size, weight, name), reviews the small view by eye on a contact sheet and shows options to the owner before upload. Triggers: 'YouTube thumbnail', 'video packaging', 'thumbnail A/B test', 'Shorts cover', 'title and thumbnail'. Triggers (RU): «сделай превью», «обложку для ролика», «обложку для YouTube», «упакуй ролик», «варианты для A/B-теста», «заголовок и превью», «обложку для Shorts», «серия превью для канала».

지원 대상~Claude Code~Codex CLI~Cursor
npx skills add https://github.com/shutckin/aivfx-content-kit/tree/HEAD/skills/youtube-thumbnail

즐겨 사용하는 AI에게 물어보기

이 에이전트 스킬이 미리 로드된 새 채팅을 엽니다.

문서

Превью и упаковка YouTube-роликов

Instructions are in Russian. Respond in the user's language.

Зачем

Превью и заголовок решают, нажмут ли на ролик в ленте, в поиске и в рекомендациях. Сам ролик может быть отличным, но если карточка на телефоне читается как серое пятно с мелкими буквами, до просмотра дело не дойдёт.

Две частые беды. Первая: скриншот из ролика с подкрученным цветом. Он честный, но плоский: в ленте рядом стоят кадры, где свет и атмосфера сильнее, чем в любом сыром кадре. Вторая: «красивая картинка» в стиле Pinterest, где герой крошечный, а вокруг много воздуха. На экране телефона от неё остаётся пустой прямоугольник.

Скилл собран из рабочего процесса маленькой студии: каждое правило ниже появилось после варианта, который пришлось переделать.

На чём работает

ЧтоЗачем здесь
Кадры и скриншоты роликареференсы-опора: лицо, одежда, продукт, место
Seedream 5 Pro и Nano Banana через Higgsfield, Flowith или аналогставят из референсов новый кадр со светом под превью; модели сравниваются, одна держит лицо, другая сильнее в свете
Лук из film-lookхвостом в каждом промпте, соотношение сторон параметром
PNG-логотипы с официального сайталоготип рождается в кадре вместе со сценой; только PNG: в Higgsfield CLI JPEG падает с ошибкой подписи хранилища только в логе, и генерация молча уходит без референса, поэтому проверяй логи
Редактор (Photoshop или аналог)точный текст отдельным слоем после генерации: модели путают кириллицу
scripts/check_thumb.pyразмер, вес и имя файла; уменьшенный просмотр делается глазами на контактном листе
Агент и владелецагент делает 3-4 варианта и контактный лист, владелец выбирает и сам решает про загрузку

Когда включать

  • Нужно превью к ролику на YouTube или обложка для Shorts.
  • Нужно упаковать ролик целиком: превью, заголовок, описание, теги.
  • Нужны 3-4 варианта для теста превью (на YouTube это «Тест и сравнение»).
  • Канал хочет единую серию, чтобы ролики узнавались в ленте.

Обложки для статей и страниц делает article-cover, лук для промптов берётся из film-look.

Порядок работы

  1. Бриф. Заполни templates/thumb-brief.md: тема ролика, что зритель должен почувствовать за секунду, главный объект, текст на превью, рабочий заголовок, свои кадры и референсы с ролями. Пустые поля в первых трёх блоках значат, что генерировать рано.
  2. Одна мысль. Запиши одной фразой: «Превью обещает: ...». Это не тема («обзор камеры»), а чувство или интрига («эта камера снимает лучше, чем стоит»). Если фраз две, выбери одну, вторую отдай заголовку.
  3. Связка с заголовком. Сразу напиши 3-5 вариантов заголовка. Превью даёт эмоцию, заголовок даёт факты и слова для поиска. Не дублируй одно и то же: если на картинке «ТИШИНА», в заголовке не нужно ещё раз «тишина».
  4. Свои материалы. Собери из ролика 10-20 кадров равномерно по таймлайну (контактный лист), выбери 2-4, где лучше всего видно героя, лицо, продукт, место. Это опора для генерации, а не готовое превью.
  5. Роли референсов. Каждому референсу назначь одну роль: внешность и лицо, продукт, место, композиция, свет, настроение. Один референс на всё сразу работает плохо.
  6. 3-4 разных концепта. Не четыре дубля одного кадра, а разные приёмы: крупное лицо с эмоцией, объект-герой, герой в атмосферной сцене, кадр «до и после» или «против». Опиши каждый одной строкой в брифе.
  7. Генерация или доработка (раздел ниже). Лук из film-look хвостом каждого промпта, соотношение сторон только параметром модели.
  8. Текст на превью отдельным шагом (раздел «Текст»).
  9. Проверка. Скрипт scripts/check_thumb.py для размера, веса и имени, глазами для смысла: каждое превью в уменьшенном виде рядом с чужими.
  10. Показ владельцу. Все варианты одним сообщением, пронумерованные, с рекомендацией и вариантами заголовка. Пока владелец не выбрал, ничего не загружай на канал и не запускай тест.
  11. Сохранение. Финалы под понятными именами в папку ролика, рабочие кадры и промпты рядом, ничего не перезаписывай.

Правила кадра

Одна мысль. Глаз за полсекунды понимает, куда смотреть. В кадре не больше 2-3 элементов: герой, одна деталь, текст. Всё остальное фон.

Лицо и эмоция. Живое лицо с понятной эмоцией цепляет сильнее всего: удивление, сосредоточенность, усталость, восторг. Если лица нет по замыслу (шлем, маска, спина героя), его заменяет узнаваемая деталь, которая повторяется из ролика в ролик и становится «лицом» канала.

Крупный объект. Герой занимает заметную часть кадра. Маленький силуэт в огромном пейзаже красив для обложки плейлиста или шапки канала, но как превью отдельного ролика не работает: на телефоне его не видно.

Контраст. Герой отделён от фона светом или цветом: тёплый объект на холодном фоне, светлое лицо на тёмном, резкое на мягком. Если герой и фон одной яркости, превью сливается с соседями.

Атмосфера сильнее, чем в ролике. Превью может быть киношнее исходника: драматичное небо, контровой свет, дымка, мокрый асфальт, низкое солнце. Но обещать надо то, что внутри: место, героя, настроение. YouTube в тесте превью выбирает победителя по времени просмотра, а не по кликам, поэтому обман наказывается.

Нижний правый угол свободен. Там YouTube ставит длительность ролика. Лицо, текст и главный объект туда не ставь.

Мобильный экран первый. Большинство смотрит с телефона. Всё, что не читается в карточке шириной с палец, не существует.

Генерация и доработка

Сырой скриншот почти всегда проигрывает. Кадры ролика, фото героя и скриншоты идут в модель как референсы: внешность, поза, продукт, место. Модель ставит из них новый кадр со светом и композицией под превью. Коллаж из вырезанных кусков вместо генерации выглядит дешево.

Схема промпта, каждый блок отдельно:

  • Опора: что обязано остаться как на своих кадрах (лицо, одежда, форма продукта, цвет, место).
  • Стиль: что брать из референсов стиля (свет, оптика, настроение).
  • Композиция: крупность, где герой, где пустое место под текст, свободный правый нижний угол.
  • Свет: конкретно, словами оператора.
  • Запреты: без случайных букв, водяных знаков, лишних логотипов, CGI-глянца, без подмены героя или продукта.
  • Лук: ядро из film-look хвостом без изменений.

Правила, которые экономят время:

  • Соотношение сторон только параметром. 16:9 для роликов, 9:16 для Shorts. В тексте промпта его нет: в режиме правки по референсу модель без параметра часто отдаёт квадрат, а текст 4:3 спорит с параметром и режет кадр мимо.
  • Генерируй с запасом (2K), потом уменьшай до 1280x720 или 1080x1920.
  • Сравнивай модели. Одна лучше держит лицо по референсу, другая сильнее в свете. Если есть пакетный режим, бери пачку и отбирай.
  • Две неудачи подряд значат стоп. Если модель дважды теряет героя или уходит в постер не по теме, не дожимай в том же контексте и не чини коллажем. Начни заново: один референс-опора, 2-3 референса стиля, короткий промпт.

Логотипы в кадре за один проход. Ролик про конкретный сервис, продукт или бренд: логотип рождается в кадре вместе со сценой, как в article-cover. Кадр и логотип-референс (PNG с официального сайта) уходят в модель вместе, логотип описан как часть мира: экран в руке героя, нашивка, вывеска, корпус устройства. Логотип, наложенный потом в редакторе, выглядит приклеенным. После генерации зум на каждый знак: перепутанные буквы и упрощённая форма это брак.

Текст на превью

  • До 3-4 слов или без текста. Лучше 1-2 слова крупно, чем фраза мелко. Если картинка говорит сама, текст не нужен.
  • Текст это эмоция или интрига, не описание. «ДОРОГА ИСЧЕЗЛА» работает, «ПОЕЗДКА В ТУМАНЕ» нет, «НЕ ХУЖЕ?» работает, «ОБЗОР КАМЕРЫ» нет. Рычаги: чувство, вопрос, число, контраст, место.
  • Текст не повторяет заголовок. Они дополняют друг друга.
  • Как ставить буквы. Для точной кириллицы и фирменного шрифта текст ставится отдельным слоем после генерации: модели путают буквы и рисуют простоватый шрифт. Короткое латинское слово модель иногда рисует сама прилично, но проверяй каждую букву. Логотипы при этом не трогай: они уже в кадре.
  • Шрифт. Жирный гротеск, широкий или плотный, один на всю серию. Цифры тем же сансом с font-variant-numeric: tabular-nums там, где они стоят столбиком. Моноширинные и «терминальные» шрифты не используй.
  • Подложка. Мягкий растушёванный градиент под текстом, если не хватает контраста. Жёсткие плашки, овалы и рамки дают «колхоз».
  • Расположение под каждый кадр. Сначала найди, где реально пусто, туда и текст. Текст никогда не перекрывает лицо и главный объект.

Единая серия канала

Канал читается в ленте с одного взгляда, когда 5-10 роликов подряд держат один код: тот же шрифт, тот же приём с текстом, одна узнаваемая деталь героя, похожая палитра. Заведи файл серии канала (раздел внизу шаблона) и сверяйся с ним перед каждым паком. Менять код можно, но осознанно и сразу для всей серии, а не потому что в этот раз захотелось иначе.

Shorts

  • Формат 9:16, финал 1080x1920.
  • В ленте Shorts превью почти не видно, там автоплей. Обложка нужна для сетки канала и поиска. Главный рычаг Shorts это сильный первый кадр и текст в первую секунду ролика, а не обложка.
  • Текст ставь у верхнего края или по центру: низ занят подписью и кнопками.
  • В сетке канала обложка обрезается ближе к квадрату: героя держи в центре.

Имена файлов и хранение

  • Латиница, цифры, дефис. Без пробелов, кириллицы и скобок: так файл не ломается при загрузке, в ссылках и скриптах.
  • Формат: <слаг-ролика>-<буква-варианта>-<приём>-v<номер>.jpg, пример cheap-cam-a-face-v2.jpg.
  • Новая версия получает новое имя. Старые не перезаписывай: при тесте важно знать, какой именно файл загружен.
  • Структура папки ролика: sources/ (свои кадры и референсы), generated/ (оригиналы генерации), finals/ (готовые превью), previews/ (уменьшенные для показа). Не оставляй единственную копию в кэше генератора или в загрузках браузера.
  • Финал: 1280x720 для роликов, JPEG или PNG, до 2 МБ (лимит YouTube).

Проверка

python3 scripts/check_thumb.py finals/cheap-cam-a-face-v2.jpg
python3 scripts/check_thumb.py --shorts finals/cheap-cam-short-a-v1.jpg
python3 scripts/check_thumb.py finals/*.jpg
python3 scripts/check_thumb.py --make-test test-thumb.png

Скрипт без внешних библиотек читает заголовок PNG или JPEG и проверяет: размер 1280x720 (с --shorts 1080x1920), вес до 2 МБ, имя файла латиницей без пробелов. Код выхода 1 при нарушениях. --make-test создаёт серый PNG нужного размера, чтобы проверить сам скрипт.

Глазами проверка в уменьшенном размере обязательна, скрипт её не заменит. Уменьши превью до ширины около 200 пикселей (примерно так оно выглядит в ленте телефона) и поставь рядом с 5-6 чужими превью из той же темы. Вопросы: понятно ли за секунду, что это; читается ли текст; не теряется ли герой среди соседей; свободен ли правый нижний угол.

Показ владельцу

Одно сообщение, чтобы ответ был одним словом:

  • уменьшенные превью рядом (контактный лист);
  • пути к 3-4 финалам, пронумерованные;
  • рекомендация: какой вариант и почему, одной фразой;
  • 3-5 вариантов заголовка, при необходимости описание и теги.

Загрузка на канал, запуск теста превью и публикация только по прямому слову владельца.

Пример (короткий)

Ролик: месяц снимаю на недорогую камеру вместо дорогой, сравниваю кадры.

  • Мысль: «дешёвая камера оказалась не хуже».
  • A: крупно лицо автора с недоверчивой улыбкой, в руке маленькая камера, логотип производителя на корпусе сгенерирован в кадре. Текст «НЕ ХУЖЕ?».
  • B: две камеры на весах, дешёвая перевешивает. Без текста.
  • C: кадр пополам «до и после», в центре автор пожимает плечами. Текст «МЕСЯЦ СПУСТЯ».
  • Заголовок: «Месяц с дешёвой камерой вместо дорогой | Сравнение кадров».
  • Файлы: cheap-cam-a-face-v1.jpg, cheap-cam-b-scales-v1.jpg, cheap-cam-c-split-v1.jpg.

Типичные ошибки

  • Скриншот ролика с подкрученным цветом вместо поставленного кадра. Плоско, проигрывает соседям по свету.
  • Четыре варианта одного кадра. Тест сравнивает одно и то же, выбирать не из чего.
  • Мелкий герой и много воздуха. Красиво на большом экране, пусто на телефоне.
  • Пять слов текста. На телефоне это серая полоса.
  • Текст повторяет заголовок. Место потрачено дважды на одно и то же.
  • Кривые буквы от модели в кириллице. Видно сразу, выглядит небрежно.
  • Логотип наложен потом поверх кадра. Смотрится как наклейка.
  • Текст или лицо в правом нижнем углу под длительностью ролика.
  • Превью обещает то, чего нет в ролике. Клики есть, досмотра нет, и тест такое превью не выберет.
  • Каждый ролик в новом стиле. Канал не узнаётся в ленте.
  • Перезапись файла под тем же именем. Потом не понять, что загружено.

Чек-лист перед показом

  • Бриф заполнен, мысль превью записана одной фразой.
  • Заголовок и превью дополняют друг друга, не дублируют.
  • 3-4 разных концепта, не дубли.
  • Свои кадры использованы как референс, роли референсов назначены.
  • Лук из film-look в каждом промпте, соотношение сторон параметром.
  • Логотипы, если нужны, сгенерированы в кадре и проверены зумом.
  • Текст до 3-4 слов или без текста, буквы проверены.
  • Правый нижний угол свободен.
  • Проверено в уменьшенном размере рядом с чужими превью.
  • check_thumb.py прошёл: размер, вес, имя.
  • Серия канала соблюдена или изменение осознанное.
  • Варианты показаны владельцу, выбор получен до загрузки.

Что устаревает первым

Имена моделей, пакетные режимы и лимиты агрегаторов, правила теста превью на YouTube, лимит веса файла. Перед работой проверь справку инструмента и помощь YouTube, а не память. Правила кадра и текста устаревают медленно. Факты проверены на октябрь 2026.

Глубже

Полные шаблоны промптов, разборы реальных паков превью и настройку серии под конкретный канал студия AIVFX показывает в работе и в обучении: https://aivfx.ru

Individual skills in this repo

This repo contains 2 individual skills — each has its own dedicated page.

shutckin/aivfx-content-kit

Runs a client AI video for a concept studio from brief to delivery. Takes the brief and real product photos, writes a synopsis, builds character and location sheets with 3 options each, a 16:9 approval deck, stills in waves, one prompt for the whole video, client revisions as a list, assembly and a delivery checklist. Core rule: the client approves the preproduction package before the first video frame, and the approved character and location sheets go as references into every generation. Use when a brief arrives for an advertising or product AI video. Triggers: 'client AI video', 'preproduction package', 'character sheet', 'location sheet'. Not for articles or covers (use blog-article and article-cover). Triggers (RU): «вот бриф», «новый клиент», «концепт студия», «препродакшн-пакет», «лист персонажа», «лист локации», «презентация клиенту», «правки от клиента», «готовим сдачу».

shutckin/aivfx-content-kit

Makes motion graphics on the HyperFrames engine (HTML scenes rendered to video) with an AIVFX studio layer: name lower thirds, chapters, numbers, Shorts and Reels hooks, end cards, titles. The brand (colors, fonts, motion, durations) lives in one file, the video is a brief of scene roles, motion is set in words, and the agent renders a draft over footage and a final ProRes 4444 with alpha. Gives timing rules, 9:16 and 16:9 safe zones, lint and black-frame checks, a delivery checklist and a brand file checker. Triggers: 'lower third', 'motion graphics', 'chapter card', 'shorts hook', 'end card', 'transparent overlay', 'brand kit for motion', 'HyperFrames'. Triggers (RU): «сделай плашку», «нижняя треть», «плашка с именем», «заставка», «глава», «титры», «хук для шортс», «финальная карточка», «моушен для ролика», «графика с альфой для монтажа», «заведи бренд для графики», «сделай на хайперфреймс».

관련 스킬