Перейти до вмісту

M-Forge

M-Forge - це єдиний медіахаб за адресою /m-forge - одне місце для всіх видів медіа, які ви створюєте в MAVEN. Його вкладки верхнього рівня: AI-Vision, Compose, Remove Watermark, Studio (Story / Cut / Dub), OpenMontage, Music, Thumbnails і браузерна Media Content Lab. OpenMontage, Music і Thumbnails раніше були окремими застосунками, а тепер стали тут вкладками.

M-Forge - M.A.V.E.N

Дозвольте моделі подивитися відео. Вставте URL (YouTube/Loom/TikTok/… через yt-dlp) або локальний файл, оберіть Task (Summarize, Transcribe, Key moments, Hook analysis, Notes, Diagnose bug або довільний запит) і Language - і модель відповість з опорою на реальні кадри та транскрипт.

  • Виконується як фонове завдання - триває, якщо ви перемкнетеся на інший застосунок (після повернення показується значок Running).
  • Повторно використовує оброблене відео для подальших запитань (без повторного перегляду).
  • Дублює кожну відповідь у ваше сховище (vault) Obsidian у ~/Obsidian/maven-os/vision/.
  • Випадний список Model показує візуальні моделі, які відкривають ваші ключі: Claude читає кадри нативно; Gemini / GPT-4o / Kimi / OpenRouter отримують кадри як зображення.
  • Мову виводу гарантує модель, тож навіть англійські субтитри повертаються обраною вами мовою.
  • розгортає на весь екран; + New session починає нове відео, зберігаючи вашу історію.

Працює на Windows, macOS і Linux. Для завантаження відео з YouTube потрібне середовище виконання JavaScript, і M.A.V.E.N передає завантажувачу той Node, на якому вже працює, замість просити вас встановити ще один.

Замовляє анімовані HTML-відеокомпозиції через запуск Claude Code, з переглядом і списком Projects (раніше - окремий застосунок Video). Потребує CLI claude.

Видаляйте або додавайте водяні знаки й логотипи на зображеннях та відео. Перемикач Pipeline обирає між:

  • Local · on-device - ваш власний ~/wm-engine (GPU). Зображення = інпейнт LaMa за намальованою маскою; відео обрізається навколо вашої рамки з варіантами Smooth · LaMa (швидко, менше мерехтіння; типово), ProPainter (на основі потоку, практично нульове мерехтіння - найкращий, але повільний, ~30-40 с на секунду відео) і Sharp · LaMa (покадрово). Повністю офлайн, без токена, без обмежень; значок стану показує GPU. Потребує одноразового налаштування рушія.
  • Cloud · HF Space - проксіює до smmisha/watermark-remover (Gemini/LaMa/OpenCV) через його REST API, тримаючи HF_TOKEN на боці сервера.

Три вкладки:

  • Image - намалюйте маску пензлем або скористайтеся інструментом рамки. Результати зберігаються в wm-removal/.
  • Video - розтягніть рамку; живий лічильник кадрів і смуга прогресу на довгих завданнях. Результати зберігаються в wm-removal/.
  • Add logo / text - перетягніть зображення/відео, намалюйте рамку, яку можна пересувати й змінювати розмір, додайте PNG-логотип або текст/нотатку з кольором і прозорістю → впікається через ffmpeg. Результати зберігаються в overlays/.

Скрізь вихідний кадр має масштабування - кнопки плюс колесо миші (до 16×; прокрутка для панорамування) - для точного виділення. (Результати видалення також потрапляють у mwm-removal/.) Усі результати зберігаються у ваше сховище Obsidian.

Два - тепер уже три - виробничі конвеєри, які обираються карткою режиму (як поділ курс/презентація в P-Forge). Усі вони - порти платних навичок Claude на безкоштовні рушії MAVEN.

Написана історія перетворюється на послідовність ілюстрацій, що зберігають тих самих персонажів, локації та стиль від сцени до сцени. Інструмент пише візуальну «біблію», малює один еталонний кадр для кожного персонажа/локації, а потім малює кожну сцену з прикріпленими цими кадрами, щоб рудоволоса дівчина залишалася тією самою дівчиною впродовж усієї історії. Безкоштовно на Gemini через проксі Antigravity. Потрапляє в ~/Obsidian/maven-os/story/<slug>/.

Сирий запис «голови, що говорить» перетворюється на чистий монтаж. Інструмент транскрибує з таймінгами на рівні слів (автоматично обирає безкоштовний рівень Whisper від Groq, якщо задано GROQ_API_KEY, інакше - повністю локальний faster-whisper), обрана вами модель вирішує, які фрагменти прибрати (слова-паразити, фальстарти, паузи - типово консервативно), довгі тиші обрізаються детерміновано, а ffmpeg рендерить один безшовний майстер. Модель ніколи не торкається ffmpeg - вона лише ухвалює редакторське рішення щодо тексту. Майстери потрапляють у ~/Obsidian/maven-os/studio-cut/.

Озвучення іншою мовою. Дайте йому локальний файл, завантаження або YouTube/URL (отримується через yt-dlp). Інструмент транскрибує з таймінгами, перекладає кожен рядок обраною вами моделлю, озвучує його та вкладає кожен кліп назад в оригінальну часову шкалу. Спершу запустіть 10-секундний попередній перегляд, щоб підібрати налаштування, а потім повний дубляж.

  • Два рушії TTS - безкоштовний Supertonic (31 мова, офлайн, голоси F1-M5) або ElevenLabs із пікером моделі (v3 / multilingual v2 / turbo / flash / v1) і власним списком голосів.
  • Тонке налаштування - темп, тембр (висота), рівень музики, а також stability / similarity / style для ElevenLabs.
  • Keep original music - підмішує новий голос під вихідну музику; вмикається після встановлення demucs.
  • Вихід - відтворюється прямо у вкладці й завантажується як .m4a або .mp3; з відео на вході виходить дубльований .mp4. Потрапляє в ~/Obsidian/maven-os/studio-dub/.

DUB - це фонове завдання з кнопкою New session - перейдіть до іншого застосунку й поверніться: воно ще триває.

Усі три конвеєри Studio типово працюють на безкоштовних рушіях; опція ElevenLabs у DUB - єдиний платний шлях, і їй потрібен ELEVENLABS_API_KEY у .env.local.

AI-«фільми» - довший запуск Claude Code збирає композицію у вашому репозиторії OpenMontage, відстежуваний за pid і вихідним файлом (раніше - окремий застосунок OpenMontage). Change folder вказує на ваш репозиторій, якщо ви клонували його в інше місце. Під час запуску агент може запустити живу розкадровку Backlot на http://127.0.0.1:4750; Stop Backlot вимикає її (скасування рендеру зупиняє лише агента Claude, а не Backlot). Потребує CLI claude (з виконаним входом) і ffmpeg у PATH; типовий шлях до репозиторію - ~/OpenMontage (перевизначається через OPENMONTAGE_DIR). Режим фільму використовує fal.ai (Veo / Kling / MiniMax / Seedance) - задайте FAL_KEY. Рендери потрапляють у ~/.maven/openmontage/<id>.mp4 і з’являються в Медіатеці.

Музична студія Suno (раніше - окремий застосунок Music). Оберіть модель, введіть промпт (за бажанням - інструментал) і генеруйте; готові треки та обкладинки потрапляють на диск, а залишок ваших кредитів Suno показується у вкладці. Потребує SUNO_API_KEY у .env.localsunoapi.org). Результат зберігається в ~/.maven/music і з’являється в Медіатеці.

Social Networks Posts Covers - генерує обкладинки й дописи для соцмереж моделями зображень fal.ai (раніше - окремий застосунок Thumbnails). Опишіть обкладинку (або попросіть редизайн), оберіть Model (FLUX.1 schnell / dev, FLUX1.1 pro / ultra, Recraft V3, Ideogram V3 - для кожної показується ≈ ціна за зображення), Format / size (універсальні співвідношення плюс пресети YouTube, Instagram, TikTok, X/Twitter, Facebook, LinkedIn, Pinterest і OG) та кількість. Потребує FAL_KEY (приймається також як FAL_API_KEY); KIE_API_KEY за бажанням додає kie.ai як другого провайдера. Результат зберігається у вашому сховищі в Thumbnails/ і з’являється в Медіатеці.

Браузерна лабораторія ffmpeg.wasm: ~29 швидких медіаоперацій, які виконуються повністю у вашому браузері - нічого не вивантажується, нічого не покидає вашу машину. Сімейства операцій охоплюють GIF maker, compress, format-convert, resize, extract / mix / mute audio, trim, speed та інше. Оскільки все виконується на боці клієнта, їй не потрібні ні ключ, ні рушій, ні мережа.

  • Пікер Медіатеки в кожному полі файлу - замість пошуку на диску підтягуйте медіа, які ви вже згенерували в M.A.V.E.N (S-Forge, OpenMontage, Music, Thumbnails, Studio, …), прямо з вашої Медіатеки.
  • Автозбереження у сховище - результат лабораторії автоматично зберігається у ваше сховище Obsidian, тож він з’являється поруч з усім іншим, що ви створили.
  • yt-dlp - для URL-джерел в AI-Vision і Studio → Cut / Dub (YouTube/Loom/TikTok/…). Локальним файлам/завантаженням потрібен лише ffmpeg. Встановіть окремий бінарник у ~/.local/bin (або brew install yt-dlp). yt-dlp також встановлюється скриптом scripts/setup-free-engines.sh.
  • ffmpeg - потрібен для впікання водяних знаків, Cut і Dub.
  • Compose - CLI claude з виконаним входом.
  • Remove Watermark · Local - одноразове налаштування ~/wm-engine: bash scripts/wm-engine/setup.sh, потім bash scripts/install-autostart.sh --now (реєструє wm-engine.service на :8189). Потребує python3.11 (PyTorch не має wheel-пакетів для 3.14), ffmpeg і ~6 ГБ на диску; GPU NVIDIA необов’язковий, але рекомендований (інакше - запасний варіант на CPU). Ціль перевизначається через WM_ENGINE_URL, пристрій - через WM_DEVICE=cpu|cuda.
  • Remove Watermark · Cloud - нічого встановлювати не треба; задайте HF_TOKEN (зберігається на боці сервера).
  • Studio · транскрипція Cut / Dub - GROQ_API_KEY обирає безкоштовний рівень Whisper від Groq; без нього використовується локальний faster-whisper у venv Studio (~/.maven/studio/venv), без ключа. (Groq тут обслуговує Whisper - це не Grok від xAI.)
  • Studio · Dub - безкоштовний Supertonic (~/.maven/supertonic/venv, встановлюється скриптом scripts/setup-free-engines.sh) - типовий TTS; ElevenLabs (ELEVENLABS_API_KEY) - платна альтернатива. Для keep original music потрібен demucs у venv Studio (~/.maven/studio/venv/bin/pip install demucs, тягне torch, ~2 ГБ).
  • Studio · Story - безкоштовно на Gemini через проксі Antigravity.
  • AI-Vision зберігає оброблене відео, тож ставте подальші запитання, не платячи за повторний перегляд.
  • Для видалення водяних знаків з відео без мерехтіння використовуйте ProPainter, але розраховуйте на ~30-40 с на секунду матеріалу; коли важлива швидкість, беріть Smooth · LaMa.
  • У DUB завжди запускайте 10-секундний попередній перегляд перед повним дубляжем, щоб підібрати темп, тембр і рівень музики.
  • S-Forge - AI-режисер фільмів; його конвеєри Studio - також портовані платні навички.
  • P-Forge - використовує той самий безкоштовний голосовий стек Supertonic/ElevenLabs.
  • Local-first