N
Neurogen
29.08.2026 16:23 · 👁 3K
MiniMax H3 Max видео за 3 секунды
Бесплатно и без регистрации
НЕ КЛИКБЕЙТ
На fal.ai залили плейграунд с minimax h3 max, пишешь промпт или закидываешь картинку и через 3 секунды получаешь 5 секундное видео сгенерированное в 768p, со встроенным стереозвуком
Дают 5 бесплатных генераций в день, даже рега не нужна, наверное это как то обходить можно, вполне возможно просто кеш сайта почистить
H3 Max - это пост-тренированная версия открытой модели MiniMax H3, доработанная командой fal Research и оптимизированная под максимальную скорость. В независимых оценках она занимает 1-е место по качеству, пониманию промпта и эстетике среди видеомоделей
https://fal.ai/tools/minimax-h3-max
N
Neurogen
28.08.2026 06:53 · 👁 2.6K
FireRedTTS3 Portable by Neurogen
Полноценная локальная студия синтеза и клонирования речи на базе FireRedTTS3. Упаковал модель, движок и все необходимые компоненты в самостоятельное portable-приложение для Windows
Отдельная установка Python, PyTorch, FFmpeg и системных зависимостей не требуется. Распаковали архив, запустили Neurogen.exe и работаете
🔘Что умеет Studio
- Voice Clone на базе FireRedTTS3 Base и Instruct.
- Voice Design: создание голоса по текстовому описанию.
- Semantic Edit для смысловой и текстовой коррекции речи.
- Acoustic Edit для работы с акустическими параметрами и звучанием.
- Очередь задач с отображением прогресса.
- Отмена, повторный запуск и удаление задач.
- Библиотека голосов.
- Сохранение референсов, транскрипций, языков и тегов.
- Экспорт в WAV, FLAC и MP3.
- Встроенный FFmpeg.
- Автоматический выбор профиля под доступную VRAM.
- Режимы CUDA, CPU и MPS там, где это поддерживается платформой.
- FP16 и BF16 для ускорения на современных GPU.
- SDPA attention.
- Экспериментальный int8/Quanto для экономии видеопамяти.
- Отдельный inference worker, чтобы интерфейс оставался отзывчивым во время генерации.
- Отображение GPU и доступной VRAM.
- Логи launcher и backend для диагностики ошибок.
- Single-instance launcher, чтобы приложение не запускалось в нескольких копиях.
- Все настройки и пользовательские данные хранятся рядом с приложением. Папку можно переносить на другой диск или внешний SSD.
🔘Для чего это подходит
- озвучки роликов и подкастов;
- создания голосов для игр и модов;
- локализации видео;
- генерации реплик персонажей;
- прототипирования дикторов и ведущих;
- работы с авторскими голосовыми библиотеками;
- экспериментов с дизайном и редактированием речи.
🔘Требования к видеопамяти
Основной режим рассчитан на пользователей с видеокартами от 8–16 ГБ VRAM.
- 16 ГБ VRAM и больше: рекомендуемый сценарий. CUDA, FP16/BF16 и комфортная работа с моделью.
- 8–12 ГБ VRAM: работа через CUDA и int8/Quanto. Лучше использовать короткие фрагменты и внимательно выбирать профиль памяти.
- 4 ГБ VRAM: полноценная загрузка модели в видеопамять не предполагается. Используется медленный CPU fallback/int8.
На тестовой машине с GTX 1650 4 ГБ и 16 ГБ оперативной памяти реальный Base Clone успешно отработал. Тестовый WAV получился в 24 кГц, mono PCM16, длительностью около 0,96 секунды. Время генерации составило примерно 216 секунд.
То есть на 4 ГБ приложение запускается, но это режим для проверки, экспериментов и небольших задач, а не для мгновенной генерации. Для комфортной работы ориентируйтесь на 8–16 ГБ VRAM и выше.
🔘Что входит в сборку
- Embedded Python 3.12.
- PyTorch и TorchAudio 2.8.0+cu128.
- PySide6.
- FireRedTTS3 engine.
- FireRedTTS3 Base.
- FireRedTTS3 Instruct.
- RedAE.
- Cam++.
- Tokenizer.
- FastText language identification model.
- FFmpeg.
- Launcher Neurogen.exe
Большие веса уже находятся внутри portable-сборки:
- Base: около 8,48 ГБ.
- Instruct: около 8,48 ГБ.
- RedAE: около 3,78 ГБ.
Размер всей портативки примерно 27,36 GiB
🔘Как запустить
1. Скачайте архив и распакуйте его через 7-Zip или встроенный tar.exe.
2. Перейдите в папку FireRedTTS3_Portable.
3. Запустите Neurogen.exe.
4. При первом запуске подтвердите уведомление об условиях использования.
СКАЧАТЬ
СКАЧАТЬ (Зеркало)
Hotfix ошибки mat/float/cuda
Примеры генераций модели
N
Neurogen
27.08.2026 19:34 · 👁 3.4K
Завтра релиз
N
Neurogen
27.08.2026 06:16 · 👁 5K
NVIDIA покупает Hugging Face за $12,9 млрд
Забавно, что ранее Hugging Face отклонила предложение NVIDIA о инвестиции в $500 млн при оценке $7 млрд, желая сохранить независимость. Переговоры о продаже шли при оценке от $13 млрд и вот, сделка состоялась
Сначала, чипы, потом облако, теперь ваще главный хаб открытых моделей, все больше и больше нвидиа поглощает мир ии, как бы не стремились развивать ai индустрию, они все равно корпорация и тут уже вопрос, останется ли hugging face такой же открытой платформой под корпоратами 🤔
Щас навешают нам там цензуры ненужной еще, надеюсь их рука не поднимется на nsfw и uncensored модели
N
Neurogen
26.08.2026 15:15 · 👁 3.6K
GLM-5.3-Flash
Флеш версия glm-5.3, стартует со свежего базового предобучения на 30T токенов мультимодальных данных, больше интеллекта за меньшие вычисления
🔘1M токенов контекста, 320B параметров, всего 18B активных, гибридная архитектура (sparse + linear attention) даёт эффективность в 3-4 раза выше по вычислениям и KV-кэшу, чем у GLM-5.3
🔘Нативная мультимодальность, впервые в серии GLM-5: модель видит интерфейсы, результаты рендера, графику и может писать код с глазами
🔘Сильнее GLM-5.2 при цене в 10 раз ниже и при этом дышит в спину Claude Opus 4.8 на coding/agentic-бенчмарках
Поддерживает все агентские сценарии. Деплой через vLLM, SGLang, KTransformers, TokenSpeed
В GLM Coding Plan квота в 3 раза больше, чем у GLM-5.3; внепиковые часы и выходные за 50% очков, сама модель тоже уже доступна в Z Code
HuggingFace
Блог
API
N
Neurogen
26.08.2026 10:10 · 👁 3.7K
FireRedTTS-3
Open-source, SOTA, ттска от китайцев, уже третья версия, это генерация и редактирование речи, по производительности и качеству приятно удивила, советую попробовать
🔘Две версии:
- FireRedTTS3-Base для zero-shot клонирования голоса
- FireRedTTS3-Instruct для управления голосом через естественный язык и редактирования аудио
24 языка + 21 китайский диалект (Arabic · Cantonese · Chinese · Czech · Dutch · English · Finnish · French · German · Greek · Hindi · Indonesian · Italian · Japanese · Korean · Polish · Portuguese · Romanian · Russian · Spanish · Thai · Turkish · Ukrainian · Vietnamese)
По качеству это SOTA на бенчах + zero-shot клон войса без дообучения, просто по короткому референсу голоса
Semantic + Acoustic editing можно править смысл фразы и акустические характеристики в одной модели
Voice design по текстовой инструкции + семантическое и акустическое редактирование речи
Для Instruct-версии доступны generate_voice_design (создать голос по описанию) и generate_semantic_edit (переписать смысл сказанного, сохранив голос)
Демо-страница с примерами
Hugging Face
GitHub
ModelScope
Делаем портативку? - 🔥
N
Neurogen
25.08.2026 15:22 · 👁 3.3K
Joy-LTX 2.5 × Z-Image
Продолжение эксперимента со слиянием моделей, на этот раз гибрид, в котором пространственный профиль внимания модели Z-Image (Lumina2, 6B) пересаживается на движок Joy-LTX 2.5
При этом идентичность, движение, звук и поведение движка остаются точно такими же, как у оригинального Joy-LTX 2.5
Без переобучения, без изменения архитектуры, без весов Z-Image на инференсе
🔘Результаты
- +8–23% энергии тонких деталей на совпадающих кадрах в A/B тестах с одинаковым сидом
- Наиболее заметно на сене, листве, гравии и ткани на среднем плане
- Улучшение видно на паузе на статичных стоп-кадрах разница сильно видна
- В движении эффект читается как богаче, а не драматично иначе
- Меняется только качество разрешения поверхностей, ничего больше
Для RTX 30/40 (Ampere) юзайте GGUF-репозиторий вместо этого, K-кванты работают в 4–8 раз быстрее любого эмулированного 4-bit варианта на этих картах
🔘Совместимость
Drop-in замена для любого workflow с Joy-LTX 2.5 v2
Не требуется никаких изменений в пайплайне просто подменить файл модели
https://huggingface.co/joeygambino/joyai-echo-ltx25-x-Z-Image-native
N
Neurogen
24.08.2026 13:39 · 👁 3.8K
Ищем нового хостинг-провайдера для наших проектов!
Прямо сейчас все наши проекты лежат, потому что у хостинг провайдера "технические неполадки в облаке" - и последнее время этих технических неполадок становится все больше. Мало того, что наши ресурсы недоступны на некоторых провайдерах, а все проблемы списываются на ТСПУ, теперь и полный шатдаун.
Притом лежит не отдельный сервер - лежит весь кластер.
Поэтому мы ищем нового надежного хостинг провайдера, с оперативной поддержкой, хорошим аптаймом и адекватными ценами, с которым можно расти дальше, а не вечно стоять на одном месте из-за разных перебоев. В идеале - с которым можно быть не очередным обычным клиентом, а построить полноценное партнерство.
Я знаю, что среди моих подписчиков есть представители самых различных компаний - поэтому надеюсь на отклик в личные сообщения - @roman_neurogen