Neurogen (@neurogen_news) — Telegram-канал | Telegram Dialogs
Telegram Dialogs — логотип
Все каналы
Neurogen

Neurogen

@neurogen_news

22.9K подписчиков технологии 💬 Комментарии открыты ✓ Зарегистрирован в РКН

Авторский взгляд на ИИ и нейросети. Крупнейший канал в Сибири про ИИ. СEO & Founder: empatra.ai, neuroapi.host Менеджер по рекламе: @rrzaev Live канал: @neurogen_blog Реестр РКН: №4777528086

Последние публикации

Neurogen
29.08.2026 16:23 · 👁 3K
MiniMax H3 Max видео за 3 секунды Бесплатно и без регистрации НЕ КЛИКБЕЙТ На fal.ai залили плейграунд с minimax h3 max, пишешь промпт или закидываешь картинку и через 3 секунды получаешь 5 секундное видео сгенерированное в 768p, со встроенным стереозвуком Дают 5 бесплатных генераций в день, даже рега не нужна, наверное это как то обходить можно, вполне возможно просто кеш сайта почистить H3 Max - это пост-тренированная версия открытой модели MiniMax H3, доработанная командой fal Research и оптимизированная под максимальную скорость. В независимых оценках она занимает 1-е место по качеству, пониманию промпта и эстетике среди видеомоделей https://fal.ai/tools/minimax-h3-max
Neurogen
28.08.2026 06:53 · 👁 2.6K
FireRedTTS3 Portable by Neurogen Полноценная локальная студия синтеза и клонирования речи на базе FireRedTTS3. Упаковал модель, движок и все необходимые компоненты в самостоятельное portable-приложение для Windows Отдельная установка Python, PyTorch, FFmpeg и системных зависимостей не требуется. Распаковали архив, запустили Neurogen.exe и работаете 🔘Что умеет Studio - Voice Clone на базе FireRedTTS3 Base и Instruct. - Voice Design: создание голоса по текстовому описанию. - Semantic Edit для смысловой и текстовой коррекции речи. - Acoustic Edit для работы с акустическими параметрами и звучанием. - Очередь задач с отображением прогресса. - Отмена, повторный запуск и удаление задач. - Библиотека голосов. - Сохранение референсов, транскрипций, языков и тегов. - Экспорт в WAV, FLAC и MP3. - Встроенный FFmpeg. - Автоматический выбор профиля под доступную VRAM. - Режимы CUDA, CPU и MPS там, где это поддерживается платформой. - FP16 и BF16 для ускорения на современных GPU. - SDPA attention. - Экспериментальный int8/Quanto для экономии видеопамяти. - Отдельный inference worker, чтобы интерфейс оставался отзывчивым во время генерации. - Отображение GPU и доступной VRAM. - Логи launcher и backend для диагностики ошибок. - Single-instance launcher, чтобы приложение не запускалось в нескольких копиях. - Все настройки и пользовательские данные хранятся рядом с приложением. Папку можно переносить на другой диск или внешний SSD. 🔘Для чего это подходит - озвучки роликов и подкастов; - создания голосов для игр и модов; - локализации видео; - генерации реплик персонажей; - прототипирования дикторов и ведущих; - работы с авторскими голосовыми библиотеками; - экспериментов с дизайном и редактированием речи. 🔘Требования к видеопамяти Основной режим рассчитан на пользователей с видеокартами от 8–16 ГБ VRAM. - 16 ГБ VRAM и больше: рекомендуемый сценарий. CUDA, FP16/BF16 и комфортная работа с моделью. - 8–12 ГБ VRAM: работа через CUDA и int8/Quanto. Лучше использовать короткие фрагменты и внимательно выбирать профиль памяти. - 4 ГБ VRAM: полноценная загрузка модели в видеопамять не предполагается. Используется медленный CPU fallback/int8. На тестовой машине с GTX 1650 4 ГБ и 16 ГБ оперативной памяти реальный Base Clone успешно отработал. Тестовый WAV получился в 24 кГц, mono PCM16, длительностью около 0,96 секунды. Время генерации составило примерно 216 секунд. То есть на 4 ГБ приложение запускается, но это режим для проверки, экспериментов и небольших задач, а не для мгновенной генерации. Для комфортной работы ориентируйтесь на 8–16 ГБ VRAM и выше. 🔘Что входит в сборку - Embedded Python 3.12. - PyTorch и TorchAudio 2.8.0+cu128. - PySide6. - FireRedTTS3 engine. - FireRedTTS3 Base. - FireRedTTS3 Instruct. - RedAE. - Cam++. - Tokenizer. - FastText language identification model. - FFmpeg. - Launcher Neurogen.exe Большие веса уже находятся внутри portable-сборки: - Base: около 8,48 ГБ. - Instruct: около 8,48 ГБ. - RedAE: около 3,78 ГБ. Размер всей портативки примерно 27,36 GiB 🔘Как запустить 1. Скачайте архив и распакуйте его через 7-Zip или встроенный tar.exe. 2. Перейдите в папку FireRedTTS3_Portable. 3. Запустите Neurogen.exe. 4. При первом запуске подтвердите уведомление об условиях использования. СКАЧАТЬ СКАЧАТЬ (Зеркало) Hotfix ошибки mat/float/cuda Примеры генераций модели
Neurogen
27.08.2026 19:34 · 👁 3.4K
Завтра релиз
Neurogen
27.08.2026 06:16 · 👁 5K
NVIDIA покупает Hugging Face за $12,9 млрд Забавно, что ранее Hugging Face отклонила предложение NVIDIA о инвестиции в $500 млн при оценке $7 млрд, желая сохранить независимость. Переговоры о продаже шли при оценке от $13 млрд и вот, сделка состоялась Сначала, чипы, потом облако, теперь ваще главный хаб открытых моделей, все больше и больше нвидиа поглощает мир ии, как бы не стремились развивать ai индустрию, они все равно корпорация и тут уже вопрос, останется ли hugging face такой же открытой платформой под корпоратами 🤔 Щас навешают нам там цензуры ненужной еще, надеюсь их рука не поднимется на nsfw и uncensored модели
Neurogen
26.08.2026 15:15 · 👁 3.6K
GLM-5.3-Flash Флеш версия glm-5.3, стартует со свежего базового предобучения на 30T токенов мультимодальных данных, больше интеллекта за меньшие вычисления 🔘1M токенов контекста, 320B параметров, всего 18B активных, гибридная архитектура (sparse + linear attention) даёт эффективность в 3-4 раза выше по вычислениям и KV-кэшу, чем у GLM-5.3 🔘Нативная мультимодальность, впервые в серии GLM-5: модель видит интерфейсы, результаты рендера, графику и может писать код с глазами 🔘Сильнее GLM-5.2 при цене в 10 раз ниже и при этом дышит в спину Claude Opus 4.8 на coding/agentic-бенчмарках Поддерживает все агентские сценарии. Деплой через vLLM, SGLang, KTransformers, TokenSpeed В GLM Coding Plan квота в 3 раза больше, чем у GLM-5.3; внепиковые часы и выходные за 50% очков, сама модель тоже уже доступна в Z Code HuggingFace Блог API
Neurogen
26.08.2026 10:10 · 👁 3.7K
FireRedTTS-3 Open-source, SOTA, ттска от китайцев, уже третья версия, это генерация и редактирование речи, по производительности и качеству приятно удивила, советую попробовать 🔘Две версии: - FireRedTTS3-Base для zero-shot клонирования голоса - FireRedTTS3-Instruct для управления голосом через естественный язык и редактирования аудио 24 языка + 21 китайский диалект (Arabic · Cantonese · Chinese · Czech · Dutch · English · Finnish · French · German · Greek · Hindi · Indonesian · Italian · Japanese · Korean · Polish · Portuguese · Romanian · Russian · Spanish · Thai · Turkish · Ukrainian · Vietnamese) По качеству это SOTA на бенчах + zero-shot клон войса без дообучения, просто по короткому референсу голоса Semantic + Acoustic editing можно править смысл фразы и акустические характеристики в одной модели Voice design по текстовой инструкции + семантическое и акустическое редактирование речи Для Instruct-версии доступны generate_voice_design (создать голос по описанию) и generate_semantic_edit (переписать смысл сказанного, сохранив голос) Демо-страница с примерами Hugging Face GitHub ModelScope Делаем портативку? - 🔥
Neurogen
25.08.2026 15:22 · 👁 3.3K
Joy-LTX 2.5 × Z-Image Продолжение эксперимента со слиянием моделей, на этот раз гибрид, в котором пространственный профиль внимания модели Z-Image (Lumina2, 6B) пересаживается на движок Joy-LTX 2.5 При этом идентичность, движение, звук и поведение движка остаются точно такими же, как у оригинального Joy-LTX 2.5 Без переобучения, без изменения архитектуры, без весов Z-Image на инференсе 🔘Результаты - +8–23% энергии тонких деталей на совпадающих кадрах в A/B тестах с одинаковым сидом - Наиболее заметно на сене, листве, гравии и ткани на среднем плане - Улучшение видно на паузе на статичных стоп-кадрах разница сильно видна - В движении эффект читается как богаче, а не драматично иначе - Меняется только качество разрешения поверхностей, ничего больше Для RTX 30/40 (Ampere) юзайте GGUF-репозиторий вместо этого, K-кванты работают в 4–8 раз быстрее любого эмулированного 4-bit варианта на этих картах 🔘Совместимость Drop-in замена для любого workflow с Joy-LTX 2.5 v2 Не требуется никаких изменений в пайплайне просто подменить файл модели https://huggingface.co/joeygambino/joyai-echo-ltx25-x-Z-Image-native
Neurogen
24.08.2026 13:39 · 👁 3.8K
Ищем нового хостинг-провайдера для наших проектов! Прямо сейчас все наши проекты лежат, потому что у хостинг провайдера "технические неполадки в облаке" - и последнее время этих технических неполадок становится все больше. Мало того, что наши ресурсы недоступны на некоторых провайдерах, а все проблемы списываются на ТСПУ, теперь и полный шатдаун. Притом лежит не отдельный сервер - лежит весь кластер. Поэтому мы ищем нового надежного хостинг провайдера, с оперативной поддержкой, хорошим аптаймом и адекватными ценами, с которым можно расти дальше, а не вечно стоять на одном месте из-за разных перебоев. В идеале - с которым можно быть не очередным обычным клиентом, а построить полноценное партнерство. Я знаю, что среди моих подписчиков есть представители самых различных компаний - поэтому надеюсь на отклик в личные сообщения - @roman_neurogen
Чат поддержки
Ответим здесь же, обычно быстро
Здравствуйте! Напишите ваш вопрос — оператор ответит в этом чате.