creator cover Neuro Art Workshop
Neuro Art Workshop

Neuro Art Workshop 

Нейроарт и нейросети: искусство будущего

129subscribers

132posts

Showcase and bundles

5
A bundle is a collection, compilation, playlist, or catalog of posts that saves you from searching through the blog and lets you buy the entire content series in a single click.
goals2
21 of 1 000 paid subscribers
Достижение цели в 1000 платных подписчиков позволит мне уделять все свое время каналу и создавать еще более качественный контент.
$7.53 of $628 raised
На развитие канала.

About

Приветствую Вас! Меня зовут Олег, и я увлечён синтезом искусства, технологий и нейросетей. С 2021 года я активно работаю с искусственным интеллектом: создаю цифровые арты с помощью генеративных моделей, пишу код на Python для адаптации инструментов под свои конкретные задачи и готовлю подробные руководства по нейросетям, генеративным моделям и интерфейсам.
Моя цель — помочь Вам освоить эти технологии. Новичкам я предлагаю пошаговые инструкции по основам работы с интерфейсами, а опытным пользователям — эффективные методы оптимизации. В гайдах я стараюсь подробно объяснять принципы работы нейросетей простым языком, привожу практические примеры и показываю, как взаимодействовать с готовыми моделями для достижения стабильных результатов — независимо от уровня подготовки.
Кроме того, я предоставляю персональные консультации по сборке персональных компьютеров: помогу подобрать комплектующие в рамках Вашего бюджета, оптимизировать систему под ускорение на GPU для задач ИИ и игр, настроить оборудование для максимальной производительности. Если Вам нужен надёжный компьютер для генерации артов или других проектов, обращайтесь — разберёмся вместе.
Поддержите мой контент на Boosty, и вместе мы углубимся в мир ИИ!

Workflow Qwen Image 2.1 повышение разрешения, очистка изображения, удаление сетки.

Промпт для Qwen Image 2.1 (Restore <image_1> to a high-resolution, clear, in-focus photograph with restored detail. Repair any defects, damage, or spots. Remove any JPEG artifacts or compression artifacts. Preserve their identity. Their skin is smooth and natural.) неплохо апскейлит и чистит изображения. Если после генерации или апскейла вы видите характерную для Qwen сетку на изображении то можно в схему включить De-Grid:  https://github.com/lunaaispace-eng/ComfyUI-DeGrid
WORKFLOW с DeGrid: 
json
image_qwen_image_2_1_image_edit_clean_degrid.json58.97 Kb
🔶 Расширение RES4LYF Samplers для Forge Neo
Расширение добавляет в ForgeUI Neo популярные самплеры и планировщики от RES4LYF (ComfyUI)
Level required:
На кофей

Доступны веса Qwen Image 2.1 для Comfy UI

Команда Qwen (Alibaba) выкатила новую модель для работы с картинками Qwen-Image 2.1.
 
Сам к сожалению пока её погонять не могу, но по описанию и первым тестам в сообществе там есть пара действительно любопытных вещей:
 
Умеет сразу рисовать на прозрачном фоне.
Если нужен стикер или объект без фона, больше не нужно прогонять результат через сторонние «вырезалки», которые мылят края. Модель нативно выдает чистый PNG с альфа-каналом.
Всё в одной коробке. Она не только генерирует картинки с нуля по тексту, но и редактирует готовые фото: меняет фон, переодевает людей или корректирует детали в рамках одной архитектуры.
Понимает до 10 референсов одновременно.
Можно скормить ей сразу пачку исходников (например, лицо человека, нужную одежду и фон) модель соберет это в единую сцену с сохранением черт лица.
Нормально пишет текст. Обещают уверенную и аккуратную отрисовку надписей на плакатах, вывесках и этикетках без каши из букв.
Разрешение и аппетиты умеренные. Генерирует в честном 2K (до 2048×2048). При этом архитектуру визуальной части облегчили до 7B параметров, поэтому модель уже спокойно запускают дома на видеокартах с 12–16 ГБ памяти.
 
По лицензии: для личного использования и экспериментов модель открыта, но для коммерческих продуктов Alibaba теперь требует отдельную лицензию.
 
Где скачать и как запустить:
 
Официальные веса на Hugging Face:
Оригинальный репозиторий от авторов:

🔥 Alibaba готовит Qwen Image 2.1: открытый 2K-генератор со слоями и редактированием «из коробки»

 
Команда ComfyUI открыла промо-страницу с анонсом нулевого дня (Day-0) для новой open-weight модели Qwen Image 2.1. Судя по всему, релиз весов от Alibaba состоится со дня на день.
 
Предыдущие версии линейки были довольно интересными, но в 2.1 обещают закрыть главные боли генеративных моделей: 
 
 - 🎯 All-in-One архитектура: теперь генерация с нуля (Text-to-Image) и умное редактирование (Image-to-Image / Inpainting) живут в одной модели.
   Переключаться между отдельными чекпоинтами больше не придётся.

 - 🖼 Нативное 2K-разрешение: генерация и обработка в честном 2K без
   обязательного апскейла и потери мелких деталей.

 - ✍️ Продвинутая типографика: модель умеет точно вписывать текст, вывески и надписи в картинку без «каши».

 - ✂️ Поддержка альфа-канала (прозрачности): умеет генерировать объекты сразу на прозрачном фоне или слоями — находка для дизайнеров и создания ассетов.
 
Команда Comfy Org подтвердила поддержку модели сразу на релизе:
 
 - Локально в ComfyUI: для нормальной работы в FP8/FP16 традиционно понадобится  видеокарта на 16–24 ГБ VRAM (RTX 3090/4090). Для карт попроще (12 ГБ) комьюнити наверняка быстро соберет GGUF-кванты.
 - В Comfy Cloud: готовые воркфлоу в один клик запустятся прямо в облаке, если  домашнего GPU не хватает.
 
Страница ожидания с подпиской на уведомление: comfy.org/qwen-image-2.1
 
Ждём выкладку весов в открытый доступ на Hugging Face. 
YuE2: твой личный Suno офлайн
YuE2 - аналог Suno на вашем ПК. 2 удобных интерфейса: от простого до студии для клипмейкинга с автоматической установкой. 
Level required:
На кофей
NVIDIA DLSS 5 Neural Rendering: рендер и апскейл изображений и видео.
DLSS 5 Neural Enhancer: автономный апскейл и реставрация фото и видео на базе закрытого ядра NVIDIA. Все детали и приложение в посте.
Level required:
На кофей с печеньками
🛠️ Forge UI Neo - лаунчер, настройка запуска и справочник в удобной графической оболочке.
Приложение для Forge UI Neo: установка в 1 клик, настройка флагов без .bat, общие модели и полный гайд. Всё в одном удобном интерфейсе!
Level required:
На кофей с печеньками

Alibaba готовит Swift-Image: компактный DiT на 3–6B с генерацией, image-edit и 8 шагами сэмплирования


Исследователи из Alibaba опубликовали пейпер по своей новой визуальной модели Swift-Image (arXiv: 2608.20334). Похоже, нас ждёт отличный легковесный кандидат для локального запуска на ПК.
Что обещают:  

1. Настоящая мультимодальная унификация. Вместо того чтобы городить сложные многослойные цепочки из отдельных адаптеров под каждую задачу, Swift-Image решает ключевые сценарии «из коробки» на уровне единой архитектуры:
Text-to-Image: Классическая генерация с нуля по текстовому описанию.
Single-Image Editing: Редактирование готового кадра по инструкциям (замена объектов, смена ракурса, перенос стиля, изменение освещения).
Multi-Image Conditioning: Склейка и манипуляция несколькими референсами (например, взять персонажа с одного изображения, фон с другого и объединить их с сохранением консистентности).
 
2. Сжатие до 3B и дистилляция в 8 шагов
Флагманские диффузионки сейчас весят неприлично много и требуют промышленных или топовых GPU. В Swift-Image пошли по пути максимальной эффективности:  Базовая версия построена на однопоточном Diffusion Transformer (DiT) размером 6 млрд параметров.
Авторы провели структурный прунинг, сжав модель до 3 млрд параметров (3B) практически без просадки в качестве.
Применили few-step дистилляцию: вместо привычных 30–50 шагов генерация укладывается всего в ~8 шагов сэмплирования.
Что это даёт на практике? Модель сможет комфортно работать даже на народных видеокартах с 8–12 ГБ VRAM (уровня RTX 3060 / 4060) и выдавать результат буквально за секунды.
 
3. Разделение логики и рендеринга (Prompt Enhancer)
Маленькие модели часто «плывут», когда сталкиваются с длинными и сложными запросами. Чтобы этого избежать, архитектуру разделили на два уровня по принципу знакомому нам уже на примере модели Ernie: Prompt Enhancer: Встроенный модуль предобработки, который переводит сложный пользовательский текст в структурированные визуальные инструкции.
Рендерер: Получает готовые инструкции и занимается только генерацией пикселей, не тратя свои ресурсы на расшифровку сложного контекста.
Чёткий текст: За счёт посимвольной токенизации модель умеет корректно рендерить надписи и вывески без каши из букв.
 
💡 Статус и ожидания
Subscription levels3

На кофей

$1.26 per month
Поддержать автора вкусняшками. 

На кофей с печеньками

$2.51 per month
Поддержать автора вкусняшками. 

ПК под ключ: Консультации по сборке 💻🔧

$3.8 per month
Подписка даёт Вам персональную консультацию по подбору и сборке ПК для нейросетей, творчества и игр. После оформления подписи напишите мне свои пожелания по конфигурации, Ваши задачи и примерный бюджет. На основе этой информации я подготовлю для Вас оптимальную конфигурацию.
Go up