НЕЙРОРАЗВЕДКА | Dmitriy $. Oganessov

НЕЙРОРАЗВЕДКА | Dmitriy $. Oganessov 

Исследую нейросети

143subscribers

89posts

Showcase and bundles

2
A bundle is a collection, compilation, playlist, or catalog of posts that saves you from searching through the blog and lets you buy the entire content series in a single click.
goals1
$3.71 of $62 raised
🤣 На отдых в ближайшие выходные! Пиво, рыбка и...

Локальные нейросети без цензуры на Android: полный обзор лучших AI-приложений и GitHub-проектов

Еще несколько лет назад запуск больших языковых моделей (Large Language Models, LLM) на смартфоне казался невозможным. Для работы нейросетей требовались мощные видеокарты, десятки гигабайт оперативной памяти и полноценный компьютер.
Сегодня ситуация изменилась. Благодаря развитию квантованных моделей (Quantized Models), библиотек llama.cpp и современных мобильных процессоров многие открытые модели можно запускать непосредственно на Android-устройстве. При этом некоторые модели позиционируются как Uncensored (без цензуры), Abliterated (с ослабленными ограничениями), Heretic, Freedom или Dolphin, то есть они менее склонны отказывать в ответах по сравнению с оригинальными версиями.
Важно понимать: отсутствие цензуры зависит прежде всего от самой модели, а не от приложения. Клиент лишь запускает выбранную модель и не меняет ее поведение.

Что такое локальная нейросеть на Android

Локальная нейросеть — это модель, которая работает непосредственно на смартфоне. Все вычисления происходят на устройстве пользователя, без отправки запросов на удаленные серверы.
Такой подход имеет несколько преимуществ:
- переписка не покидает устройство;
- не требуется подписка на облачный сервис;
- можно работать без подключения к Интернету (после загрузки модели);
- пользователь самостоятельно выбирает модель.
Однако производительность зависит от объема оперативной памяти, процессора и размера модели.

Какие модели считаются «без цензуры»

Многие разработчики публикуют альтернативные версии популярных моделей с уменьшенными встроенными ограничениями.
Наиболее распространенные обозначения:
- Uncensored — версия с ослабленными ограничениями.
- Abliterated — модель, в которой была частично удалена или ослаблена защитная настройка.
- Heretic — авторская модификация модели с измененным поведением.
- Dolphin — серия моделей с расширенными инструкциями и менее строгими ограничениями.
- Freedom — модифицированные версии с минимальным количеством встроенных фильтров.
Следует учитывать, что эти названия не гарантируют полного отсутствия отказов. Поведение модели зависит от конкретной сборки, метода дообучения и используемых системных инструкций.

Лучшие AI-приложения для Android

1. PocketPal AI

GitHub:
https://github.com/a-ghorbani/pocketpal-ai
PocketPal AI сегодня считается одним из наиболее удобных клиентов для локального запуска больших языковых моделей на Android.
Проект полностью открытый и использует библиотеку llama.cpp.

Возможности

Поддерживаются:
- любые GGUF-модели, включая Llama, Qwen, Gemma, Mistral, DeepSeek, Phi и другие.
- большинство современных открытых моделей.
Если загрузить модель с пометкой Uncensored, Heretic или Abliterated, приложение не будет накладывать собственные ограничения.

Преимущества

- полностью локальная работа;
- высокая скорость;
- поддержка большого количества моделей;
- современный интерфейс;
- открытый исходный код.

Недостатки

Для моделей 7–8B желательно иметь смартфон минимум с 8–12 ГБ оперативной памяти.

2. Layla AI

Официальный сайт:
https://www.layla-network.ai/
Layla AI — одно из самых известных Android-приложений для локального общения с нейросетями.

Поддерживает

- Gemma;
- Mistral;
- Qwen;
- Поддерживает локальные модели семейства Llama.cpp (GGUF), а также собственный каталог моделей.
- пользовательские модели.
Главное преимущество — возможность самостоятельно выбирать и загружать модели.

3. ChatterUI

GitHub:
https://github.com/Vali-98/ChatterUI
ChatterUI представляет собой универсальный клиент.
Он умеет работать сразу с несколькими источниками моделей.
Поддерживаются:
- Ollama;
- OpenAI API;
- OpenRouter;
- llama.cpp;
- локальные модели.
Благодаря этому можно легко переключаться между локальными и облачными нейросетями.

4. MLC Chat

GitHub:
https://github.com/mlc-ai/mlc-llm
MLC Chat — проект команды MLC AI, ориентированный на запуск моделей непосредственно на мобильных устройствах.
Разработчики уделяют большое внимание оптимизации вычислений.
Поддерживаются:
- оптимизированные версии Llama, Gemma, Qwen, Phi и других моделей, подготовленные для MLC.
Если телефон достаточно современный, скорость генерации оказывается весьма высокой.

5. Maid

GitHub:
https://github.com/Mobile-Artificial-Intelligence/maid
Maid — открытый AI-клиент, поддерживающий одновременно локальные модели и облачные API.
Можно подключить:
- Ollama;
- OpenRouter;
- OpenAI;
- локальные GGUF-модели.
Такой подход особенно удобен, если пользователь работает сразу с несколькими AI-провайдерами.

Если смартфон слабый

Не каждый Android-смартфон способен запускать большие модели локально.
В этом случае гораздо эффективнее использовать облачные модели.
Сам смартфон становится лишь интерфейсом, а все вычисления выполняются на удаленных серверах.
Например:

OpenRouter

https://openrouter.ai
Позволяет использовать сотни моделей через единый API.

Google AI Studio

https://aistudio.google.com
Предоставляет бесплатный доступ к моделям Gemini через API.

GitHub Models (уже закрыто)

https://github.com/marketplace/models
Позволяет тестировать современные модели непосредственно через инфраструктуру GitHub.

Какие модели без цензуры наиболее популярны

Если говорить именно о моделях, а не приложениях, чаще всего используются следующие семейства.

1. Huihui Gemma Abliterated

Автор: Huihui AI
Лучше использовать поиск по коллекции автора, так как модели регулярно обновляются.
Hugging Face (автор):
https://huggingface.co/huihui-ai
Huihui AI регулярно публикует Abliterated-версии моделей Gemma разных размеров (от компактных до крупных). Для Android наиболее практичны модели 2B–9B в формате GGUF.

2. Dolphin (уже закрыто)

Автор: Eric Hartford (cognitivecomputations)
Официальная страница:
https://huggingface.co/cognitivecomputations
Популярные модели:
- Dolphin Llama 3.2 3B
- Dolphin Qwen 2.5 3B
- Dolphin Mistral 7B
Это официальный источник серии Dolphin.

3. Hermes

Автор: Nous Research
Официальная страница:
https://huggingface.co/NousResearch
Популярные модели:
- Hermes 3 Llama 3.2 3B
- Hermes 3 Llama 3.1 8B

4. Mistral Uncensored

Официальной "Mistral Uncensored" не существует.
Это десятки независимых сборок.
Лучший источник — TheBloke (GGUF):
https://huggingface.co/TheBloke
или поиск:
Популярные варианты:
- Mistral-7B-Instruct-Uncensored
- Dolphin Mistral
- OpenHermes Mistral

5. Llama Uncensored

Также не существует одной официальной версии.
Лучшие источники:
GGUF:
https://huggingface.co/TheBloke
Поиск:
Популярные варианты:
- Llama 3.1 Uncensored
- Llama 3.2 Uncensored
- Dolphin Llama
- Hermes Llama

6. Heretic

Автор: DavidAU
Официальная страница:
https://huggingface.co/DavidAU
Популярные модели:
- Qwen 2.5 3B Heretic
- Qwen3.5 9B Heretic

Дополнительно рекомендую эти репозитории

TheBloke (GGUF)

Самая большая коллекция готовых GGUF-моделей.
https://huggingface.co/TheBloke

bartowski

Самый активно обновляемый автор GGUF-квантовок в 2026 году.
https://huggingface.co/bartowski

lmstudio-community

Специально подготовленные модели для LM Studio.
https://huggingface.co/lmstudio-community

unsloth

Отличные модели Qwen, Gemma и Llama после дополнительного обучения.
https://huggingface.co/unsloth

QuantFactory

Большая коллекция современных квантованных моделей.
https://huggingface.co/QuantFactory

Какие телефоны подходят

Для комфортной работы объем оперативной памяти имеет решающее значение.

До 6 ГБ RAM

Подойдут модели размером 1–3B параметров в квантованном виде.

8 ГБ RAM

Можно запускать большинство моделей 3–4B.

12 ГБ RAM

Можно запускать большинство моделей 7–8B в квантовке Q4_K_M или аналогичной, однако скорость генерации будет зависеть от процессора смартфона..

16 ГБ RAM и больше

Позволяет экспериментировать с более крупными моделями, хотя скорость генерации будет зависеть и от производительности процессора.

Что выбрать

Если нужен полностью автономный AI без постоянного подключения к Интернету, наиболее удачным выбором будут:
- PocketPal AI — оптимальное решение для локального запуска GGUF-моделей.
- Layla AI — простой интерфейс и поддержка собственных моделей.
- ChatterUI — универсальный клиент для локальных и облачных моделей.
- MLC Chat — высокая производительность на современных устройствах.
- Maid — удобный вариант для работы сразу с несколькими AI-провайдерами.
Если же смартфон не обладает достаточной производительностью, разумнее использовать облачные сервисы вроде OpenRouter, Google AI Studio или GitHub Models. В этом случае устройство практически не испытывает нагрузки, а пользователь получает доступ к современным языковым моделям без необходимости запускать их локально.
Важно: большинство современных Android-приложений не зависят от конкретной модели. Если приложение поддерживает формат GGUF и движок llama.cpp, оно сможет запускать практически любую совместимую модель — будь то Gemma, Qwen, Llama, Mistral, DeepSeek или их модифицированные версии (Dolphin, Heretic, Abliterated и другие). Поэтому при выборе приложения гораздо важнее обращать внимание на поддерживаемый формат моделей, чем на список названий в описании.

Короче...

Экосистема локальных AI-приложений для Android развивается очень быстро. Сегодня даже смартфоны среднего класса способны запускать компактные языковые модели, а более производительные устройства — работать с моделями 7–8B параметров.
При выборе решения важно понимать, что именно приложение отвечает за запуск модели, а не за ее "цензуру". Если вы загружаете модифицированную модель с пометками Uncensored, Abliterated, Heretic или Dolphin, именно ее особенности будут определять стиль ответов. Поэтому ключевую роль играет не выбор клиента, а выбор самой модели и ее источника.
Creator has disabled comments for this post.
Subscription levels3

🕵️ Шпион

$1.24$0.93 per month
-25%
billed every 12 months
Доступ к материалам проекта
🔍 Вместо поиска десятков AI-сервисов...
✅ Обзоры и разборы лучших AI-инструментов и GitHub-репозиториев (функционал, необходимое железо, установка);
✅ Тематические подборки: самых интересных AI-релизов, трендов из GitHub, лучших AI-сервисов по различным категориям;
✅ Полезные материалы, чек-листы, промпты, исследования;
➕ Дополнительные материалы.
👉 Это фундамент проекта: отобранные и разобранные инструменты без воды.

⭐ ⭐ 🥷 ДИВЕРСАНТ ⭐ ⭐

$3.7$2.78 per month
-25%
billed every 12 months
👉 Всё из уровня «ШПИОН»
Доступ в закрытый AI-клуб (потребуется привязка Telegram к Boosty)
🔥 Обсуждение AI-инструментов, моделей, GitHub-проектов и обмен опытом;
🔥 Ранний доступ к AI-сервисам и находкам до публикации в Telegram и YouTube;
🔥 Серая зона с бесплатными возможностями и нестандартными решениями;
🔥 Помощь сообщества и мои ответы на вопросы;
🔥 AI и заработок: идеи монетизации
🔥 Полезные программы, сервисы, инструменты, не связанные с AI
🔥 Свободное общение
💎 ОТКРОЙ БОЛЬШЕ ВОЗМОЖНОСТЕЙ
+ chat

👑 МЕЦЕНАТ 💼

$37$29.6 per month
-20%
billed every 12 months
👉 Всё из уровня «ДИВЕРСАНТ»,
а также:
✅ Возможность задавать вопросы в личных сообщениях на Boosty (ответы по мере возможности, без гарантии мгновенной реакции)
✅ Упоминание твоего имени с благодарностью в моих видео
👉 Основная цель этого уровня — поддержка развития проекта и его дальнейший рост
⚠️ Потребуется привязка Telegram к Boosty.
+ chat
Go up