Главная Юзердоски Каталог Трекер NSFW Настройки

Искусственный интеллект

Ответить в тред Ответить в тред
<<
Назад | Вниз | Каталог | Обновить | Автообновление | 15 4 9
Локальные языковые модели (LLM): Gemma, Qwen, GLM и прочие №255 /llama/ Аноним 08/08/26 Суб 19:09:25 1671563 1
Llama 1.png 818Кб, 630x900
630x900
Карта деградаци[...].png 153Кб, 1473x830
1473x830
Реальная длина [...].png 533Кб, 2340x1714
2340x1714
178579996190109[...].jpg 5981Кб, 3000x4000
3000x4000
В этом треде обсуждаем генерацию охуительных историй и просто общение с большими языковыми моделями (LLM). Всё локально, большие дяди больше не нужны!

Здесь мы делимся рецептами запуска, настроек и годных промтов, расширяем сознание контекст и бугуртим с кривейшего тормозного говна.

Тред для обладателей топовых карт NVidia с кучей VRAM или мажоров с проф. картами уровня A100, или любителей подождать, если есть оперативная память. Особо терпеливые могут использовать даже подкачку и запускать модели, квантованные до 8 5 4 3 2 0,58 бит, на кофеварке с подкачкой на микроволновку.

Официальная вики треда с гайдами по запуску и базовой информацией: https://2ch-ai.github.io/wiki/llama/
Гайд для новичков: https://rentry.org/2ch-llama-inference

Инструменты для запуска на десктопах:
• llamacpp - отец и мать всех инструментов, позволяющий гонять GGML и GGUF форматы: https://github.com/ggml-org/llama.cpp
• koboldcpp - самый простой в использовании и установке форк llamacpp: https://github.com/LostRuins/koboldcpp
• TextGen (в девичестве text-generation-webui) - если необходимы другие форматы и больше контроля: https://github.com/oobabooga/textgen
• TabbyAPI - заточенный под Exllama (V2 и V3) и в консоли: https://github.com/theroyallab/tabbyAPI
• Однокнопочные инструменты на базе llamacpp с ограниченными возможностями: https://github.com/ollama/ollama, https://lmstudio.ai

Универсальные десктопные фронтенды:
• SillyTavern - всеядное, сопрягается почти со всем, имеет большую коллекцию расширений: https://github.com/SillyTavern/SillyTavern
• Marinara Engine - вариация на тему таверны, больше возможностей из коробки: https://github.com/Pasta-Devs/Marinara-Engine
• Risuai - еще одна вариация, на этот раз в профиль, излишеств по минимуму: https://github.com/kwaroran/RisuAI

Инструменты для запуска на мобилках:
• Maid - интерфейс для локального запуска моделей под андроид с llamacpp под капотом: https://github.com/Mobile-Artificial-Intelligence/maid
• ChatterUI - альтернативный вариант для локального запуска под андроид (фронтенд и бекенд сепарированы): https://github.com/Vali-98/ChatterUI
• Гайд по установке SillyTavern на ведроид через Termux: https://web.archive.org/web/20241201232031/https://rentry.co/STAI-Termux

Поставщики локальных моделей:
• Hugging Face - платформа куда загружается всё и во всех форматах: https://huggingface.co/models
• Проверенные квантоделы: https://huggingface.co/bartowski, https://huggingface.co/mradermacher, https://huggingface.co/unsloth

Рейтинги и списки локальных моделей:
• Актуальный список моделей с отзывами от тредовичков: https://rentry.co/2ch_llm_moe_2026
• Неактуальные списки моделей в архивных целях: 2025: https://rentry.co/2ch_llm_2025 (версия для бомжей: https://rentry.co/z4nr8ztd ), 2024: https://rentry.co/llm-models , 2023: https://rentry.co/lmg_models
• Миксы от тредовичков с уклоном в русский РП: https://huggingface.co/Aleteian и https://huggingface.co/Moraliane
• Рейтинг моделей по уровню их закошмаренности цензурой: https://huggingface.co/spaces/DontPlanToEnd/UGI-Leaderboard
• Сравнение моделей по сомнительным метрикам: https://huggingface.co/spaces/HuggingFaceH4/open_llm_leaderboard
• Сравнение моделей реальными пользователями по чуть менее сомнительным метрикам: https://chat.lmsys.org/?leaderboard

Готовые карточки для таверны:
• Botbooru - текущая мета (регистрируйтесь для отображения всего спектра, и/или меняйте страну): https://botbooru.com
• Прошлая мета, откуда массово удалили карточки сомнительного содержания: https://www.characterhub.org, https://www.chub.ai
• Архив карточек, удадённых с chub: https://gottasaveemall.github.io/

Официальные документации к инструментам:
• llamacpp: https://github.com/ggml-org/llama.cpp/blob/master/tools/server/README.md
• koboldcpp: https://github.com/LostRuins/koboldcpp/wiki
• SillyTavern: https://docs.sillytavern.app/usage/quick-start

Дополнительные ссылки:
• Перевод нейронками для таверны: https://rentry.co/magic-translation
• Пресеты под локальный ролплей в различных форматах: http://web.archive.org/web/20250222044730/https://huggingface.co/Virt-io/SillyTavern-Presets
• Шапка почившего треда PygmalionAI с некоторой интересной информацией: https://rentry.co/2ch-pygma-thread
• Последний известный колаб для обладателей отсутствия любых возможностей запустить локально: https://colab.research.google.com/drive/11U-bC6AxdmMhd3PF9vWZpLdi6LdfnBQ8?usp=sharing
• Инструкции для запуска базы при помощи Docker Compose: https://rentry.co/oddx5sgq https://rentry.co/7kp5avrk
• Пошаговое мышление от тредовичка для таверны: https://github.com/cierru/st-stepped-thinking
• Потрогать, как работают семплеры: https://artefact2.github.io/llm-sampling/
• Выгрузка избранных тензоров, позволяет ускорить генерацию при недостатке VRAM: https://www.reddit.com/r/LocalLLaMA/comments/1ki7tg7
• Инфа по запуску на MI50, тесты производительности и прочее: https://arkprojects.space/wiki/AMD_GFX906
• Тесты tensor_parallel: https://rentry.org/8cruvnyw

Архив тредов можно найти на архиваче: https://arhivach.vc/?tags=14780%2C14985

Шапка в https://rentry.co/llama-2ch, предложения принимаются в треде.

Предыдущие треды тонут здесь:
>>1668203 (OP)
>>1665553 (OP)
Аноним 08/08/26 Суб 19:26:07 1671585 2
>>1671417 →
Получается, если интересует чисто кум, то смысла заглядываться на большие локальные модели нет?
Аноним 08/08/26 Суб 19:29:23 1671589 3
>>1671563 (OP)
Какую более-менее годную карту сейчас лучше взять в пределах 60к? Есть смысл брать Tesla V100 32gb?
Аноним 08/08/26 Суб 19:59:14 1671606 4
>>1671585
Ну если тебе достаточно мнения какого-то шиза то да
Аноним 08/08/26 Суб 20:16:48 1671618 5
>>1671606
А другие шизы молчат.
Аноним 08/08/26 Суб 20:23:43 1671622 6
>>1671585
Я пусть и бомж с одной 3090, но тестил эти модельки через попенроутер. Выводы такие же. Для тупо кума ничего не нужно кроме Геммы, а сильно круче для рп это самые жирные модели.
Аноним 08/08/26 Суб 20:45:48 1671637 7
Ну тогда поедим в следующем году, на гемме 5 120б. А пока в расход.
Аноним 08/08/26 Суб 21:18:51 1671671 8
>>1671637
>поедим в следующем году, на гемме 5 120б
А что, гемму 4 120б уже отменили? Бля...
Аноним 08/08/26 Суб 21:22:08 1671673 9
>>1671563 (OP)
Приветствую, анончики. Не бейте нюфага, и по возможности не обоссывайте.

Ситуация такая:
Есть пека на ноутбучном распаянном i9 12 поколения, в него воткнуты 64гб ддр4 и обоссаная 5060 на 8. Используется для работы, но локально хочу ещё запускать ЛЛМки для говнокодинга.

Так вот, передо мной 2 стула:

1. Купить миниПК на рузене 395, шоб сразу было 128гб памяти?

2. За те же деньги купить 4090 48гб VRAM с заделом на то, что в будущем буду брать новую материнку и ОЗУ. Но до тех пор, она будет торчать в нынешнем ПК с 64гб ддр4 (максимум 2 слота). Это самое будущее, когда я куплю новую мать с ОЗУ наступит хз когда
Аноним 08/08/26 Суб 21:25:04 1671680 10
>>1671673
Любой ценой взять 24 врам и запустить гемму. Всё. Больше нихуя нет и не будет, даже на 128 рам.
Аноним 08/08/26 Суб 21:31:59 1671687 11
Аноним 08/08/26 Суб 21:32:04 1671688 12
>>1671673
>для говнокодинга
Говнокрысы существуют, анон. Мы тут каничек от майоров укрываем на своих ллм. Только для этого они и нужны.
Аноним 08/08/26 Суб 21:35:25 1671691 13
>>1671680
А как же дикпик 4 flash? Было бы неплохо его запустить после апгрейда с ОЗУ в будущем. Ему там вроде 200гб VRAM+RAM достаточно. Мне в основном нужны анцензорные нейронки, шобы задавать неприятные для SoyGPT вопросы по инфобезу
Аноним 08/08/26 Суб 21:43:33 1671698 14
>>1671673
>Но до тех пор, она будет торчать в нынешнем ПК с 64гб ддр4
А в чём проблема то? РАБочий конфиг.
Аноним 08/08/26 Суб 21:50:09 1671703 15
>>1671698
> А в чём проблема то?
Эти 64гб ноутбучные, всего 3200. Но я жду с алика радиаторы для них, буду пытаться шить биос и гнать озу
Настройки X
Ответить в тред X
15000
Добавить файл/ctrl-v
Стикеры X
Избранное / Топ тредов