Свой ИИ-сервер за полтора миллиона: инвестиция, страховка или игрушка
статья · 23.09.2026
Цифры на 22 сентября 2026 года. Курс — 84,10 ₽ за доллар. Источники, допущения и модель расчёта собраны в отдельном исследовании, в тексте только выводы.
Денис задал вопрос, который сейчас задают многие, кто всерьёз работает с агентами:
Стоит ли вложить 1–1,5 млн ₽ в собственный сервер для локальных ИИ? С учётом риска потерять облачные модели, риска, что железо подорожает или исчезнет, — и окупится ли это вообще, хотя бы для малого бизнеса или кооператива энтузиастов?
Короткий ответ: как инвестиция — нет, как страховка — да, но страхует он не то, чего боятся. Ниже разберём, почему.
Сначала о том, что сервер не заменит
Экзокортекс — это агенты, которые читают вашу базу знаний, держат длинный контекст, вызывают инструменты и доводят работу до конца. Для такой работы сегодня нужна модель фронтира: Claude, GPT, Gemini.
Лучшее, что можно запустить локально за эти деньги, — gpt-oss-120b или Qwen 27–35B на 96 ГБ видеопамяти. На агентных бенчмарках вроде Terminal-Bench они отстают от фронтира на 10–30 пунктов. Это примерно уровень «Claude полтора года назад». Вариант, который приближается к фронтиру (GLM-5.3-Flash или DeepSeek V4-Flash на двух RTX PRO 6000), стоит уже 3,5–4 млн ₽. И даже для него качество квантованной версии на агентных задачах пока никто толком не мерил.
Отсюда главная рамка статьи. У экзокортекса два этажа:
- Потолок — умный агент, который думает вместе с вами. Это облако, и своим железом его не заменить.
- Пол — всё, что должно работать всегда и не должно уходить наружу: поиск по базе (эмбеддинги), разбор входящих, расшифровка записей, суммаризация, работа с клиентскими и личными данными. Этот этаж локальная модель держит уверенно.
Сервер страхует пол, а не потолок. Если завтра пропадёт Claude, свой сервер не вернёт вам Claude. Но экзокортекс не рассыплется: память, поиск и разбор останутся, а думать будет модель попроще.
Риск первый: облако закроют или поднимут цену
Риск реальный, и прецедент уже случился. OpenRouter, через который многие брали дешёвые открытые модели, в мае перестал принимать российские платежи, а в конце июня закрыл доступ из России. Anthropic и OpenAI Россию не обслуживают официально, и доступ держится на посредниках. У подписок тем временем тихо сжимается объём: недельные лимиты, окончание временных бонусов, новый токенизатор, который считает тот же текст на 30% дороже.
Интересно другое. Цена за токен падает быстрее, чем растёт что-либо ещё. Модель фиксированного уровня дешевеет в разы за год, а Opus за полтора года подешевел почти вчетверо. Поэтому сценарий «облако станет неподъёмным по деньгам» маловероятен. Вероятен сценарий «облако станет недоступным из России». Это другой риск, и страхуется он иначе.
А теперь самая неожиданная находка исследования. Если зарубежные агрегаторы закрыты, остаются российские облака, и та же открытая модель стоит там в 3–20 раз дороже. Посчитаем пользователя с активным агентным экзокортексом: около 100 млн токенов входа и 3 млн выхода в месяц.
| Где брать модель | ₽ в месяц |
|---|---|
| gpt-oss-120b на OpenRouter (из РФ уже закрыт) | ~1 400 |
| Claude Max 5x через посредника | ~11 500 |
| Claude Max 20x через посредника | ~22 000 |
| GLM-5.2 в Cloud.ru | ~26 000 |
| gpt-oss-120b в Yandex AI Studio | ~31 000 |
Открытая модель в доступном российском облаке обходится дороже подписки на лучшую модель мира. Именно с этой строкой, а не с Claude, и надо сравнивать свой сервер.
Риск второй: железо подорожает или исчезнет
Этот риск уже реализовался. Причина — память: фабрики переключились на HBM для дата-центров. Контрактные цены DRAM выросли почти вдвое только в первом квартале 2026 года, и по прогнозу TrendForce дефицит в 2027-м только расширится. Как это отразилось на ценах:
| Позиция | Было | Стало |
|---|---|---|
| RTX PRO 6000 (96 ГБ) | $8,5 тыс. на старте; ~1,08 млн ₽ в феврале 2026 | $14–16 тыс.; 1,6–2,4 млн ₽ в РФ |
| RTX 5090 | $1 999 (MSRP) | $4,3–6,4 тыс. в мире; 630–750 тыс. ₽ в РФ |
| Mac Studio с 512 ГБ | в продаже | сняли с продажи, возвращают дороже $10 тыс. |
Новое поколение видеокарт, по слухам, выйдет не раньше 2028 года.
Отсюда проверка тезиса «через пару лет продашь за те же деньги». За 2024–2026 годы он подтвердился с запасом:
- RTX 3090 шестилетней давности. В 2024-м её покупали за $700–800, сейчас продают за ~$1 030.
- Б/у 4090. Идёт на 40–60% дороже, чем стоила новой.
Но причина не в том, что железо «держит цену». Причина во внешнем шоке. Покупка сейчас — это покупка на пике и ставка на то, что пик продлится. Когда в 2028 году придут новые мощности, цены могут откатиться. Ещё две поправки: частный покупатель даст на 15–35% меньше рынка, и после работы круглосуточно карта продаётся хуже.
Вывод по второму риску: если покупать, то сейчас — ждать дешевле до 2028 года не имеет смысла. Но закладывать в расчёт «продам за те же деньги» нельзя. Честная база — минус 30% за три года.
Риск третий: окупится ли это вообще
Возьмём три конфигурации, которые реально можно собрать в сентябре 2026 года, и посчитаем владение на три года. В расчёт вошли амортизация с учётом перепродажи, электричество по московскому тарифу 8,90 ₽ с 1 октября и время на обслуживание по 2 000 ₽ за час.
| Конфигурация | Цена | Что тянет | В месяц (база) |
|---|---|---|---|
| A. 4× RTX 3090 б/у на платформе EPYC, 96 ГБ | ~750 тыс. ₽ | gpt-oss-120b, Qwen 27–35B; до 8–10 одновременных агентов | ~22,7 тыс. ₽ |
| B. Рабочая станция с одной RTX PRO 6000, 96 ГБ | ~1,85 млн ₽ — уже выше бюджета | то же, но быстрее и тише | ~23,8 тыс. ₽ |
| C. Mac Studio M5 Ultra, 256 ГБ | ~1,05 млн ₽ (оценка, в РФ цен ещё нет) | большие модели, но длинный контекст читает минутами | ~11,5 тыс. ₽ |
Три вещи бросаются в глаза.
- Для одного человека сервер стоит как Claude Max 20x, а умеет меньше. Как замена подписке он не окупается никогда.
- У сборки на 3090 больше половины стоимости — время на обслуживание, а не железо. Четыре карты, райзеры, охлаждение и драйверы — это хобби на несколько часов в месяц. Если ваш час дорог, это главная статья расходов.
- Mac дешевле в быту, но плох как агент. Для агента узкое место — скорость чтения контекста (prefill), а у мака она в 5–10 раз ниже, чем у видеокарты. Люди, которые полгода работали на Mac Studio, урезали системные промпты агентов вдвое, лишь бы дождаться ответа.
Кооператив меняет картину
Разделим тот же сервер на участников:
| Конфигурация | 1 чел. | 3 чел. | 5 чел. | 10 чел. |
|---|---|---|---|---|
| A · 4×3090 | 22,7 тыс. | 7,6 тыс. | 4,5 тыс. | 2,3 тыс. |
| B · RTX PRO 6000 | 23,8 тыс. | 7,9 тыс. | 4,8 тыс. | 2,4 тыс. |
| C · Mac Studio | 11,5 тыс. | 3,8 тыс. | не потянет | не потянет |
Уже при пяти участниках открытая модель на своём сервере обходится в 5–6 раз дешевле, чем та же модель в российском облаке, и никуда не утекает. Вот где появляется экономика: не у одиночки, а у группы, которой нужен надёжный «пол» для всех.
Условия у кооператива такие:
- Есть администратор. Типовая схема — LiteLLM с отдельными ключами и бюджетами на участника поверх vLLM, так живут похожие сообщества за рубежом. Но кто-то должен держать железо дома или в стойке, платить за свет и чинить.
- Есть договорённость о выходе. Что получает участник, который уходит через год, — стоит записать до покупки, а не после.
- Приватность настраивается, а не даётся даром. Общий кэш промптов — известный канал утечки между пользователями. Если в кооперативе чьи-то клиентские данные, кэш изолируют.
- Одновременных агентов немного. Реалистично 8–10 на 96 ГБ. Больше — и каждый начинает заметно тормозить.
Сдача в аренду
Сдача в аренду — самый слабый аргумент. Для хоста из России зарубежные площадки фактически закрыты: Vast.ai платит через Wise, PayPal или Stripe, RunPod новых хостов не берёт. Остаются криптовая Clore.ai и российская Qudata.ai со ставкой 23 ₽ в час за 3090.
Сборка A в часы простоя (16 часов в сутки) при загрузке 50% приносит около 14 тыс. ₽ в месяц чистыми. Этого хватит отбить электричество и часть амортизации, а железо целиком окупится лет за четыре. Реальную загрузку площадки не публикуют. Кроме того, аренда конфликтует с вашей же работой: агенты нужны не по расписанию. Mac сдать нельзя вовсе.
Аренда — приятный бонус к кооперативу, но не бизнес-модель.
Что это значит для разных читателей
Участнику сообщества. Покупать сервер в одиночку ради экзокортекса не нужно. Потолок оставьте облаку и держите два канала доступа, а не один. Пол можно закрыть дёшево: мини-ПК на Strix Halo или DGX Spark за 260–560 тыс. ₽ тянет модели до 120B для эмбеддингов, разбора и расшифровки. Если хочется серьёзнее — ищите кооператив, а не кредит.
Малому бизнесу. Сервер оправдан в одном случае: есть данные, которые нельзя отправлять за рубеж (клиенты, персональные данные по 152-ФЗ, коммерческая тайна), и есть объём, который в российском облаке выходит в десятки тысяч рублей в месяц. Тогда сборка A или B окупается против Yandex или Cloud.ru за 2–3 года и заодно закрывает юридический риск. Без такой задачи это дорогой способ заменить подписку за 11–22 тыс. ₽.
Денису. Ответ на три вопроса:
- Риск облака реален, но страхует сервер только пол, а не потолок.
- Риск железа уже сыграл: покупать сейчас дорого, но дешевле до 2028 года не станет. Ждать смысла нет, но и рассчитывать на рост цены при перепродаже тоже.
- Экономика для одного человека не сходится, для кооператива от пяти участников сходится хорошо — если в нём есть администратор и договор о выходе.
Что мы предлагаем проверить в сообществе
Экономика кооператива держится на трёх допущениях, которые никто не мерил на наших задачах:
- Сколько токенов реально съедает экзокортекс участника в месяц. Мы заложили 100 млн входа; если меньше, облако дешевеет.
- Сколько агентов одновременно выдержит одна сборка на 96 ГБ без заметного замедления.
- Как квантованные открытые модели справляются с нашими навыками: сессии, разбор инбокса, работа с базой знаний.
Все три проверяются одним коротким пилотом на арендованной видеокарте, без покупки. Сервер стоит покупать только после этого пилота.
Присоединяйтесь к сообществу
Эта статья — первый разбор сообщества «Развитие экзокортекса». В сообществе обсуждают, как строить личную AI-среду работы со знанием, считают её экономику и собирают участников для пилота на арендованной видеокарте. Там же по запросу можно получить исследование с источниками и модель расчёта: её можно пересчитать под свой сценарий, поменяв число участников, тариф или остаточную стоимость.
Сообщество открытое. Перейти в сообщество «Развитие экзокортекса» и нажать «Вступить». Если аккаунта на платформе ещё нет, после регистрации вы вернётесь прямо на страницу сообщества.
теги: экзокортекс · локальный ИИ · экономика · кооператив
Этот материал — часть открытой витрины базы «Экзокортекс — сообщество». Применение в собственных задачах через рабочие сессии и навыки эксперта — на платформе.
Регистрация бесплатна и открывает каталог баз знаний. Полный доступ к базе и рабочим сессиям — по подписке; в поток с сопровождением — по заявке.