Как выбрать GPU для ИИ-задач? Разобрали семь моделей





Мы опубликовали серию обзоров GPU, в которых разобрали семь популярных ускорителей NVIDIA: сверили характеристики с официальными спецификациями, проверили публичные тесты и рассказали, при каких условиях эти результаты воспроизводятся.
Каждый материал отвечает на главные вопросы при выборе: поместится ли модель, сколько запросов выдержит карта и во что обойдется обработка миллиона токенов.

Обзор NVIDIA RTX PRO 6000
Разбираем все три модификации — Workstation, Max-Q и Server Edition — и объясняем, чем они отличаются на практике. В тесте с LM Studio модель Llama 3.3 70B в четырехбитной квантизации выдала 29 токенов в секунду против 3 у потребительской RTX 5090: когда моделям тесно в 32 ГБ, объем памяти меняет результат радикально.
servercore.com/ru/blog/articles/nvidia-rtx-pro-6000-blackwell-obzor/

Обзор NVIDIA A100
Полный разбор архитектуры Ampere, тензорных ядер третьего поколения и технологии MIG. Сравниваем A100 с V100, H100, L40S и A30 и объясняем, почему карта остается востребованной даже после снятия с производства.
servercore.com/ru/blog/articles/nvidia-a100-obzor/

Обзор NVIDIA H200
У H200 и H100 одинаковый графический процессор и совпадающая вычислительная производительность. Все различие — в памяти: 141 ГБ HBM3e против 80 ГБ и 4,8 ТБ/с против 3,35. Объясняем, почему в задачах ИИ этого достаточно для заметного прироста и в каких проектах переход не окупится.
servercore.com/ru/blog/articles/nvidia-h200-obzor/

Сравнение RTX A5000 и RTX 4090
У карт одинаковые 24 ГБ видеопамяти, но разрыв в вычислительной производительности трехкратный: 27,8 против 82,6 TFLOPS в FP32. При этом профессиональная A5000 умеет то, чего игровая карта не умеет вовсе, — работать с памятью ECC, объединяться в пару через NVLink и обслуживать виртуальные рабочие столы.
servercore.com/ru/blog/articles/rtx-a5000-rtx-4090-obzor/

Сравнение H100, A100 и V100
Материал для тех, у кого модель уже обучена и осталось запустить ее в работу. Разбираем метрики инференса — время ответа, число запросов в секунду и потребление памяти, приводим формулу стоимости миллиона токенов и объясняем, почему дорогая карта при высокой загрузке обходится дешевле бюджетной.
servercore.com/ru/blog/articles/h100-a100-v100-obzor/

Проверить выводы на своей модели можно без закупки оборудования. В облачных серверах с GPU Servercore доступны NVIDIA RTX A5000 и RTX PRO 6000, а конфигурацию выделенного сервера с GPU мы собираем под задачу. Развертывание занимает от двух минут, оплата почасовая по факту потребления, а на время отладки ресурсы можно заморозить — тарификация vCPU, RAM и GPU остановится.
servercore.com/ru/services/cloud-based-gpu-servers/

Что можно вынести в S3?




При запуске проекта файлы, логи и архивы часто хранят на том же сервере, где работает приложение. Сначала это удобно, но со временем такой подход может перегружать диск, усложнять масштабирование и увеличивать стоимость инфраструктуры.

Иногда сервер приходится расширять не из‑за нехватки мощности процессора или оперативной памяти, а просто потому, что на нем накопились резервные копии, медиафайлы, старые выгрузки или логи.
S3 объектное хранилище помогает вынести такие данные в отдельный слой: доступный по API, совместимый со многими инструментами и не привязанный к диску сервера. Доступно в России, Нидерландах и Франции, что позволяет выбирать локацию под задачи проекта, требования к размещению данных и резервные сценарии.




hostkey.ru/services/s3-object-storage/

OVHcloud и Plakar интегрируют резервное копирование непосредственно в публичное облако



Рубе – 3 сентября 2026 г. – OVHcloud, глобальный игрок и ведущий европейский поставщик облачных услуг, и Plakar, французская компания-разработчик программного обеспечения с открытым исходным кодом, специализирующаяся на обеспечении отказоустойчивости данных, интегрируют функцию резервного копирования в публичное облако OVHcloud. Клиенты сохраняют свои ключи, а копии остаются в Европе.

Резервное копирование — ключевая функция облачных вычислений.
Защита облачной среды по-прежнему подразумевает сборку нескольких программных компонентов в зависимости от используемых продуктов: виртуальных машин, Kubernetes, управляемых баз данных, а затем добавление хранилища, заключение контракта и привлечение специалистов. Отныне резервное копирование становится самостоятельной услугой, многофункциональной, управляемой непосредственно из среды OVHcloud, от традиционных приложений до рабочих нагрузок искусственного интеллекта.

Восстанавливайте данные где угодно, не завися от облака.
Каждая резервная копия остается портативной: клиенты могут восстанавливать свои данные в других местах, в том числе за пределами OVHcloud. Ключи к восстановлению принадлежат только им. Plakar восстанавливает всю среду приложения, вплоть до рабочих нагрузок ИИ.

Янив Фдида, директор по продуктам и технологиям OVHcloud, заявил: «Резервное копирование — это ключевая функция облачных вычислений, как и вычислительные ресурсы или сети. Мы интегрируем ее изначально, в соответствии с нашими принципами открытости и обратимости».

Жюльен Манжар, соучредитель и генеральный директор Plakar, сказал: «Сейчас атаки в конечном итоге заканчиваются успехом: резервное копирование перестало быть последней линией защиты компании, оно стало первой. Мы гордимся тем, что интегрировали его в OVHcloud и защитили множество компаний, не блокируя при этом доступ к их данным».

www.plakar.io

Новый дашборд пользователя в ispmanager вышел с beta-релизом 6.151



Новый дашборд пользователя в ispmanager
Мы улучшили дашборд для пользователей с правами user. Теперь он с первой минуты сориентирует в интерфейсе и помогает сразу же приступить к действиям: посмотреть данные о своем сайте, создать новый проект, загрузить файлы, настроить почту, развернуть бэкапы. Для большинства людей, работающих с хостингом, это актуально — теперь дашборд стал еще полезнее в решении повседневных задач.

В новом дизайне:
  • Панель быстрых действий.
  • Настраиваемый виджет с информацией о сайте.
  • Информация о дисковом пространстве и квотах, как в старой версии дашборда.
  • Расположение виджетов меняется перетаскиванием.

Как выглядит новый дашборд



Кто увидит новый дашборд
Обновление доступно с релиза beta 6.151 от 25 августа и выше, возврат к предыдущей версии дизайна не поддерживается. Новый дашборд увидят пользователи с правами user, если включена тема Феникс.

Новости по идентификации доменов .RU, .РФ и .SU



1 сентября уже прошло — что с идентификацией доменов в зонах .RU,.РФ и .SU?
По имеющейся информации: новые правила пока не действуют.

Это связано с тем, что необходимые нормативно-правовые акты не готовы, и регистраторам ещё не предоставлен полноценный доступ к ЕСИА для работы по новым требованиям.

Когда идентификация начнет полноценно работать, пока неизвестно.

Пока порядок не изменился, вы можете управлять доменами в обычном режиме. Рекомендуем продлить домен, если срок его действия истекает в течение 60 дней. Так у вас будет больше времени пройти идентификацию, когда она потребуется.
firstvds.ru/blog/dostupna-testovaya-identifikaciya-domenov-cherez-gosuslugi

Автоматическая выдача технических доменов для VPS в IHC



Мы упростили первичный доступ к серверам: к каждому новому VPS теперь сразу привязывается адрес формата:
  • your-vps.ihchost.rocks

Он отобразится в вашем личном кабинете сразу после старта услуги. Вы можете использовать это имя вместо привычных цифр IP-адреса, чтобы, к примеру, быстро подключаться к серверу через SSH.

Маршрутизация, DNS-записи и системный hostname настраиваются полностью на нашей стороне в момент создания сервера — вам не нужно тратить время на ручной конфиг.

www.ihc.ru

Новая локация: VPS/VDS в Чехии от Макхост



Мы расширили географию присутствия и добавили новую локацию для аренды виртуальных серверов — современный дата-центр в Праге. Прага является крупным телекоммуникационным узлом Центральной Европы, поэтому эта площадка обеспечивает минимальные задержки и высокую скорость работы при взаимодействии с аудиторией из любых европейских стран и не только.

Зачем нужна европейская локация:
  • Для работы проектов, ориентированных на пользователей из Европы.
  • Для размещения веб-приложений, сервисов, безопасных каналов связи и корпоративных систем.
  • Для создания защищенной рабочей среды и тестовых площадок с полным root-доступом.

Условия и характеристики:
  • Высокоскоростные SSD NVMe накопители и KVM-виртуализация.
  • Тарифы начинаются от 728 ₽/месяц при оплате за год.
  • 1 месяц использования панели ispmanager 6 в подарок на каждом тарифе, а также неограниченный трафик и бесплатный перенос проектов от других хостеров.

Всё оборудование в Праге принадлежит «Макхост», площадка соответствует международным стандартам безопасности, а поддержка готова помочь с вопросами 24/7.

Разворачивать новые серверы стало еще удобнее. Теперь при активации VPS система генерирует для него персональное имя, например:
  • vps.mchost.tools
Забудьте о необходимости постоянного копирования IP-адреса — используйте готовый домен для любых подключений и задач (включая работу по SSH). Посмотреть его можно прямо в панели управления. Все нужные параметры и DNS-записи прописываются автоматически во время установки системы, так что сервер готов к работе сразу после запуска.

mchost.ru

Запустили Yandex BareMetal Extend



Мы расширили возможности сервиса аренды выделенных серверов и запустили Yandex BareMetal Extend.
Это новая функциональность, которая превращает «голое железо» в готовую изолированную среду. Теперь вы можете запускать ИТ-проекты быстрее и снять с команды рутину по настройке инфраструктуры с сохранением повышенного контроля над данными и ресурсами.

Функционал находится на стадии Preview — протестируйте в числе первых, оставив заявку на сайте.
yandex.cloud/ru/services/baremetal

Линейка возможностей BareMetal Extend
Extend: Virtualization (в партнёрстве с K2 Cloud)
Готовая виртуальная инфраструктура на выделенных физических серверах. Полный контроль над ресурсами без необходимости покупать и настраивать физическое оборудование и гипервизор.

Extend: Managed Service for Kubernetes
Готовая K8s‑инфраструктура на выделенных серверах. Всё уже настроено для разработки и запуска контейнерных приложений — без самостоятельной настройки и поддержки Kubernetes, с полным контролем над кластером и приложениями.

Extend: Yandex Cloud Stackland
On‑premises платформа контейнеризации с интегрированными PaaS‑сервисами Yandex Cloud. Разрабатывайте и запускайте приложения в безопасном контуре без закупки и поддержки оборудования.

Что это даёт пользователям
  • Снижение нагрузки на ИТ‑отдел и уменьшение числа ошибок по настройке инфраструктуры.
  • Предсказуемые затраты — выгоднее, чем закупать и обслуживать собственное железо.
  • Быстрый старт ИТ‑проектов: дни, а не месяцы от идеи до production — без ожидания поставки оборудования.
  • Высокий уровень контроля и безопасность ресурсов в изолированном контуре.
  • Узнайте подробнее о Yandex BareMetal Extend на индивидуальной консультации — подробно расскажем про новый функционал, обсудим технические требования и поможем решить именно вашу задачу.

Что там с последним коммерческим облаком в России (и как мы лажали этот год)



Коротко итоги за год:
  • Пустили ИИ в прод.
  • Уволили отдел продаж.
  • Чуть не положили дата‑центр.
  • Ещё раз пустили ИИ в прод.

Сейчас ещё один раунд халявы на 4000 рублей в облаке для новых пользователей.

Примерно год назад мы опубликовали статью о том, что запускаем последнее коммерческое облако в РФ. Тогда мы честно рассказывали про наши амбиции, про ненависть к медленному корпоративному подходу и так далее.

А потом на год пропали. Вышли из беты и пропали.

Нас сгубили корпоративные заказы. Они оказались намного более жирными, чем коммерческое облако. И ещё их стало ОЧЕНЬ МНОГО.

Самый простой ответ на вопрос, почему мы ничего не писали: нам было тупо некогда.

Но облако тоже развивалось. За этот год мы прошли путь от стартапа до нормального IaaS‑провайдера.

Официальный старт состоялся 26 декабря 2025, под самый Новый Год. И пока вся страна просыпалась и лечила похмелье, я сидел и отвечал на тикеты в саппорт. Я смотрел в монитор и думал: «Кто вообще эти люди, которые 1 января лезут настраивать виртуалки и писать в поддержку?»

Январь
В январе мы знали, что просто не будет, потому что люди сталкиваются с облаком, и там для них всё новое и непонятное. А справки, которая идеально всё покрывает, ещё нет. Поэтому приходилось сразу писать справку, допиливать интерфейсы, выносить функции с бека в UI‑панель и так далее.

Тикеты были самые разные: от тривиального «ой, я, кажется, криво загрузил SSH‑ключ, проверьте» и «почему у меня нет денег на балансе» до жёсткого траблшутинга на стадии загрузки ОС через консоль и расследования вторжений в машины.

Почти 100% L2-саппорта я тогда закрывал один, просто потому что доступ к боевым серверам был только у меня. Напомню, у нас команда — 10 человек. Мы с тех пор выросли до мегакорпорации в 20 человек, кстати.

В бете нам прощали мелкие даунтаймы, но в проде ставки выросли. Отвлекаться на написание статей в таком режиме ежедневного тушения пожаров было физически невозможно.

Февраль: пошли крупные факапы
У нас было два по‑настоящему массовых инцидента, которые затронули больше одного тенанта (клиента).

Инцидент первый. Изначально наши Managed БД жили в публичной сети — у каждой был белый IP. Мы решили дать пользователям возможность прятать базы в изолированную приватную сеть. Со стороны кажется: ну поменяй ты IP, пропиши два Network Policy, делов‑то. Нам так в саппорт и писали: «Вы чё, два полиси настроить не можете?» Хотелось ответить: «Приезжай к нам в офис, подпишем NDA, покажешь на нашем проде, как ты это сделаешь».

Дело в том, что у нас под капотом не классический Kubernetes с простыми неймспейсами. За сеть отвечает суровый зверь — Kube‑OVN. Он изолирует тенантскую подсеть намертво. Трафик за её пределы не выходит вообще. Но базой данных управляет оператор, которому нужен доступ к подам БД для контроля жизненного цикла. Нам пришлось изящно и точечно выпускать наружу конкретную нагрузку, сохраняя абсолютную безопасность.

На бете мы бы, конечно, херанули бы иначе. Но тут уже не бета.

Мы сделали это архитектурно, но споткнулись на автоматизации. Скрипт миграции старых баз на новую архитектуру не учёл, что у нас исторически скопилось две версии созданных ресурсов. Версия 2 (более новая) смигрировала идеально. А вот десяток баз версии 1 сломался. Пользователи начали обрывать тикеты: «База недоступна, у меня там прод!» Пришлось всё бросать и ручками, индивидуально по каждому тенанту, править конфиги. Починили быстро, за пределы SLA в годовом измерении не вышли, но седых волос прибавилось.

Инцидент второй: AI‑кодеры и зацикленный IPAM. Мы запартнерились с одним курсом по AI‑кодингу. К нам на интенсив пришла толпа студентов, которым нужно было массово и одновременно разворачивать виртуалки. И тут наш любимый Kube‑OVN выкинул фокус: его счётчик в IPAM зациклился и перестал вовремя освобождать адреса.

Подсеть на 1000 адресов выжралась моментально. Студенты жмут кнопку создания машины, а им не хватает IP! Нам пришлось прямо в моменте, за полтора часа, склеивать четыре маленькие подсети (/24) в одну большую, анонсировать её, учить Kube‑OVN (который из коробки этого не умеет) маршрутизировать трафик в две разные публичные сети и писать скрипты‑костыли, чтобы новые юзеры падали только в новую подсеть.

Самое крутое в этой истории — тенантская изоляция. SLA не пострадал вообще, потому что ни одна из уже запущенных машин даже не моргнула.

Март: AI Ops и чем это закончилось
Пока я полгода сидел на первой линии поддержки, я методично превращал свой опыт в данные. Я скрупулёзно собирал каждый кейс в отдельный чат с Claude. У меня накопилось около 500 чатов с детальными постмортемами и десяток пошаговых ранбуков (инструкций по починке). В какой‑то момент стало ясно: пора это автоматизировать. Но пускать LLM в прод бесконтрольно — самоубийство.


Правило 32x. Недавно коллеги из энтерпрайза поделились математикой: успешно решённый ИИ‑агентом тикет стоит 10% от стоимости работы человека. А вот неуспешно решённый (когда ИИ галлюцинирует и ломает систему) обходится в 32 раза дороже, чем если бы туда изначально полез человек. Выгоднее вообще не пускать агента, чем пускать его без тормозов.

Поэтому мы создали строгий фильтр и собственный MCP‑сервер. Он дал агенту строгий набор инструментов и обогащённый контекст (RAG). Наш инструмент всеяден: через OpenRouter мы можем подключать и дорогую Claude Opus, и открытую Code Llama. При правильном контексте и жёстких ранбуках даже дешёвая модель решает задачи на уровне толкового мидла.

Как это работает сейчас:
Автопилот: пользователь пишет, что его виртуалка недоступна. Раньше я тратил 30 минут: пинговал, лез в кластер, проверял сеть, логи, ключи. Сейчас агент делает это сам за 1,5 минуты и выдаёт мне саммари: «Снаружи доступно, внутри сеть жива, SSH отвечает, в консоли виден login prompt, проблема на стыке провайдера юзера и ТСПУ».

Привилегированные действия: если для решения проблемы нужно перезапустить под с новыми параметрами, агент проводит диагностику, находит нужный ранбук и выводит мне всплывающее окно: «Разрешаешь выполнить этот экшен?» Я жму «Да».



Сейчас агент съедает почти 55 миллионов токенов в месяц (в пересчёте по API это было бы около $1100, но в рамках подписки обходится в копейки). Этот «безустальный мидл» закрывает 80–90% рутины.

То есть как бы я есть, но мне надо только покивать на то, что выдумал агент в 90% случаев. Ещё в 2% случаев это нечто новое, и он там накосорезил, и это надо исправить, а стоит это х32, то есть получается 64% работы + 10% — 74%. То есть польза от внедрения агента — 26% экономии рабочего времени.



На деле я немного шучу, но не сильно. В следующие месяцы неопознанных ситуаций стало меньше, и там реально освободилось время.

Кстати, интересный инсайд: к нам пришёл человек из корпорации с 600 разработчиками. Так вот, они массово AI‑кодят, но тщательно скрывают это от руководства. Потому что в корп‑культуре за использование нейросетей могут наказать. Мы же, команда до 20 человек, благодаря легализованному AI‑кодингу обгоняем эту корпорацию по роадмапу на полтора года.

Продажи, корпораты и перебежчики
В прошлом году мы решили поиграть во взрослый B2B‑бизнес. Наняли крутого Head of Sales и коммерческого директора (на минуточку — бывшего коммерческого директора MTS Cloud). Ребята пришли со своей огромной записной книжкой, пошли по старым связям и вширь открыли шикарную воронку продаж в крупном энтерпрайзе.

А на выходе — ноль.

Я сейчас не про те ситуации, когда заказчик пришёл к нам за машзалом в аренду, поставил что‑то своё и крутит (такого, как я уже говорил, много). А именно про попытки поставить корпоратов в коммерческое облако.

Ни одной закрытой сделки.

Почему? Сработал жёсткий коктейль из стартапных реалий и корпоративной бюрократии. Корпоративные безопасники просто резали нас по формальному скорингу. Уставный капитал мы не раздували, а во всех базах светились с чистым убытком. Почему? Да потому что мы реинвестировали вообще всё и вливали бешеные деньги в закупку железа последнего поколения! Но для СБшника в пиджаке это выглядит как: «Э‑э, ребята, с этими не связываемся».

К концу года мы честно признали поражение на этом поле. Мы попрощались со всем отделом продаж и полностью сменили фокус. Наш B2B‑путь — это не прямые продажи, а партнерская модель через доверенных проводников (DevOps‑студии и системных интеграторов). Если DevOps‑студия, которая ведёт инфраструктуру клиента, скажет: «Съезжаем из Яндекса к этим ребятам», — клиент переедет.

А почему? Потому что мы бьём в главную боль гигантов — наплевательское отношение к клиентам. Один из клиентов, который сейчас рассматривает нас в качестве альтернативы, отгружает БигТех‑Облаку 6,5 миллионов рублей ежемесячно. И в поддержке он для них — никто. Его тикеты просто падают в бэклог. Хочется, чтобы на них реагировали? Ещё 1,5 миллиона в месяц, пожалуйста.

Проблема в том, что у того же Яндекса жесточайший вендор‑лок. Просто откройте их документацию в разделе «Как перенести данные своей виртуальной машины». Там бесконечная простыня текста и целая последовательность шагов с бубном: вот тут постучи, тут попляши, тут за ухом почеши — и так для каждой виртуалки.

Поэтому прямо сейчас мы дописываем автоматизацию этого процесса миграции. В том числе автоматизацию бубна. Мы хотим сделать так, чтобы вытащить инфраструктуру клиента из клетки вендор‑лока корпораций можно было без боли. С VMware, кстати, тоже помогаем соскочить.

Воронка открылась шикарная. На выходе — уже не ноль закрытых сделок )

Ещё халява
Наша старая механика «закинь 5000 рублей и получи год ресурсов» отлично отсекала ботов. Основная проблема была именно с триал‑хантерами, когда пробовали чуть ли не майнить.

Но там надо было доставать и показывать 5000 рублей на баланс (и их можно было потом вернуть в любой момент). Это как капча: показать 5000 рублей робот не может.

На vc.ru уже есть пост от одного обиженного юзера, который возмущался, что мы попросили паспортные данные, чтобы оформить ему возврат аж 6 рублей с баланса. Он там путает тёплое с мягким, мы попросили паспорт, чтобы перевести ему сумму с баланса обратно (все 5к), а не для отмены списания на 6 рублей (которые, конечно, отменили без вопросов). В общем, всё строго по правилам и вбелую.

Сейчас у нас другая механика — проще.

Теперь при регистрации мы даём бонусный демо‑баланс 4000 рублей на один месяц.

Аккаунт надо подтвердить: российский телефон, российская карта. Без этого, увы, по закону нельзя.

Что выкатываем прямо сейчас
Наш базовый IaaS (виртуальные машины, VPC, быстрые диски, S3, балансировщики, Managed PostgreSQL) работает как часы. Managed Kubernetes тоже работает в полный рост — автоскейлинг вверх и вниз, автоапдейт, autoprovisioning PV и load balancer с белым IP. Плюс мы сейчас дотягиваем его до уровня оператора Capability Level 5 (полный автопилот).

Впереди жирные релизы:
  • Serverless‑платформа (preview в конце сентября). Это Serverless Functions, Containers, очереди, Key‑Value БД и API Gateway. Главная фича: масштабирование до нуля. Пока нет запросов — контейнер схлопывается в 0 реплик, и вы не платите за простой. Логи, трейсы и метрики интегрированы из коробки.
  • AI‑платформа (в октябре). Managed inference, GPU‑виртуалки, среда для обучения открытых моделей. Мы делаем свой AI Gateway, который по API на 100% совместим с OpenAI и Anthropic. Чтобы переехать к нам, вам достаточно поменять одну строчку с URL в вашем коде.
  • AI Ops для Managed Kubernetes (октябрь). Тот самый MCP‑сервер, который мы отладили на своей поддержке, мы отдаём пользователям. Ваши SRE‑инженеры получат AI‑агента, который помогает чинить инциденты по вашим ранбукам.
  • SDLC‑платформа (релиз к концу года). Знаете проблему, когда ИИ‑кодер нагенерил кода, уволился, и весь контекст архитектуры (C4, Gherkin) потерялся? Наша платформа хранит весь агентский контекст унифицированно. А ещё она решает новую болезнь индустрии: когда разрабов премируют за использование ИИ, они качают с Гитхаба скрипты, которые гоняют LLM по кругу, просто чтобы сжечь токены для KPI. Наша SDLC считает реальные DORA‑метрики и показывает экономику фичи, включая стоимость потраченных на неё токенов.

Почему мы не боимся спойлерить роадмап?
Резонный вопрос: вдруг Яндекс или Сбер прочитают и скопируют? Не боимся. Показательный пример: в 2022 году от MWS (MTS Cloud) ушёл вендор Canonical, оставив их OpenStack без поддержки. Ребята выбили 7,5 миллиардов рублей инвестиций, наняли 400 человек и пошли пилить облако. В итоге в сентябре прошлого года они выкатили то, что у нас работало ещё в мае. Чтобы нас догнать, конкурентам с их масштабом и текущими обязательствами нужно сначала набить наши шишки и влить миллиарды в инфраструктуру. Можно пробовать )

Почему мы так уверены в своих силах? Во‑первых, по чистой производительности мы обходим гигантов. У того же Яндекса база — это Xeon 2-го и 3-го поколения и память DDR4. У нас — 5-е поколение Xeon и DDR5. В бенчмарках мы быстрее в 2 раза в базе, в 5–7 раз на базах данных и до 10 раз в инференсе.

Про инференс и GPU в целом есть нюансы. Мы ждём поставку GPU‑установок топового уровня — целимся построить кластер в два раза больше Сберовского суперкомпьютера. Но сроки уехали до 20 недель, а поставщики в открытую говорят: «В Китае я продам каждую установку на $200 000 дороже, чем повезу вам в РФ». Цена улетела за миллион долларов за штуку. Притом что себестоимость её ниже 500 тысяч. Это новые реалии, которые рождаются спросом.

А ещё мы активно переселяемся в собственные ЦОДы: с нами по соседству живёт инфраструктура Cloud.ru, X5 и OZON, что делает объект очень лакомой мишенью. Глядя на то, что происходит вокруг, очень не хочется, чтобы нам прилетело «за компанию».

Так что мы вернулись, и мы поехали дальше.

h3llo.cloud