Расширяем географию Fastfox: новая локация в Финляндии



Хельсинки — удобная точка размещения для сайтов, приложений и онлайн-сервисов, ориентированных на пользователей из Финляндии и других стран Европы. Локация обеспечивает стабильную связность и низкие задержки до европейской аудитории.

На новой площадке используется современное серверное оборудование. В конфигурациях:
  • AMD EPYC — мощные процессоры для стабильной работы под нагрузкой;
  • NVMe-диски — быстрый отклик системы, приложений и баз данных;
  • безлимитный трафик — без ограничений по объему переданных данных.

fastfox.pro/vds/

Можем выступать в роли транзита, ставить любое сетевое оборудование за ваши деньги



  • Вся коммутация через патч-панели прямо в каждой стойке
  • Возможность завести любого оператора который присутствует в ДЦ

Готовы оформить предзаказы любого рода на сеть ДЦ — DigitalRealty

165 новых сборок выделенных серверов



165 новых конфигураций выделенных серверов
Добавили новые конфигурации выделенных серверов — все в московской локации. Теперь можно еще точнее подобрать ресурсы под задачу, без необходимости брать с запасом.
timeweb.cloud/my/dedicated/create

Машина под ваши задачи
  • Инференс в продакшене — LLM работает круглосуточно, а соседи не отнимают ресурсы.
  • Дообучение под свой домен — LoRA или файнтюн на своих данных, машина занята только вашей задачей.
  • Весь контур рядом — датасеты, препроцессинг, векторная база и API-слой на одной машине, а не в разных сервисах.
  • Работа с чувствительными данными — сервер соответствует 152-ФЗ УЗ-1, данные под защитой.

Запустить сервер
timeweb.cloud/r/hostsuki

Письмо от CEO



Здравствуйте!
Это Григорий Атрепьев, руководитель платформы Yandex Cloud.
Последний раз я писал такое письмо год назад. И вот, снова пришло время пригласить вас на нашу главную технологическую конференцию — Yandex Scale'26.

Она пройдёт уже 24 сентября в двух форматах: офлайн в Москве и онлайн. На конференции мы обсудим ключевые анонсы платформы и покажем, какие возможности они открывают для IT-команд и бизнеса.

Зарегистрироваться на Yandex Scale'26
scale.yandex.cloud

В ответе за Тех
В этом году у нас произошёл редизайн и появился этот слоган. Что он значит? Бесконечно много.
Каждый день мы соединяем людей и технологии. Постоянно улучшаем свои продукты, чтобы они были быстрее и безопаснее. Мы делаем это для вас — тех, кто создаёт новые решения и сервисы на нашей платформе.

Мы честно признаём неудачи и берём за них ответственность. И ответственность для нас — это готовность обеспечивать и контролировать работу платформы каждый день и в каждом аспекте.
А ещё мы всегда ищем новые подходы. О них — и не только — расскажем на конференции.

Такого ещё не было
Эта конференция Yandex Scale отличается от всех предыдущих. Мы сделали её ещё масштабнее: в программе четыре трека (AI, Hybrid Infrastructure & DevOps, Security, Data), 15 воркшопов и десятки уникальных кейсов.
scale.yandex.cloud/program
scale.yandex.cloud/workshops

Отдельно хочу сказать про онлайн: в этом году помимо трансляции докладов будут углублённый технологический трек DeepTech, интересные гости и воркшопы по ИИ.

Приглашаю вас! Вместе с другими руководителями Yandex Cloud я открою конференцию в 11:00 мск главным докладом.

Как выбрать GPU для ИИ-задач? Разобрали семь моделей





Мы опубликовали серию обзоров GPU, в которых разобрали семь популярных ускорителей NVIDIA: сверили характеристики с официальными спецификациями, проверили публичные тесты и рассказали, при каких условиях эти результаты воспроизводятся.
Каждый материал отвечает на главные вопросы при выборе: поместится ли модель, сколько запросов выдержит карта и во что обойдется обработка миллиона токенов.

Обзор NVIDIA RTX PRO 6000
Разбираем все три модификации — Workstation, Max-Q и Server Edition — и объясняем, чем они отличаются на практике. В тесте с LM Studio модель Llama 3.3 70B в четырехбитной квантизации выдала 29 токенов в секунду против 3 у потребительской RTX 5090: когда моделям тесно в 32 ГБ, объем памяти меняет результат радикально.
servercore.com/ru/blog/articles/nvidia-rtx-pro-6000-blackwell-obzor/

Обзор NVIDIA A100
Полный разбор архитектуры Ampere, тензорных ядер третьего поколения и технологии MIG. Сравниваем A100 с V100, H100, L40S и A30 и объясняем, почему карта остается востребованной даже после снятия с производства.
servercore.com/ru/blog/articles/nvidia-a100-obzor/

Обзор NVIDIA H200
У H200 и H100 одинаковый графический процессор и совпадающая вычислительная производительность. Все различие — в памяти: 141 ГБ HBM3e против 80 ГБ и 4,8 ТБ/с против 3,35. Объясняем, почему в задачах ИИ этого достаточно для заметного прироста и в каких проектах переход не окупится.
servercore.com/ru/blog/articles/nvidia-h200-obzor/

Сравнение RTX A5000 и RTX 4090
У карт одинаковые 24 ГБ видеопамяти, но разрыв в вычислительной производительности трехкратный: 27,8 против 82,6 TFLOPS в FP32. При этом профессиональная A5000 умеет то, чего игровая карта не умеет вовсе, — работать с памятью ECC, объединяться в пару через NVLink и обслуживать виртуальные рабочие столы.
servercore.com/ru/blog/articles/rtx-a5000-rtx-4090-obzor/

Сравнение H100, A100 и V100
Материал для тех, у кого модель уже обучена и осталось запустить ее в работу. Разбираем метрики инференса — время ответа, число запросов в секунду и потребление памяти, приводим формулу стоимости миллиона токенов и объясняем, почему дорогая карта при высокой загрузке обходится дешевле бюджетной.
servercore.com/ru/blog/articles/h100-a100-v100-obzor/

Проверить выводы на своей модели можно без закупки оборудования. В облачных серверах с GPU Servercore доступны NVIDIA RTX A5000 и RTX PRO 6000, а конфигурацию выделенного сервера с GPU мы собираем под задачу. Развертывание занимает от двух минут, оплата почасовая по факту потребления, а на время отладки ресурсы можно заморозить — тарификация vCPU, RAM и GPU остановится.
servercore.com/ru/services/cloud-based-gpu-servers/