Независимый портал · не связан с NVIDIA
В наличииВидеокарта Palit GeForce RTX 5060 Ti Infinity 3 16GB спереди с тремя вентиляторами для локального ИИ

Видеокарта Palit GeForce RTX 5060 Ti 16 ГБ

RTX 5060 Ti 16 ГБ от Palit, версия Infinity 3, — компактная видеокарта на Blackwell с полными 16 гигабайтами GDDR7: тянет модели до 14B в 4-битном квантовании и MoE вроде gpt-oss-20b целиком, а по цене остаётся доступнее топовых карт с тем же объёмом памяти.

от 52 990 ₽
ориентировочно
В наличии
Партнёрские ссылки: цена для вас не меняется, а сайт получает небольшое вознаграждение.
Проверенные характеристикиДанные сверяем с официальными источниками
Партнёрские ссылкиПоддержите проект без переплат
Подбор аналоговПоможем найти вариант под задачу
Сравнение ценСобираем предложения магазинов в одном месте

Характеристики

Память16 ГБ GDDR7
АрхитектураBlackwell (GB206)
Питание180 Вт
CUDA-ядра4608
Шина памяти128 бит
Пропускная способность448 ГБ/с
Частота (буст)2572 МГц
ИнтерфейсPCIe 5.0 x8
Разъём питания8-pin
Габариты291,9×116,6×41,3 мм, 2 слота

Ключевые сценарии

Локальный запуск LLMЗапуск и инференс моделей без облака
Разработка и тестированиеAI-приложения, прототипы и исследования
Дообучение моделейLoRA и файнтюнинг на своих данных
Генерация изображений и видеоДиффузионные модели, апскейл, видеосинтез

RTX 5060 Ti 16 ГБ от Palit, версия Infinity 3, — один из самых доступных способов получить полные 16 гигабайт GDDR7 на архитектуре Blackwell. В основе чип GB206: 4608 CUDA-ядер, 128-битная шина и 448 ГБ/с пропускной способности, это на 56% больше, чем у предыдущей RTX 4060 Ti 16 ГБ. Карта занимает всего два слота при габаритах 291,9×116,6×41,3 мм: по заявлению Palit, серия Infinity 3 примерно на 40% компактнее обычных видеокарт RTX 50-й серии.

Что реально запускается. В 4-битном квантовании Qwen3 8B выдаёт около 51 ток/с на контексте 16K, Qwen3 14B — 33 ток/с. Mistral 7B и DeepSeek-Coder 6.7B в Ollama разгоняются до 90 и 101 ток/с. MoE-модель gpt-oss-20b (3,6 млрд активных параметров, квант MXFP4) укладывается в память целиком: 92 ток/с на коротком контексте, около 44 при заполненных 128K. Для картинок FLUX.1-dev в fp8 (11,9 ГБ весов) помещается впритык — по независимым тестам, около 14 секунд на кадр 1024×1024 в ComfyUI. Компактнее и быстрее работает NVFP4-квант той же модели, если нужен запас по памяти.

Кому подойдёт. Рабочий вариант для тех, кто хочет запускать модели до 14B без компромиссов и пробовать MoE покрупнее вроде gpt-oss-20b — здесь она заходит целиком, а не с оглядкой на объём. Для дообучения через QLoRA хватает моделей до 7B, это около 12 ГБ VRAM. Для 13B и выше уже нет — там нужно от 20 ГБ. Компактный корпус Infinity 3 — плюс для тесных сборок, но меньшая площадь радиатора означает меньше запаса по разгону, чем у полноразмерных версий той же карты.

Питание — 180 Вт, разъём один 8-pin, Palit рекомендует блок от 600 Вт. Карта работает на 8 линиях PCIe 5.0: для инференса LLM это не помеха даже в слоте PCIe 4.0. Расчёт видеопамяти под конкретную модель — в материале сколько VRAM нужно для локальных LLM, установка окружения для генерации картинок — в гайде по ComfyUI и FLUX. Если 16 ГБ пока избыточны, присмотритесь к MSI RTX 3050 8 ГБ; если важна скорость на той же памяти — к MSI RTX 5070 Ti 16 ГБ.