Member
Статус: Не в сети Регистрация: 21.07.2011 Откуда: Москва Фото: 70
Mini-FAQ по DLSS 4.5
DLSS 4.5 добавляет 2 модели - L и M. M является основной. Она рекомендована для performance, но может быть использована в любых режимах. L тяжелее и оптимизирована в основном на режим ultra performance. Официальные рекомендации основаны на 4K, в других разрешениях картина может быть другой. Обе модели тяжелее, чем модель K (DLSS 4.0), особенно на картах 20 и 30 серий. Для ray reconstruct новых моделей не добавлено. Последними моделями RR остались E и D, которые используют прошлогодний трансформер (не путать с E и D для режимов без RR, которые являются моделями DLSS 3.x). Модель K никак не изменилась.
Member
Статус: Не в сети Регистрация: 20.08.2011 Откуда: Рязань Фото: 0
Agiliter писал(а):
Я пробовал FG в киберпанке. Это не серьезно.
а 4060 в 1440р это серьёзно? гонял бы в 1080р не так страшно было бы
Agiliter писал(а):
Соотвественно чем выше качество DLSS(пресет и разрешение), тем хуже становится FG.
Не, FG становится дороже от выводимого разрешения, апскейл на него влияет в районе погрешности, лучи примерно так же, твой результат выше скорее всего с упором в vram, отсюда и недобор фепесов
Advanced member
Статус: Не в сети Регистрация: 29.03.2017 Фото: 0
Сейчас прогннал DLSS B и текстуры средние. фпс без генератора приблизился к 80. Генератор скатился до x1.43. Ей тупо не хватает мощности, как для Transformer 2, так и для дегенератора Nvidia.
Member
Статус: Не в сети Регистрация: 20.08.2011 Откуда: Рязань Фото: 0
Agiliter писал(а):
Там даже честных 1080p нет. DLSSQ - 960p.
да что же это такое гене пофиг на разрешение рендера, время генерации зависит от внешнего разрешения кадра, то которое выводится на монитор прогони в 1080р с dlaa с геной и без и сравни
A224 писал(а):
какой будет коэффициент
коэффициент сильно зависит от фпс и разрешения, условно если он найдёт у себя игру которая в 4k без гены показывает 100 фепесов можно с апскейлом, то включи он там гену получит примерно тот же фпс, т.е. коэфициент около 1, а если это будет игра с изначальными 30 фпс, то там и 45 фпс можно получить т.е. х1,5 цифры примерные, но думаю суть ясна
A224 писал(а):
попробуй smooth motion ради интереса
затрвты на SM меньше чем на FGx2(пресет "В"), но rtx5090 в 4k - 1,38мс и 1,7мс соответственно, на 4060 зависимость будет примерно такая же, но эна менее качественная поэтому смысла её использовать где есть внутренняя гена как-то мало.
Member
Статус: Не в сети Регистрация: 29.07.2015 Откуда: Москва Фото: 707
ты же понимаешь что коэффициент 1.5 это на самом деле значит снижение фпс на 30% (и вообще любая гена снижает фпс) 30% это что-то дофига. а тут речь про то что ещё меньше.
tolikmixx писал(а):
затрвты на SM меньше чем на FGx2(пресет "В"), но rtx5090 в 4k - 1,38мс и 1,7мс соответственно
коэффициент-то какой? миллисекунды я вообще не понимаю это что лаг добавочный или о чём ты?
tolikmixx писал(а):
но эна менее качественная поэтому смысла её использовать где есть внутренняя гена как-то мало.
что-то внутренняя гена в кибере говно какое-то честно говоря и во многом из-за коэффициента тупого
Добавлено спустя 5 минут 57 секунд: 95.05/54.09 = 1,757 95.05/54.09/2*100 = 87,863 ну... чё то. но базовый фпс меньше 50 это пипец сам понимаешь
_________________ лучше больше fps чем меньше fps https://overclockers.ru/blog/A224/
Member
Статус: Не в сети Регистрация: 20.08.2011 Откуда: Рязань Фото: 0
Agiliter писал(а):
Ей тупо не хватает мощности, как для Transformer 2, так и для дегенератора Nvidia.
сравнил сейчас затраты не дегенерацию с dlaa + fgx2 против taa + fgx2 в гта5 с лучами в 4к 4k taa -121 фпс 4k dlaa -113 фпс 4k taa + fgx2 - 202фпс - т.е. затраты на дегенерацию ~1.69мс(2*1000/201-1000/121) 4k dlaa + fgx2 - 190 фпс - затраты ~1.68мс(2*1000/190-1000/113) и какой вывод? rtx5090 хватает для дегенератора и апскейлера одновременно?
Main Character
Статус: Не в сети Регистрация: 03.12.2004
Agiliter писал(а):
Ну и я полагаю, что FG DLSS и DLSS используют общие ресурсы карты, в частности тензорные ядра. Соотвественно чем выше качество DLSS(пресет и разрешение), тем хуже становится FG. Конфиг тензорных ядер.
Нет, не так. Параллельно работают только CPU и GPU (CPU может готовить будущие кадры, пока идет рисовка текущего на GPU). GPU никогда не делает несколько вещей одновременно. 1. Есть GPU render time. Его посчитать не сложно. Просто выруби все нейронки и подели 1000 на полученный фпс. 2. После него несколько своих ms добавляет апскейл. Он зависит от модели, исходного и целевого разрешения. Оба разрешения увеличивают время. UP обходится дешевле DLAA, а не наоборот. 3. После этого еще несколько ms добавляет генерация. Она зависит от модели (очень слабо), числа фейковых кадров и разрешения. Одного разрешения - выводимого, генерация это отдельная нейронка, которой апскейл безразличен. После этого снова переходим к пункту 1, но для следующего кадра.
Сложи все ms из пунктов 1-3, раздели 1000 на это число. Вот тебе и фпс с нейронками. Если 2 и 3 не используется, то там соответственно ноль.
Нейронки кушают не только тензоры.Тензоры ускоряют только матричные операции. CUDA-ядра там тоже активно задействованы.
_________________ Исследования показывают, что хранить лестницу в доме опаснее, чем ружье. Поэтому у меня 10 ружей, на случай, если какой-нибудь псих попытается протащить лестницу.
Member
Статус: Не в сети Регистрация: 20.08.2011 Откуда: Рязань Фото: 0
A224 писал(а):
миллисекунды я вообще не понимаю это что лаг добавочный или о чём ты?
миллисекунды это как раз то, что действительно важно, а не твои абстрактные коэффициенты миллисекунды это затраты на дегенератор, и уже через них можно считать твои любимые коэфициенты объясню ещё раз, но я точно помню, что уже объяснял тебе как работают эти миллисекунды есть у тебя 50фпс без гены т.е. время кадра 20 мс, включаем гену т.е. прибавляем мои 1,7мс(у тебя свои для конкретного разрешения) к 20мс и получаем время реального кадра с геной 21,7мс т.е (1000/20+1,7)=46 фпс и умножаем это на 2 так как у нас гена х2, получаем 92фпс которые выводятся на монитор а теперь включаем другую игру и там 100 фпс(10мс на кадр) без гены, а с геной будет 2*1000/(10+1,7)=171фпс дальше включаем игру у которой 200 фпс(5мс на кадр) без гены, а с геной 2*1000/(5+1,7)=299фпс а теперь считаем твои любимые коэффициенты 92/50=1,84 171/100/1,71 299/200=1,495 как видишь твои коэффициенты не работают надеюсь понятно объяснил
Advanced member
Статус: Не в сети Регистрация: 29.03.2017 Фото: 0
tolikmixx писал(а):
и какой вывод? rtx5090 хватает для дегенератора и апскейлера одновременно?
Маловато будет. Думаю на 80-100ФПС уже более... рационально.
4e_alex Ну очевидно, что там не только тензоры задействованы, но они в частности и по ним разница у карт огромная. Я имел ввиду тензоры + всё остальное. Полагаю, что оно ещё и жрёт дополнительную мощность, а у 4060 из коробки 115Вт в который она регулярно упирается. У меня обычно настроено вообще на 105Вт, с поправленной кривой и целевой частотой 2730. На ноутбуках даже 115Вт... мягко говоря не гаратированы будут.
Короче в FHD с низкой базы оно приемлемо работает на 4060, чем выше базовый фпс и разрешение тем печальнее. QHD 30-50ФПС её предел, дальше это просто смешно.
Main Character
Статус: Не в сети Регистрация: 03.12.2004
Agiliter писал(а):
Полагаю, что оно ещё и жрёт дополнительную мощность, а у 4060 из коробки 115Вт в который она регулярно упирается. У меня обычно настроено вообще на 105Вт, с поправленной кривой и целевой частотой 2730.
Если подумать, то из описания выше становится понятно, почему нейронки снижают общее потребление видеокарты. В пункте 1 задействовано большинство блоков GPU. В пунктах 2 и 3 наоборот. Если ты проходишь все 3 этапа (включил и апскейл и генератор), то потребление будет минимальным. Во втором пункте потребление довольно сильно зависит от модели. L и M самые затратные не только по времени, но еще и ваттам. Но даже они не должны быть тяжелее, чем если бы GPU крутил только пункт 1, т.е. рисовал только честные кадры без нейронок.
A224 писал(а):
с чего ты взял что у тебя всегда будут одинаковые миллисекунды?
На одной и той же карте в одинаковых условиях (разрешение, число фейковых кадров) время генерации будет одинаковым в любой игре или сцене. Там разница в пределах погрешности.
_________________ Исследования показывают, что хранить лестницу в доме опаснее, чем ружье. Поэтому у меня 10 ружей, на случай, если какой-нибудь псих попытается протащить лестницу.
Member
Статус: Не в сети Регистрация: 29.07.2015 Откуда: Москва Фото: 707
4e_alex писал(а):
На одной и той же карте в одинаковых условиях
ну так и коэффициент будет одинаковый в одинаковых условиях. все прекрасно понимают что на другой карте, в другом разрешении и т.д. коэффициент будет другой.
_________________ лучше больше fps чем меньше fps https://overclockers.ru/blog/A224/
Member
Статус: Не в сети Регистрация: 20.08.2011 Откуда: Рязань Фото: 0
4e_alex писал(а):
Нейронки кушают не только тензоры.Тензоры ускоряют только матричные операции. CUDA-ядра там тоже активно задействованы.
именно, иначе бы у нас не просаживался фпс от перехода с TAA на DLAA, по крайней мере на невысоких фпс/разрешениях явного упора в тензоры нет и время апскейла что на 30фпс, что на 130фпс примерно одинаковое как-то давно, тут даже какие-то ссылки были, что тензорные блоки в играх при операциях апскейла и дегенерации используются на какие-то небольшие проценты, но сейчас не найду.
Мемbеr
Статус: В сети Регистрация: 15.12.2006 Фото: 85
tolikmixx писал(а):
как-то давно, тут даже какие-то ссылки были, что тензорные блоки в играх при операциях апскейла и дегенерации используются на какие-то небольшие проценты, но сейчас не найду.
Сейчас этот форум просматривают: нет зарегистрированных пользователей и гости: 24
Вы не можете начинать темы Вы не можете отвечать на сообщения Вы не можете редактировать свои сообщения Вы не можете удалять свои сообщения Вы не можете добавлять вложения