Часовой пояс: UTC + 3 часа




Форум закрыт Новая тема / Эта тема закрыта, вы не можете редактировать и оставлять сообщения в ней. Закрыто  Сообщений: 65 • Страница 3 из 4<  1  2  3  4  >
  Пред. тема | След. тема 
В случае проблем с отображением форума, отключите блокировщик рекламы
Автор Сообщение
 

Member
Статус: Не в сети
Регистрация: 13.09.2010
mag_ai писал(а):
ага она (хбм1) оказалась быстрей даже 6гб на 384 шине у 980ти / титана в тестах пропускной способности выдавая больше 350гб/с - нифигасе не ускорит... может вам перестать мыслить "видеокартами" а начать мыслить характеристиками? м?

Скорость памяти не имеет много общего с псп. Если проводить грубую аналогию - псп это шоссе. Где могут быть 4 ряда с какими нибудь Maclaren P1, а может быть и 200 рядов с катком на каждой. И пусть скорость катка будет в 50 раз меньше, чем у спорткара, но суммарная скорость движения по каждой дороге будет одинаковой.
HBM1 по скорости уступает GDDR5, хотя и превосходит по ПСП. HBM2 уже слегка быстрее, чем GDDR5, при этом обладая гораздо более высокой ПСП. GDDR5Х же поднимает планку быстродействия, не меняя физической разводки. И хотя реальное увеличение производительности будет меньше теоретического прироста, все-таки удвоение префетча далеко не всегда имеет шанс сработать, особенно по полной (просто потому, что не всегда будет задействовано все), тем не менее можно говорить о том, что GDDR5X с большой долее вероятности окажется быстрее HBM2. Зачем же тогда HBM2? я выше уже расписал (крайне обобщенно, конечно) структуру чипов Нвидии. Если рассмотреть ее, то появится четкое понимание, что использование HBM2 оправдано будет только там, где будет достаточное кол-во исполнительных блоков, чтобы создать связку канал памяти - исполнительный блок. Т.е. топовые чипы.

_________________
СМЕРШ - СМЕРть Школоте.



Партнер
 

Member
Статус: Не в сети
Регистрация: 13.02.2013
sudey писал(а):
Боюсь наложить на себя ваш гнев(шутка) но вы наверное знайте что архитектура максвелл использует новое сжатие памяти. Там где доступные 224 Гбайт в секунду будут соответствовать эффективным 290-300 Гбайт/с, например. и там где 112 GB/s у gtx 960 сжатием идет под 190 GB/s

Знаю. И не вижу причин, почему бы в Паскале не улучшилось это самое сжатие еще больше. Соответственно, необходимости в HDM опять не будет: простенькая 256-битная шина за счет компрессии сможет прокачать достаточно данных для новый видеоплат (условно назовем их 1080/1070).

Добавлено спустя 5 минут 25 секунд:
sudey писал(а):
берем ссд - память одна контроллеры разные один ссд в тесте дает 500мб/с скорости другой 250 мб/с вопрос кто виноват?

Совершенно верно. До тех пор, покуда нет мощного контроллера, быстрый флеш себя не раскроет.
А до тех пор, покуда нет мощного чипа с производительностью хотя бы раза в два выше теперешних топов, GDDR5 памяти будет достаточно. Как только появятся эти чипы - будет достаточно GDDR5x памяти. А для того, чтобы понадобилась HDM2 память, потребуется чип еще минимум вдвое мошной. Почему? Да потому что не упирается производительность в память на теперешний момент.

Добавлено спустя 6 минут 27 секунд:
aasheron писал(а):
я выше уже расписал (крайне обобщенно, конечно) структуру чипов Нвидии. Если рассмотреть ее, то появится четкое понимание, что использование HBM2 оправдано будет только там, где будет достаточное кол-во исполнительных блоков, чтобы создать связку канал памяти - исполнительный блок. Т.е. топовые чипы.

Где-то так. Все логично и предсказуемо.
p.s. Давайте воткнем в PIV DDR4. Или в Geforce 3 GDDR5. Сильно поможет?
Да что там PIV! Современный i7 сильно от DDR4 ускоряется? Черта с два! Ускорение есть очень мало где (как правило - разновсякие архиваторы), но и там ограничено процентами так десяти. На остальных задачах хорошо если 2-3% наскребется. Хотя память прокачивает данных больше раза так в полтора.


 

Member
Статус: Не в сети
Регистрация: 20.06.2013
MaK123 писал(а):
Знаю. И не вижу причин, почему бы в Паскале не улучшилось это самое сжатие еще больше.

Сжатие тратит ресурсы, использование HBM позволяет их высвободить и повысить энергоэффективность псп. Впрочем в лоу и мид моделях обойдутся и гддр.


 

Member
Статус: Не в сети
Регистрация: 13.02.2013
mag_ai писал(а):
и частота выше и новые алгоритмы сжатия данных ну да почему ей быть медленней? псп рассчитывается как величина бит на мегагерц = то есть можно понизить один параметр но повысить другой и псп не измениться

Спасибо, кэп!
Итого бит на мегагерц стало на 28% меньше: шину урезали в полтора раза даже в сравнении с древним GTX 660, а частоту памяти подняли всего то на 16%

Добавлено спустя 2 минуты 57 секунд:
Yalg писал(а):
Сжатие тратит ресурсы, использование HBM позволяет их высвободить и повысить энергоэффективность псп.

Ну если судить по Максвеллу, то сжатие как раз таки энергоэффективность повышает: видеоплаты на Максвелл кушают меньше Кеплеров, а работают заметно быстрее.
А на Паскале так и вовсе проблемы не будет: в отличии от Максвелла это не только новая архитектура, но и новый техпроцесс.


 

Member
Статус: Не в сети
Регистрация: 20.06.2013
MaK123 Они кушают меньше за счет новой архитектуры, кастрации FP64 и более свежего техпроцесса.


 

Member
Статус: Не в сети
Регистрация: 23.02.2013
Откуда: г. Орел
CDG.Axel писал(а):
Никак не на HBM, которая значительно дороже, плюс обладает серьезным ограничением по ёмкости, которое не позволит пихать её в старшие модели.

да вы вот опять на фантазировали себе - цену и то что кто то там думает о том что вам "мало" памяти... бред все это. я верю в то что *80 получит скажем hbm2 в размере 8гб а *70 получит 4гб первой версии и ничего покупатели как миленькие побегут ибо это рост псп больше чем на 1/3 и что самое удивительное такое положение вещей выгодно всем от производителей чипов до производителей самих плат - в одном случаи это контроль "гпу+память" что более высокая отпускная цена так и маржу можно поднять. для производителей это более дешевые печатные платы на которых можно пару баксов себе в карман положить а продать по старой цене.
... рынок поступает так как ему выгодно - потребитель уже давно не на первом месте.
CDG.Axel писал(а):
когда её производили только под заказ для АМД крайне ограниченными тиражами?

а это кто вам напел? вы просто офигенные сказки сочиняете я посмотрю... может стоит в писатели пойти?
... зачем писать о том что уже состоявшийся факт? массовое производство запустили с запуском фурии - дальше вопрос наращивания объемов и подготовка мощностей к hbm2.
aasheron писал(а):
Очень рекомендую покурить мануалы и понять, что загрузкой текстур общение видеокарты с ЦПУ не ограничивается. И все команды драйвера, данные от обработки физики и т.д.

этот объем не сравним с объемом текстурного пака если он в пишется где то в область 20% от шины - это будет победа а так в реальности ниже 10% загрузки шины дает можете проверить... теоретик.

Добавлено спустя 4 минуты 35 секунд:
aasheron писал(а):
HBM1 по скорости уступает GDDR5, хотя и превосходит по ПСП.

в мезориз это ахинею...
MaK123 писал(а):
А до тех пор, покуда нет мощного чипа с производительностью хотя бы раза в два выше теперешних топов

а чем прикажите текстурки в 4к обрабатывать? тму я думаю все архитектуры нарастят как и роп чтоб гордо сказать "4к карты" а чтоб прокачать возросший потенциал обработки текстурного массива 200гб/с - маловато.

_________________
Мертвый киберпанк с улыбкой мутанта... (:


 

Member
Статус: Не в сети
Регистрация: 13.02.2013
mag_ai писал(а):
а чем прикажите текстурки в 4к обрабатывать? тму я думаю все архитектуры нарастят как и роп чтоб гордо сказать "4к карты" а чтоб прокачать возросший потенциал обработки текстурного массива 200гб/с - маловато.

А с чего Вы взяли, что их будет 200? Во первых, 200 даже сейчас нет. Есть 224 при шине 256 и частоте 7 гигагерц. Во вторых, нельзя исключать дальнейшее улучшение механизма компрессии текстур в памяти, что приводит к большей реальной производительности подсистемы памяти при той же физически шине и чипах памяти. Пример - GTX 960.
Во третьих, потенциал GDDR5 еще далек от предела, т.к. даже сейчас, сегодня эта память достаточно легко берет по факту частоты около 8 гигагерц, при штатных на современных платах 6-7. Через полгода-год вполне допускаю, что штатная частота будет уже 8, при пределе в районе 8,5 - 9. А значит, догнать даже имеющуюся сейчас на конвейере память до реальных 256 гигабайт в секунду вполне реально. GDDR5x дополнительно даст свои 30-50% прироста сразу после выхода, а выход ее вряд-ли затянется дольше чем на год, учитывая, что для производства этого типа памяти не придется менять вообще ничего на имеющихся в настоящее время фабриках. Итого, через год скорости более 300 гигабайт/с при шине в 256 бит вполне возможны.

_________
Ну и наконец самое главное: на кой черт нужна поддержка 4K в low/middle сегменте? :)

Добавлено спустя 12 минут 57 секунд:
Yalg писал(а):
MaK123 Они кушают меньше за счет новой архитектуры, кастрации FP64 и более свежего техпроцесса.

Ну насчет более свежего техпроцесса я готов поспорить. :)
Ибо он как раз наоборот, очень "несвежий", и именно поэтому вылизанный. Свежий же будет в Паскале. Равно как в Паскале будет также и новая архитектура, а также (вполне допускаю) что еще более кастрированный, либо как минимум оставленный без изменений FP64 в middle, и тем более в low- сегменте.


 

Member
Статус: Не в сети
Регистрация: 23.02.2013
Откуда: г. Орел
MaK123 писал(а):
А с чего Вы взяли, что их будет 200? Во первых, 200 даже сейчас нет. Есть 224 при шине 256 и частоте 7 гигагерц.

:D потому что это "пиковая пропускная способность памяти" в реальности она всегда не достижима... представьте себе поэтому когда я пишу о хбм обычно говорю 300гб/с либо 350гб/с но в реальности пиковая еще больше но я беру примерную "реальную" - которая всегда ниже пиковой процентов на 10-20.
MaK123 писал(а):
Во вторых, нельзя исключать дальнейшее улучшение механизма компрессии текстур в памяти

насколько 7-зип или винрар стали лучше сжимать данные за несколько лет своего существования или насколько новый формат рар5 лучше рар? или как вы думаете насколько легко реализовать в кремнии алгоритм с минимальными задержками для компрессии и насколько часто такие изменения будут происходить? в реальности за всю историю видеокарт (не считая вендорные войны) изменений в компрессии было очень мало.
MaK123 писал(а):
Во третьих, потенциал GDDR5 еще далек от предела

а это вообще бред она уже на последнем издыхании ползет к финишной прямой еще на 6ггц фактически уже все было плохо а на 7ггц стало уже совсем худо на 8ггц будет не лучше чем на 7ггц - ведь с ростом частоты растут и задержки при этом вся это частота не соотноситься с частотой чипа те это компенсатор между возможностью передать за один такт скажем 128-256 бит информации... при этом частота памяти реализуется "запрос - передача данных" если выборка была ошибочна привет куча задачь где частота уже не просто не спасет но и вредит (опять же задержки).
MaK123 писал(а):
догнать даже имеющуюся сейчас на конвейере память до реальных 256 гигабайт в секунду вполне реально

и залипнуть на задержках и высоком потреблении а в месте с этим и температурой самой памяти ;)
MaK123 писал(а):
GDDR5x дополнительно даст свои 30-50% прироста сразу после выхода

вот опять у вас на руках есть чипы чтоб ванговать такие гипотетические красивые результаты?
MaK123 писал(а):
что для производства этого типа памяти не придется менять вообще ничего на имеющихся в настоящее время фабриках.

это тоже конь в вакууме - менять в любом случаи придется как минимум маски с помощью которых будут делать эти чипы что ведет вероятней всего к повышению количества брака. а еще нужно новые контроллеры памяти в чипах которые тоже стоят денег и разработки...
MaK123 писал(а):
Итого, через год скорости более 300 гигабайт/с при шине в 256 бит вполне возможны.

и того зачем геморой когда уже есть память имеющие такие характеристики при этом скоро не один кьюникс ее будет выпускать но и самсунг?
MaK123 писал(а):
Ну и наконец самое главное: на кой черт нужна поддержка 4K в low/middle сегменте?

на кой черт нв говорила о 980 (в том числе и ти) карте как о карте способной на 4к? почему амд говорит что фурия это 4к карта?
потому что это продажи - новомодное разрешения для новых карт чтоб лучше продавались очевидно как белый день. даже программа "окулус реди" на это и заточена чтоб люди брали новые компы а не для того чтоб рассказать людям какая прекрасная виртуальная реальность. ;)

_________________
Мертвый киберпанк с улыбкой мутанта... (:


 

Member
Статус: Не в сети
Регистрация: 13.02.2013
mag_ai писал(а):
потому что это "пиковая пропускная способность памяти" в реальности она всегда не достижима...

Это ничего не меняет :D
Значит и сейчас нет никаких 224 гигабайта/с, а есть где-то сотни полторы. И этого хватает 980-й, чтобы обойти GTX 780ti у которого память работает в полтора раза быстрее.

mag_ai писал(а):
насколько 7-зип или винрар

Не путайте 7-zip, задача которого сжимать максимально сильно и реализацию в чипе, с задачей сжать как-нить, лишь бы оно сжалось. У 7-zip'а уже все давним давно уперлось в ограничения кодирования информации, тогда как у компрессии текстур на чипе упор в мощность блока компрессии. Появляется новый техпроцесс - появляется возможности впихнуть в блок в полтора раза больше транзисторов - появляется лучшая компрессия.

Добавлено спустя 2 минуты 48 секунд:
mag_ai писал(а):
это тоже конь в вакууме - менять в любом случаи придется как минимум маски с помощью которых будут делать эти чипы что ведет вероятней всего к повышению количества брака. а еще нужно новые контроллеры памяти в чипах которые тоже стоят денег и разработки...

А вот Micron с Вами не согласен, и считает, что переделка будет не как минимум масок, а как максимум, да и не глобальная, а чуток, всего в одной части одного блока. Учитывая выпуск на старом оборудовании по старому техпроцессу - уровень брака будет ровно тот же, копейка в копейку. Да и контроллер памяти, который станет читать данные блоками вдове бОльшей ширины - это не новый контроллер, а всего лишь слегка измененный старый.

Добавлено спустя 1 минуту 49 секунд:
mag_ai писал(а):
на кой черт нв говорила о 980 (в том числе и ти) карте как о карте способной на 4к? почему амд говорит что фурия это 4к карта?

Чтобы продать топовые видеоплаты. Топовые, ценой в килобакс. Не мидл за 300-400, и тем более не начально-игровой уровень а-ля GTX 960, с ценой в 250. Эти платы и без 4K отлично продаются. И в следующем поколении будут продаваться. А реальная игра в современные игры с минимум полусотней FPS в 4K на настойках выше среднего, а тем более максимальных невозможна ни сейчас, ни даже в будущих через год-полтора GTX 1080ti. Ибо он будет всего раза в два быстрее теперешнего топа, который в 4K совершенно неиграбелен.

Добавлено спустя 1 минуту 11 секунд:
mag_ai писал(а):
того зачем геморой когда уже есть память имеющие такие характеристики при этом скоро не один кьюникс ее будет выпускать но и самсунг?

К тому, что характеристики то у памяти есть.. А ее саму едва на Фури наскребли...


 

Member
Статус: Не в сети
Регистрация: 23.02.2013
Откуда: г. Орел
MaK123 писал(а):
И этого хватает 980-й, чтобы обойти GTX 780ti у которого память работает в полтора раза быстрее.

производительность видеокарты это только где то 1/3 зависит от памяти. с тем же успехом можно сослаться что скайлайк обходит амдшные фх просто из за того что "память не та".
MaK123 писал(а):
Не путайте 7-zip, задача которого сжимать максимально сильно и реализацию в чипе, с задачей сжать как-нить, лишь бы оно сжалось.

не путай любой алгоритм можно реализовать в кремнии но встает вопрос 1. задержек 2. разности объемов декомпрессионного и сжатого 3. транзисторного бюджета.
MaK123 писал(а):
У 7-zip'а уже все давним давно уперлось в ограничения кодирования информации

уперлось в патенты и сложности алгоритмов потому что например интеллектуальные алгоритмы подбора разных типов компрессии для разных файлов в приделах одного архива прекрасно работают например винзип.
ну а патенты на некоторые методы и алгоритмы сжатия данных до сих пор работают а значит применив их нужно договориться о выплате патентов отчислений как минимум.
MaK123 писал(а):
тогда как у компрессии текстур на чипе упор в мощность блока компрессии.

представь себе нет такого блока.
MaK123 писал(а):
а чуток, всего в одной части одного блока.

однако вы знакомы с тем как эти чипы устроены в кремнии нука расскажите?
пока все что известно что на выходе получим абсолютно совместимые по выводам с гддр5 чипы - насколько они будут совместимы на уровне шины или внутри ничего не говорилось.
MaK123 писал(а):
Учитывая выпуск на старом оборудовании по старому техпроцессу

ну во первых драм только сейчас переводят на 20нм в том числе и видимо гддрам выпускают по нему. а 20нм нифига не старый добрый тех процесс для производителей памяти... как то так.
MaK123 писал(а):
это не новый контроллер, а всего лишь слегка измененный старый.

как вам это то объяснить... архитектурно кп и л2 в видеокартах взаимосвязана при этом если кп изменен - выходит что "таблицы файлов" как минимум должны быть в 2 раза шире это уже не маленькое изменение.
MaK123 писал(а):
Эти платы и без 4K отлично продаются.

ну да... это вам так кажется в реальности все наоборот даже 950 брать никто не хочет и тут вопрос не цены.
MaK123 писал(а):
А ее саму едва на Фури наскребли...

:bandhead: опять сказки у костра... кончайте выдумывать.

_________________
Мертвый киберпанк с улыбкой мутанта... (:


 

Member
Статус: Не в сети
Регистрация: 13.02.2013
mag_ai писал(а):
производительность видеокарты это только где то 1/3 зависит от памяти. с тем же успехом можно сослаться что скайлайк обходит амдшные фх просто из за того что "память не та".

Вовсе нет, когда ее, этой памяти не хватает. Ну например на любых APU, от любого вендора. Выход Broadwell в качестве настольного решения, благодаря чему можно сравнить топовые APU это доказал.
Однако на современных платах обоих вендоров скорости памяти совершенно достаточно. Ее, этой скорости может перестать (а может и не перестать) быть достаточным только для топов следующего поколения, а возможно и через одно поколение. Разводить на плате шину 384 бита шириной научились давным-давно. И это явно не сложнее, чем выпустить GPU с двумя контроллерами памяти, один из которых придется разрабатывать с нуля.

mag_ai писал(а):
не путай любой алгоритм можно реализовать в кремнии но встает вопрос 1. задержек 2. разности объемов декомпрессионного и сжатого 3. транзисторного бюджета.

Совершенно верно. Потому в рамках допустимого для 28-микронного техпроцесса алгоритм компрессии такой, какой есть. А в рамках 16 (или возможно 14) микронного техпроцесса транзисторов станет возможным добавить, и получится другая, лучшая компрессия.

mag_ai писал(а):
уперлось в патенты

В патенты меньше всего. Ибо принцип кодирования избыточной информации на то и принцип, чтобы патентами не регулироваться. Под патент может попасть какая-то конкретная реализация данного принципа, которая ну допустим работает раз в десять быстрее другой реализации.

mag_ai писал(а):
ну во первых драм только сейчас переводят на 20нм в том числе и видимо гддрам выпускают по нему. а 20нм нифига не старый добрый тех процесс для производителей памяти... как то так.

Тем лучше :)
Значит все равно будет брак, покуда техпроцесс не отладят.

mag_ai писал(а):
как вам это то объяснить... архитектурно кп и л2 в видеокартах взаимосвязана при этом если кп изменен - выходит что "таблицы файлов" как минимум должны быть в 2 раза шире это уже не маленькое изменение.

Даже спорить не буду. Но контроллер HDR памяти потребует явно бОльших переделок. И эти переделки можно сделать и потом. Скажем во втором поколении чипов, по техпроцессу 16 микрон. Т.е не бежать впереди паровоза, а дать прирост к текущим топам 50%, за счет нового GPU со скажем бОльшими объемами кеша... и хватит. А через год можно дать еще 30% (за счет того же GPU, но теперь с открытыми всеми блоками, ибо техпроцесс за год отшллифуется, и брака станет меньше, и новой памяти). Т.е. продать одну и ту же хрень два раза. Как Вы там писали выше... "рынок поступает так как ему выгодно - потребитель уже давно не на первом месте." :D

Добавлено спустя 7 минут 55 секунд:
mag_ai писал(а):
ну да... это вам так кажется в реальности все наоборот даже 950 брать никто не хочет и тут вопрос не цены.

Ну не знаю даже.. а кто не берет?
Я вон взял себе 960-ю. Получил прирост под полста процентов в сравнении с 660, что стояла до этого три года. Все игры пошли на самых максимальных настройках (кроме сглаживания, которой задрать на мамсимум я в паре игр таки не могу). Однако для этой пары игр переплачивать за видеоплату вдвое я смысла не вижу.


 

Member
Статус: Не в сети
Регистрация: 23.02.2013
Откуда: г. Орел
MaK123 писал(а):
Выход Broadwell в качестве настольного решения, благодаря чему можно сравнить топовые APU это доказал.

что доказал что едрам который всего на 10гб/с быстрей ддр3 с немного меньшими задержками - ненужный костыль в мире процессоров стоимостью как крыло самолета? что вообще броадвелль доказал и кому?
MaK123 писал(а):
Однако на современных платах обоих вендоров скорости памяти совершенно достаточно.

кому достаточно? вам? или мне? мне нет - я по этому все жду идеального процессора под лга2011 чтоб сесть на 4 канальный а если повезет и 6 канальный кп памяти - задачи бывают разные однако... а на видеокартах вообще не бывает такого как "избыточность" по большей части просто в конкретной ситуации к тонге прикрутили новую память отсюда не эффективность всей платы - будут новые чипы будет иное и в тестах.
MaK123 писал(а):
Разводить на плате шину 384 бита шириной научились давным-давно.

да и 512 бит тоже да и 1024 бит можно - вопрос в чем? цена? готовы за текстолит платить по 100 баксов?
MaK123 писал(а):
И это явно не сложнее, чем выпустить GPU с двумя контроллерами памяти, один из которых придется разрабатывать с нуля.

хуанг опять сидит в луже да? у амд например все готово и я думаю что они даже не рассматривают "другие" вариант - кп готов контракты с кьюниксом есть причем они более выгодные чем у нв. ляпота.
MaK123 писал(а):
Потому в рамках допустимого для 28-микронного техпроцесса алгоритм компрессии такой, какой есть.

нет потому что еще лет 5 пройдет пока что то новое изобретут.
MaK123 писал(а):
возможным добавить, и получится другая, лучшая компрессия.

нет. учите что такое вообще компрессия и как работают вообще компрессия данных на видеокартах...
MaK123 писал(а):
за счет нового GPU со скажем бОльшими объемами кеша... и хватит.

а вы думаете что мегабайт кеша стоит дешевле чем 1 чип на 1гб hbm? могу вас расстроить мегабайт л2 выйдет дороже любой памяти - вообще любой.
MaK123 писал(а):
Ну не знаю даже.. а кто не берет?

нвидиа не от хорошей жизни запускает акцию за акцией то для 960 и выше теперь для 950 - если карты без плюшек никто не хочет брать значит проблема в картах или рынке.

_________________
Мертвый киберпанк с улыбкой мутанта... (:


 

Member
Статус: Не в сети
Регистрация: 13.09.2010
mag_ai писал(а):
этот объем не сравним с объемом текстурного пака если он в пишется где то в область 20% от шины - это будет победа а так в реальности ниже 10% загрузки шины дает можете проверить... теоретик.

С точностью до наоборот. Потому что тот же обсчет физики в подавляющем большинстве случаев проводит CPU, а не GPU. Да и все приказы драйвера (пресловутые draw calls и т.д.) идут через шину. А текстуры... текстуры скорее упираются в дисковую подсистему, чем в шину. Во-первых потому, что сами текстуры на самом деле достаточно маленькие (как по занимаемой памяти, так и по размерам). А во-вторых потому, что они зачастую перебрасываются в видеокарту один раз.

mag_ai писал(а):
в мезориз это ахинею...

Ахинея это то, что постоянно несешь ты, не понимая вообще сути. ПСП - это все равно что указание, что через реку протекает , к примеру, 1000 кубометров воды в минуту. Безотносительно других данных - ширины реки и быстроты течения, он ни о чем не говорит. И именно по такой аналогии любой грамотный человек может понять - что при одинаковой ПСП память может быть быстрой, но с узкой шиной или медленной, но с широкой шиной. Учи матчасть, бездарь.

Добавлено спустя 20 минут 58 секунд:
mag_ai писал(а):
не путай любой алгоритм можно реализовать в кремнии но встает вопрос 1. задержек 2. разности объемов декомпрессионного и сжатого 3. транзисторного бюджета.

Не только. Но откуда это знать неуче вроде тебя?
К примеру, компрессия использующая алгоритм Хаффмана (Huffman) требует разбиения на одинаковые кусочки, после чего чаще встречающиеся куски кодируются более короткими последовательностями кода. И для такого кодирования нужен объем памяти в несколько раз превышающий кодируемые данные, просто потому, что нужен предварительный анализ. Есть, конечно, и алгоритмы, не использующие такое кодирование. К примеру, те же цветоразностные схемы для изображений.

_________________
СМЕРШ - СМЕРть Школоте.


 

Member
Статус: Не в сети
Регистрация: 23.02.2013
Откуда: г. Орел
aasheron писал(а):
Да и все приказы драйвера (пресловутые draw calls и т.д.) идут через шину.

вызовы в "объеме" меньше 100кб/с будут... конечно они нагрузят даже 10гигабитную шину а уж чего говорить про современные.
aasheron писал(а):
А текстуры... текстуры скорее упираются в дисковую подсистему, чем в шину.

текстурный пак ед что может при прелоуде разоганать шину больше 50% загрузки все остальное даже близко не подойдет по объемам. второй по объему это сли и кросс фаер (сли в данный момент не актуально но я думаю как и амд скоро перейдут на общение по пси-е) третье по объему это прилоуд нехватающих данных в том числе текстур четвертой строчкой идет "другое" куда падает и физика и апи и другая сервисная информация.
aasheron писал(а):
А во-вторых потому, что они зачастую перебрасываются в видеокарту один раз.

мы не говорим об "передаваемом объеме за минуту" мы говорим о возможности упереться в пропускную способность шины - то что в час данных по шине может быть передано в несколько раз больше чем текстурный пак мне рассказывать не нужно - но все эти данные даже в теоретической модели не дадут больше 50% от возможности шины а вот текстурный пак в моменты загрузки - может.
aasheron писал(а):
ПСП - это все равно что указание, что через реку протекает , к примеру, 1000 кубометров воды в минуту.

и? какая разница на то что у кого то там 8ггц на памяти толку от этого? или от того что у кого то там больше задержки на эти 8ггц? в реальности интересует скорость выполнения задачи - перенос 1гб информации из точки а1 в точку а2. вопрос "эффективности" "крутости" и тд не стоит в моменты когда мы говорим о скорости - " ширины реки и быстроты течения" это лишь инструменты для достижения поставленной цели не более.
aasheron писал(а):
Учи матчасть, бездарь.

:facepalm: псп это такт на бит = пропускная способность учитывает и частоту памяти и толщину шины данных. как бэ без одной из двоек (2*2) не получить 4. даже представим что 2 * х = 4 или 2 * 2 = х все равно вот такого может быть быстрой, но с узкой шиной или медленной, но с широкой шиной не может быть когда говорят о псп.

_________________
Мертвый киберпанк с улыбкой мутанта... (:


 

Member
Статус: Не в сети
Регистрация: 13.09.2010
mag_ai писал(а):
вызовы в "объеме" меньше 100кб/с будут... конечно они нагрузят даже 10гигабитную шину а уж чего говорить про современные.

Так что же может нагрузить карту? Выдавай срывы покровов. В реальности там далеко не 100кб/с.
А вообще, рекомендую почитать http://www.techpowerup.com/reviews/NVIDIA/GTX_980_PCI-Express_Scaling/1.html


mag_ai писал(а):
текстурный пак ед что может при прелоуде разоганать шину больше 50% загрузки все остальное даже близко не подойдет по объемам. второй по объему это сли и кросс фаер (сли в данный момент не актуально но я думаю как и амд скоро перейдут на общение по пси-е) третье по объему это прилоуд нехватающих данных в том числе текстур четвертой строчкой идет "другое" куда падает и физика и апи и другая сервисная информация.

Ссылочка выше. Если прелоад уже завершен, что же тормозит PCIe 1.1, где пропускная способность 250МБ/с? Поток в 100кб/с? Сорви покровы. :lol:

Цитата:
мы не говорим об "передаваемом объеме за минуту" мы говорим о возможности упереться в пропускную способность шины - то что в час данных по шине может быть передано в несколько раз больше чем текстурный пак мне рассказывать не нужно - но все эти данные даже в теоретической модели не дадут больше 50% от возможности шины а вот текстурный пак в моменты загрузки - может.

И тем не менее, очень медленная (250МБ/с) шина вытормаживает карты. Ответь - почему? :D

Цитата:
и? какая разница на то что у кого то там 8ггц на памяти толку от этого? или от того что у кого то там больше задержки на эти 8ггц? в реальности интересует скорость выполнения задачи - перенос 1гб информации из точки а1 в точку а2. вопрос "эффективности" "крутости" и тд не стоит в моменты когда мы говорим о скорости - " ширины реки и быстроты течения" это лишь инструменты для достижения поставленной цели не более или менее.

И какое это отношение имеет к псп? напомню, за исключением уж очень больших массивов данных, любые данные во VRAM будут храниться на одном канале. Скорость работы одного канала HBM1 при 1.25ГГц= 1.25*128бит=160гигатранзакций/с=~20Гбайт/с. надеюсь, не нужно объяснять и дополнительно приводить слайды SK Hynix, где говорится о 128-битных каналах? Скорость одной микросхемы GDDR5 - 32 пина по 8Гбит/с каждый (8ГГц WCK)=256гигатранзакций/с=~32Гбайт/с. Это, собственно, та скорость, с которой будет передаваться одна отдельно взятая информация внутри каждого вида VRAM. Рассматривать всю ПСП можно только в случае, когда информация гарантировано равномерно распределена по всем каналам памяти.


Цитата:
псп это такт на бит = пропускная способность учитывает и частоту памяти и толщину шины данных. как бэ без одной из двоек (2*2) не получить 4. даже представим что 2 * х = 4 или 2 * 2 = х все равно вот такого может быть быстрой, но с узкой шиной или медленной, но с широкой шиной не может быть когда говорят о псп.

Ещё раз для альтернативно одаренных в логическом мышлении:
1 канал х 32 бита шины канала х 8Гбит/с скорости каждого бита = 256Гбит/с=32Гбайт/с. Это ПСП 1 канала микросхемы GDDR5 при 8 ГГц.
Для сравнения: 256-битная шина GF6800 Ultra с памятью GDDR3, работающей на частоте 1.1ГГц давала карте ПСП в ~35.2ГГц.
Пропускная способность почти одинаковая. Но вот вопрос - что быстрее, одна микросхема GDDR5 на 8ГГц или массив GDDR3?
А про воду, прямая аналогия. Есть 2 реки:
1) вода в первой реке течет со скоростью 1м/с, площадь сечения русла реки - 500кв.м.
2) вода во второй реке течет со скоростью 5м/с, площадь сечения русла реки - 100кв.м
Итоговая пропускная способность первой реки (объем воды прошедший за 1с)= 500*1=500куб.м/с
Итоговая пропускная способность второй реки = 100*5=500куб.м/с

_________________
СМЕРШ - СМЕРть Школоте.


 

Member
Статус: Не в сети
Регистрация: 23.02.2013
Откуда: г. Орел
aasheron писал(а):
А вообще, рекомендую почитать

хрень игровые тесты и причем тут они? не понять.
aasheron писал(а):
Если прелоад уже завершен, что же тормозит PCIe 1.1, где пропускная способность 250МБ/с?

внимание вопрос - реализация на одной микросхемой базе? ответ - нет. что тормозит? ответ - разность реализации.
втыкая устройства куда вздумается очевидным остается что нарваться на задержки / проблемы на вроде "одинаковой шине" легче.
aasheron писал(а):
Ответь - почему?

ответ выше?
aasheron писал(а):
Скорость работы одного канала HBM1 при 1.25ГГц= 1.25*128бит=160гигатранзакций/с=~20Гбайт/с.

а у вас стековая память слоями работает мммм... при этом какие то 1,25ггц. ну да ладно а кто на рынке поставляет hbm в один слой?
давайте я вам предложу другой расчет в реальности плотность гддр5 позволяет получить 1гб 2 модулями и теми самыми 64 бит (и полноценным кп на чипе если что). 1 модуль хбм это 1024 бит берем не выдуманные 1,25ггц или 8ггц а реальные частоты работы то есть 1ггц и 7ггц считаем:
1024 * 1000 = 128000
64 * 7000 = 56000
aasheron писал(а):
256гигатранзакций/с=~32Гбайт/с

... ну вот опять сравнить некий гипотетический слой памяти и целое рабочие решение ммм... хоть не совсем целое в реальности еще нужно найти устройство с 32 битным кп.
aasheron писал(а):
Рассматривать всю ПСП можно только в случае, когда информация гарантировано равномерно распределена по всем каналам памяти.

ммм... я вам щас раскрою тайну но кп уже давно научились делать "раид 0" для чтения / записи. и в конкретном режиме за счет дробленности кп и большего объема на шину хбм выигрывает у гддр в кпд.
aasheron писал(а):
Ещё раз для альтернативно одаренных в логическом мышлении

для еще раз одаренных как вы вычленили слой из памяти то? так можно начать все что угодно вычлинять например блины из hdd модули флеша из ssd... для кого то это возможно и "логика" для меня же это ни какой логикой и не пахнет - стековая память изначально строилась на применении широкой шины данных как многоядерные процессоры строились на работе с параллельными потоками но вы говорите "в жопу все я самый умный я сейчас вам слои сравню" а че тогда не ячейки памяти? ну вот реально они же хранят информацию являются самой малой и не делимой структурой любой памяти? что за дискриминация hbm по отношению к gddr? из одной выравают слои а другой полноценным модулем берем для тестов - сравнив ежа и коня (по вашей логики) можно констатировать что еж не конь.
окей я понял, но только то что это окончательный бред. аминь.

_________________
Мертвый киберпанк с улыбкой мутанта... (:


 

Member
Статус: Не в сети
Регистрация: 01.06.2011
Откуда: Кривий Рiг UA
Фото: 1
MaK123 писал(а):
Можно долго плеваться от того факта, что у GTX 960 шина 128 бит. Но того факта, что эта плата на 30-40% быстрее, чем ее предок GTX 660, у которого шина 192 бита, и процентов на 15 быстрее чем у прямого предка - GTX 760 с шиной 256 бит это не отменяет.
:bandhead: показательно сравнить лучше 660ti и 760ю, почему первая хуже второй? Потому что 24 ROP против 32. А у 960й все 32 ROP, как у 670й, а частоты из-за урезания шины и лишних ядер в SM явно за 1400+, тут даже Нострадамус предскажет паритет c 680 и 770 (в Ферми когда-то из-за техпроцесса в SM было меньше ядер, но на удвоенной частоте для компенсации, Хуанг вернулся на круги своя) :-) плюс что-то даёт и увеличенный кеш и архитектура, а вот Интелу архитектура даёт 3% на поколение, так что это не показатель, кеш гораздо важнее при выставлении ценников на Зион, и частота, чем архитектура :-P более-менее родственные чипы, а вот уже 980 и 780ti фиг сравнить, 48 ROP против 64 и уже не в классе :bandhead:

_________________
По поводу АМД можно сказать, что... http://images.vfl.ru/ii/1466552059/06f0b3de/13108371.gif


 

Member
Статус: Не в сети
Регистрация: 23.06.2011
Откуда: default city
mag_ai писал(а):
уперлось в патенты и сложности алгоритмов потому что например интеллектуальные алгоритмы подбора разных типов компрессии для разных файлов в приделах одного архива прекрасно работают например винзип.
Ну не мог просто удержаться. Винзип как был отстоем 25 лет назад (правда начинал он просто как оболочка для zip), так и остался. Прикола ради решил пожать не очень большой рабочий каталог (90 Мб) с самой разнородной информацией - документы (word, excel, презенташки), текстовые файлы, картинки, исполняемые файлы - всего понемногу. Результат - WinZip - 55.5 Мб, 26 сек, WinRar - 54.2 Мб (6 сек), 7zip - 38.6 (!) Мб, 22 сек. Самый прикол, что WinZip паковал дольше всех (в 4 раза дольше, чем WinRar), а результат оказался самым поганым. Понятно, что мой пример может быть непоказательным. Но в моей практике 7z всегда (95%) жмет лучше рара, но сильно дольше. А WinZip - вообще непонятно что.

mag_ai писал(а):
хуанг опять сидит в луже да? у амд например все готово и я думаю что они даже не рассматривают "другие" вариант - кп готов контракты с кьюниксом есть причем они более выгодные чем у нв. ляпота
Это вы намекаете, что в следующем году АМД отгрызет у Nvidia значительную часть рынка, причем последняя будет терперь убытки, безуспешно пытаясь нагнать утраченное технологическое лидерство? Достаточно смешно, или еще иронии добавить?

mag_ai писал(а):
нвидиа не от хорошей жизни запускает акцию за акцией то для 960 и выше теперь для 950 - если карты без плюшек никто не хочет брать значит проблема в картах или рынке
Бедная NVidia, кругом у неё беды. Как же так вышло, что АМД скатилась до 18% рынка? Если и дальше пойдет такими темпами, через 3 года будет как Matrox.


mag_ai, если отбросить в сторону особенности работы памяти... Вы нам пытаетесь доказать, что инженеры NVidia глупые неучи? Вместо дешевой и массовой (лоль) HBM зачем-то полезли в дебри, развивать непонятно что на свою голову? Откройте им глаза, чтоли. А то ведь сгинут без вашей помощи.

_________________
R Tape loading error, 0:1


 

Member
Статус: Не в сети
Регистрация: 23.02.2013
Откуда: г. Орел
CDG.Axel писал(а):
Самый прикол, что WinZip паковал дольше всех (в 4 раза дольше, чем WinRar), а результат оказался самым поганым.

какая версия программы и какие настройки? вы же прекрасно должны понимать что родной "зип" уг более чем а версия например 9 от 14 отличается сильно.
... да и данном случаи я не говорил о том кто крут или нет - речь шла про то что появившийся алгоритм подбора алгоритмов для сжатия данных в винзип сильно поднял уровень компрессии. если не ошибаюсь такой же функционал есть у WinArc но что то я данных об этом не нашел видимо все же какой то другой архиватор был типо winace. те я привел архиватор в котором я уверен что есть алгоритм подбора метода сжатия в приделах одного архива.
CDG.Axel писал(а):
Достаточно смешно, или еще иронии добавить?

я говорю о том что басня стрекоза и муравей имеет место быть - пока нв танцевала и плясала амд пилила новый кп и выбивала себе контракты выгодные. очевидно что у нв сейчас положении хуже чем могло быть и в этом виновато руководство компании потому что денег у них больше но даже имея запас средств они не рискнули а амд рискнула - очевидно что "кто не рискует тот не пьет шампанское". и да я про те новости где нв может и не достаться в нужном объеме hbm1-hbm2.
CDG.Axel писал(а):
Вы нам пытаетесь доказать, что инженеры NVidia глупые неучи?

я вообще не затрагивал эту тему если что. как бы то ни было разговоры по замене гддр у амд были раньше - новости по xdr:
Цитата:
В начале сентября 2011 года появились неофициальные сведения, что флагманские видеокарты Radeon HD 7900 серии Radeon HD 7000 (Southern Islands) будут использовать XDR2, тогда как на остальных моделях будет установлена GDDR5. В начале ноября об использовании данного типа памяти AMD обмолвилась в своём корпоративном Твиттер-аккаунте.

... и то что они пришли к hbm со временем ничего удивительного. как только пошли слухи о том что амд переключилась на стековую память нв (точней хуанг) начал бегать с макетом карты где эта память есть правда макет был не правильный не думаю что его делали инженеры а не маркетологи но факт есть факт. при этом нв постоянно отчитывается о больших суммах на "исследования и разработку" но отстает от конкурента и тут как раз две версии либо инженеры не те либо деньги идут не туда.

_________________
Мертвый киберпанк с улыбкой мутанта... (:


 

Member
Статус: Не в сети
Регистрация: 23.06.2011
Откуда: default city
mag_ai писал(а):
какая версия программы и какие настройки?
Кхм. Качал вчера самую последнюю версию (20) по этой ссылке. На странице написано "загрузить пробную версию WinZip", ниже "Версия 20". Самый прикол, что на этой странице автоматически начинает качать версию 112ru. Не обратил вчера на это внимание. Версия 20 на сайте по другим ссылкам нашлась в 3 (!) экземплярах (winzip20.exe, winzip20-new.exe, winzip20-wz.exe). Ни одна из них не работает, говорит что нужны права администратора, хотя они есть. В настройках сжатия выбирал "наилучший метод для каждого типа файла". Интрефейс у него, просто ппц. На каждом шагу предлагает себя купить (за $30!). В общем впечатление после себя WinZip оставил наипоганейшее. Ровно такое же, как много лет назад... Я, конечно, верю, что результаты версии 20 могут быть лучше. Но она не поставилась. У меня есть догадки почему - потому что онлайн-инсталлятор (явно необходимая штука для программ размером 5-7 мб) "не смог в интернет". Но программисты WZ настолько криворуки, что отсутствие доступа к инету (на рабочем компе его нет - инет через терминалку) трактует как нехватку прав. Triple facepalm, что еще сказать.

mag_ai писал(а):
я говорю о том что басня стрекоза и муравей имеет место быть - пока нв танцевала и плясала амд пилила новый кп и выбивала себе контракты выгодные
Очень хорошо, если действительно так. Я не хочу смерти АМД в видеосегменте, так как это произошло (хотя многие в это не верят) в десктопном сегменте. Нужна здоровая конкуренция, без которой просто не будет развития. Но чем дальше, тем больше у меня опасений, что еще один год тупки для АМД может стать последним. Она не умрет. нет. Но, как и в случае с процессорами, уйдет из производительного сегмента видеокарт, еще больше сконцентрировавшись на клепании APU. А это верный путь к судьбе матрокса (насколько я помню, он теперь закупает чипы AMD для своих видях, доля коих <0.1%).

Почему я считаю, что АМД в процессорном сегменте мертва? Вроде АМД выпускает новые процессоры, и Интел тоже. Но за 5 лет прирост производительности в домашнем сегменте исчисляется 10-15% (i7-2600k -> i7-6700k), если сравнивать процессоры в разгоне, и не использовать инструкции, которых нет у старого поколения (их использует довольно мало приложений, как ни странно). В реале это означает, что ни АМД, ни Интел за 5 лет ничего толкового не выпустили в принципе. Конечно меньшее энергопотребление это классно, вот только 90% времени компьютер используется в browser-mode, в котором новое поколение жрет на 5-7 Вт меньше старого от силы. Я ценю уменьшение потребления (так как люблю тихие компы), но для 5 лет это ровно ничто.

mag_ai писал(а):
я вообще не затрагивал эту тему если что. как бы то ни было разговоры по замене гддр у амд были раньше - новости по xdr
Вроде как и не затрагивали... Но почему-то доказываете всем, что HBM1.0 это просто-классно-дешево, а у GDDR5X туманные перспективы. Я же более чем уверен, что Хуан(г) решение об использовании GDDR5X принимал (явно не один, а с советом директоров) не с похмелья.

mag_ai писал(а):
при этом нв постоянно отчитывается о больших суммах на "исследования и разработку" но отстает от конкурента и тут как раз две версии либо инженеры не те либо деньги идут не туда
Может NVidia и идет не туда, но 82% рынка дискреток она захватила. А ведь совсем недавно было менее 60%. И, на мой взгляд, выпустила в последнее время отличные карты (поколение 9хх). Если бы еще не курс доллара... Но это сугубо приколы нашей страны. GTX 970 за $329 (причем годные нерефы стоят на каплю больше) - серьезный прорыв с точки зрения "производительность/$", которая в сегменте пред-предтопов всегда была крайне низкой.

_________________
R Tape loading error, 0:1


Показать сообщения за:  Поле сортировки  
Форум закрыт Новая тема / Эта тема закрыта, вы не можете редактировать и оставлять сообщения в ней. Закрыто  Сообщений: 65 • Страница 3 из 4<  1  2  3  4  >
-

Часовой пояс: UTC + 3 часа


Кто сейчас на конференции

Сейчас этот форум просматривают: нет зарегистрированных пользователей и гости: 11


Вы не можете начинать темы
Вы не можете отвечать на сообщения
Вы не можете редактировать свои сообщения
Вы не можете удалять свои сообщения
Вы не можете добавлять вложения

Перейти:  
Создано на основе phpBB® Forum Software © phpBB Group
Русская поддержка phpBB | Kolobok smiles © Aiwan