Комментарии пользователя Beach Bunny

Мои комментарии:в блогах в форуме
Ответы мне:в блогах в форуме
Все комментарии: к моим постам
Иван Семёнов, лотерая, это же отбраковка, как там тестируют насколько хорошо работает разблокированая память? Шина PCIe урезанная, медленно работает и значит если модель не влазит целиков в видюхи, то падает скорость prefill. Гарантий что память хорошо работает, продаваны не дают и не будут давать, разлочил память и дальше еб##сь c ней сам как хочешь, они даже PCIe шину не допаивают, хотя это несложно.
Плюс еще и нормального охлаждения нет, надо доделывать.
Так что тут лучше переплатить и взять че нит другое, типа Radeon Mi60 Mi50.
Или готовый Radeon 9700x или Intel Arc Pro B70
avatar
  • 20 августа 2026, 14:43
  • Еще
Поскольку цифровой рубель чем то похож на Крипту, ЦБ органичивает сумму на которую можно пополнить цифровой каселёк суммой в 300тыр.

rg.ru/2026/08/19/cb-ustanovit-limit-na-popolnenie-koshelka-cifrovym-rubliami.html

----
Про квалов и неквалов, как с криптой, пока не уточняли.
Так что налетай торопись!
avatar
  • 20 августа 2026, 14:12
  • Еще
Судя по картинкам в Грузии растет число нацистов.
Видимо придется и их освобождать от них.
avatar
  • 20 августа 2026, 08:45
  • Еще
Скорее новый отлив бабла.
Что бывает с деньгами юриков на расчетных счетах, если наворачивается обычный банк ?
Они прощаются со своими бабками.
Получается для юриков имеет смысл загнать все свои деньги в цифровой рубль на счета ЦБ, чтобы такого не происходило.
А вот что будет с банками, если даже только 50% юриков выведут из них свои бабки в ЦБ?
avatar
  • 20 августа 2026, 08:43
  • Еще
А сколько люди потеряли на проблемах из-за блокировок акция на СПБ бирже и на отрицательной нефти?
avatar
  • 19 августа 2026, 22:12
  • Еще
zhorzh, за 3млн можно (пока что )взять 8шт 4090 на 48Gb и борду c Threadripper или EPYC c 200-256Gb  RAM .

И будет 384Gb VRAM на которых можно будет запускать:
GLM-5.2 в Q4 с неплохой скоростью токенов 20-25
Kimi-Code-K2.7 в Q3
MiniMax-M3 будет быстро работать
и все что меньше по размеру в Q8 и быстро
------
Модели большего размера будут работать НЕ быстро, ну и оперативки RAM надо будет больше от 512Gb
========================
Можно и на RTX Spark собрать кластер, но какие скорости будут на Spark сказать не могу, ну и возможно на них будет невысокая скорость Prefill для больших моделей
avatar
  • 19 августа 2026, 21:59
  • Еще
Антон Иванов, это не самая сильная модель.
Сильнее Qwen3.6-27B и Qwen3.8-27B
Qwen3.8-27B — самая сильная из мелких Qwen
avatar
  • 19 августа 2026, 21:41
  • Еще
Ho_Chu, понятненко, товарисчь тихо съехал с темы. 
avatar
  • 19 августа 2026, 19:51
  • Еще
Ho_Chu, то есть по твоему между 96 и 98 огромная разница?
Ok

— то есть 96Gb НЕ хватит для DeepSeek4-Pro !

— Но вот 98Gb ТОЧНО хватит для DeepSeek4-Pro и все будет хорошо работать? 
-----
Ну и с какой скоростью у вас будет работать на 98Gb VRAM?
avatar
  • 19 августа 2026, 19:46
  • Еще
Ho_Chu, ниже почитай что ты писал
avatar
  • 19 августа 2026, 19:31
  • Еще
Ho_Chu, не, тыж писал про DeepSeek4 Pro которому достаточно 96Gb VRAM ?
А теперь пишешь про Flash который примерно в ШЕСТЬ раз МЕНЬШЕ.

avatar
  • 19 августа 2026, 19:22
  • Еще
Ho_Chu, и это все что ты можешь ответить по теме.
Очень содержательный ответ. 
avatar
  • 19 августа 2026, 19:08
  • Еще
Самый минимальный дешманский вход стоит — 1 видеокарта типа RTX3090
можно будет запустить
Qwen3.6-27B
Qwen3.6-35B
Qwen3.8-27B
в кванте Q4 
лучше конечно 2 карты типа RTX3090
чтобы гонять теже модели но в лучшем качестве и большим размером контекста.
Та же DeepSeek4-Flash НЕ намного лучше этих Qwen а требования к железу у нее намного выше.
avatar
  • 19 августа 2026, 19:06
  • Еще

Ho_Chu, угу, напиши какая у тебя будет скорость генерации при всего 96Gb VRAM   для DeepSeek 4 Pro.

У меня вот DeepSeek4-Flash которая гораздо меньше,  на 230Gb VRAM на RTX4090 дает 40 tok/sec генерации, для кванта Q8.

У тя же ДВА спарка и 256Gb VRAM и ты пишешь что этого больше чем достаточно для DeepSeek4-Pro.

Ну так и сколько у тебя токенов ? 

avatar
  • 19 августа 2026, 18:53
  • Еще
Ho_Chu, для 4х Спарков нужен будет еще Свитч, как ты их соеденишь без него.
Кстати Свитч стоит чуть дешевле одного Спарка
avatar
  • 19 августа 2026, 19:29
  • Еще
Auximen, DeepSeek часто врет, НЕ нужно загружать в VRAM все веса MOE модели, часть весов может остатся в RAM, но будет работать немного медленнее.
Напиши ему что он не прав и для MOE модели не нужно все загружать в VRAM, он извинится и напишет другой ответ
avatar
  • 19 августа 2026, 18:43
  • Еще
Ho_Chu, балабол, ты сам то хоть пробовал запускать LLM с быстрым SSD, давай напиши сколько у тебя получается и с какой моделью 
avatar
  • 19 августа 2026, 18:38
  • Еще
Андрей Рулин, в 18 веке получали алмазы, и каким же это образом они делали?
Вы кстати, сколько классов школы окончили?
Говорят что если не учить в школе физику, то будет казаться что весь мир заполнен магией.
avatar
  • 19 августа 2026, 01:39
  • Еще
Гадские япошки, теперь из-за них мы не сможем покупать японские тачки.
avatar
  • 18 августа 2026, 16:10
  • Еще
Три корочки Хлеба богатенькому Буратине!
avatar
  • 18 августа 2026, 15:56
  • Еще
Выберите надежного брокера, чтобы начать зарабатывать на бирже:
....все тэги
UPDONW
Новый дизайн