Ho_Chu, штукатурщик и каменщик — там движения достаточно простые и стандартные. Сантехники и электрики много работают в труднодоступных местах + мелкая моторика и нестандартные решения. Думаю следующие после курьеров это сварщики на вход пойдут. Там з/п очень большие, а механика движений проще чем у сантехников и электриков.
Ho_Chu, я бы не забывал, если бы с ним регулярно сталкивался.
А пока я решаю узкие задачи — говорю что где добавить или какой узкий функционал реализовать, и вот минимум что оставался это сейчас в клоде «6% left». Но тут я долго с ним работал в одной сессии.
Так что, видимо, надо исходить из тех задач, которые решаешь.
Ho_Chu, загрузить — точно нет, а выполнить задачу — поэтапно, общей стоимостью 10+ млн токенов — можно. Решается довольно просто: субагенты, канбан-воркеры, фиксация каждого решения в журнал проекта чтобы не потерять готовые решения и не путать шаги выполнения задачи + функция context compaction для сессии = очень приличный результат. И все в одном окне сессии.
Ho_Chu, лимиты контектсного окна, хоть и костылями, но можно подлечить — у меня в одной сессии задачи на 10+ млн. токенов решаются, без падений и потерь. Но в целом это хреновая штука, сильно бесит, конечно.
Ho_Chu, так сколько памяти надо, чтобы пользоваться одному на локальной модели в режимах вопрос-ответ в тексте, без генерации картин, видео и писания длинных многостраничных текстов.
Ho_Chu, но у NVIDIA DGX Spark в описании написано, что он позволяет работать с моделями до 200 миллиардов параметров, а при объединении 2-х до 405 миллиардов параметров, в то время, как у DeepSeek-V4-Pro 1,6 трлн параметров, 2 х 128 Гб универсальной памяти (это означает минус 15 Гб оперативной памяти на задачи системы) для этой модели явно недостаточно.
Ho_Chu, штукатурщик и каменщик — там движения достаточно простые и стандартные. Сантехники и электрики много работают в труднодоступных местах + мелкая моторика и нестандартные решения. Думаю следующие после курьеров это сварщики на вход пойдут. Там з/п очень большие, а механика движений проще чем у сантехников и электриков.
А пока я решаю узкие задачи — говорю что где добавить или какой узкий функционал реализовать, и вот минимум что оставался это сейчас в клоде «6% left». Но тут я долго с ним работал в одной сессии.
Так что, видимо, надо исходить из тех задач, которые решаешь.
Ok
— то есть 96Gb НЕ хватит для DeepSeek4-Pro !
— Но вот 98Gb ТОЧНО хватит для DeepSeek4-Pro и все будет хорошо работать?
-----
Ну и с какой скоростью у вас будет работать на 98Gb VRAM?
А теперь пишешь про Flash который примерно в ШЕСТЬ раз МЕНЬШЕ.
Очень содержательный ответ.
Ho_Chu, угу, напиши какая у тебя будет скорость генерации при всего 96Gb VRAM для DeepSeek 4 Pro.
У меня вот DeepSeek4-Flash которая гораздо меньше, на 230Gb VRAM на RTX4090 дает 40 tok/sec генерации, для кванта Q8.
У тя же ДВА спарка и 256Gb VRAM и ты пишешь что этого больше чем достаточно для DeepSeek4-Pro.
Ну так и сколько у тебя токенов ?![]()
Кстати Свитч стоит чуть дешевле одного Спарка