Блог им. Dobriy_Dob

Ии как генератор слов

В продолжение темы про Ии, добавлю несколько тезисов:

Часть 1.
Современные Ии(Llm) это Large Language Model (в переводе на русский — Большая языковая модель).
В базовую модель DeepSeek-V3 при обучении загрузили 14,8 триллиона токенов, это примерно 11 триллионов слов (1 токен ≈ 0,75 слова).
Когда слово попадает в DeepSeek, нейросеть переводит его в математический вектор — длинный ряд из сотен или тысяч чисел.
Эти числа определяют «координаты» слова в виртуальном пространстве смыслов. Близкие по смыслу слова (например, «собака» и «щенок») получают похожие координаты и оказываются рядом друг с другом.
Веса (параметры) — это коэффициенты внутри самой нейросети. Их можно сравнить с силой синапсов (связей между клетками) в человеческом мозге.
В DeepSeek-V3 таких весов 671 миллиард.Когда вы задаете вопрос, координаты ваших слов проходят через эти 671 миллиард весов-фильтров.Каждый вес либо усиливает, либо ослабляет сигнал.На выходе сеть вычисляет, какое следующее слово имеет наибольшую вероятность стать продолжением текста.

Часть 2.
Сложные, абстрактные правила морали (законы, этические кодексы) и формальную логику (математику, философию) человек так же формулирует и передает через слова.
Книги стали главным ускорителем прогресса, поскольку они превратили человеческие знания из индивидуального и смертного опыта в коллективную, вечную и накапливаемую память.
Через слова (лекции, учебники, методички) студент вуза получает около 70–80% объема входящей информации.
В науке влияние языка на поведение и мышление описывается гипотезой лингвистической относительности (Сепира — Уорфа). Согласно ей, структура языка определяет то, как человек категоризирует мир, расставляет приоритеты и в конечном счете действует в бытовых ситуациях.


Данная публикация является личным мнением автора. Мнение владельца сайта может не совпадать с мнением автора.
489 | ★1
5 комментариев
Через слова (лекции, учебники, методички) студент вуза получает около 70–80% объема входящей информации.
Отнюдь не через слова, а через релевантный этим словам свой собственный опыт. И через слова ещё получают структуры.
avatar
tradeformation, согласен, но я это пропустил для краткости. Однако в контексте обучения, слова на лекции соотносятся с вероятным опытом у студента, а потом этот опыт проверяется на экзамене
avatar

Dobriy_Dob, 

А у ии нет связи с опытом.

avatar
tradeformation, веса формируются многократным воздействием. Только первый обучающий токен ложится на пустой параметр(вес). Давным давно я делал распознавание дорожных знаков, на один знак нужно более 30 фоток, после первой фотки у сети уже есть опыт
avatar

Dobriy_Dob, 

опыт включает в себя кинестетический компонент. у ии он отсутствует. и ещё — связи (память) у человека формируется не только многократным повторением. то есть, человек определяет важное не только по количеству повторов. ии такое не умеет.

avatar

Читайте на SMART-LAB:
Фото
Взносы россиян в НПФ в 1 квартале 2026 года достигли 237 млрд рублей
Объем взносов россиян в финансовые инструменты негосударственных пенсионных фондов (НПФ) в 1 квартале 2026 года достиг 237 млрд рублей. Об этом...
Фото
S&P 500: два шага вперед, шаг назад
Ведущий мировой фондовый индекс после консолидации в узком торговом диапазоне пробил его верхнюю границу и на прошлой неделе обновил исторические...
Фото
Ребалансинг в алго №2: RebalancerClassicDividend — акции и золото по расписанию
Продолжаем цикл «Ребалансинг в алго». Сегодня первая практическая статья — разбираем робота RebalancerClassicDividend. Это еженедельный...
Фото
Промомед - самая быстрорастущая компания на рынке по цене IPO
Промомед — фармацевтическая компания с одним из самых высоких темпов роста выручки в 2025 году, и, возможно, в этом году тоже.  Компания...

теги блога Dobriy_Dob

....все тэги



UPDONW
Новый дизайн