Блог им. Dobriy_Dob

Ии как генератор слов

В продолжение темы про Ии, добавлю несколько тезисов:

Часть 1.
Современные Ии(Llm) это Large Language Model (в переводе на русский — Большая языковая модель).
В базовую модель DeepSeek-V3 при обучении загрузили 14,8 триллиона токенов, это примерно 11 триллионов слов (1 токен ≈ 0,75 слова).
Когда слово попадает в DeepSeek, нейросеть переводит его в математический вектор — длинный ряд из сотен или тысяч чисел.
Эти числа определяют «координаты» слова в виртуальном пространстве смыслов. Близкие по смыслу слова (например, «собака» и «щенок») получают похожие координаты и оказываются рядом друг с другом.
Веса (параметры) — это коэффициенты внутри самой нейросети. Их можно сравнить с силой синапсов (связей между клетками) в человеческом мозге.
В DeepSeek-V3 таких весов 671 миллиард.Когда вы задаете вопрос, координаты ваших слов проходят через эти 671 миллиард весов-фильтров.Каждый вес либо усиливает, либо ослабляет сигнал.На выходе сеть вычисляет, какое следующее слово имеет наибольшую вероятность стать продолжением текста.

Часть 2.
Сложные, абстрактные правила морали (законы, этические кодексы) и формальную логику (математику, философию) человек так же формулирует и передает через слова.
Книги стали главным ускорителем прогресса, поскольку они превратили человеческие знания из индивидуального и смертного опыта в коллективную, вечную и накапливаемую память.
Через слова (лекции, учебники, методички) студент вуза получает около 70–80% объема входящей информации.
В науке влияние языка на поведение и мышление описывается гипотезой лингвистической относительности (Сепира — Уорфа). Согласно ей, структура языка определяет то, как человек категоризирует мир, расставляет приоритеты и в конечном счете действует в бытовых ситуациях.


Данная публикация является личным мнением автора. Мнение владельца сайта может не совпадать с мнением автора.
497 | ★1
5 комментариев
Через слова (лекции, учебники, методички) студент вуза получает около 70–80% объема входящей информации.
Отнюдь не через слова, а через релевантный этим словам свой собственный опыт. И через слова ещё получают структуры.
avatar
tradeformation, согласен, но я это пропустил для краткости. Однако в контексте обучения, слова на лекции соотносятся с вероятным опытом у студента, а потом этот опыт проверяется на экзамене
avatar

Dobriy_Dob, 

А у ии нет связи с опытом.

avatar
tradeformation, веса формируются многократным воздействием. Только первый обучающий токен ложится на пустой параметр(вес). Давным давно я делал распознавание дорожных знаков, на один знак нужно более 30 фоток, после первой фотки у сети уже есть опыт
avatar

Dobriy_Dob, 

опыт включает в себя кинестетический компонент. у ии он отсутствует. и ещё — связи (память) у человека формируется не только многократным повторением. то есть, человек определяет важное не только по количеству повторов. ии такое не умеет.

avatar

Читайте на SMART-LAB:
Фото
EUR/USD: медведи берут паузу «за свой счет», пока быки разогревают двигатели?
Европейская валюта успешно оттолкнулась от мощного технического перекрестка, который сразу привлек внимание крупных участников рынка. Пара...
Фото
Средние доходности облигаций в зависимости от кредитного рейтинга. От B- до AA+
Средние доходности облигаций в зависимости от кредитного рейтинга (бледные столбцы — доходности без сглаживания). И как они изменились за...
Фото
Турнир алготрейдеров в РИЧ 2026: призовой фонд, условия и как участвовать
Всем привет! Т-Инвестиции объявили турнир алготрейдеров в рамках РИЧ 2026 — только роботы, никакой ручной торговли. Призовой фонд 550 000 ₽,...

теги блога Dobriy_Dob

....все тэги



UPDONW
Новый дизайн