Съкращението, което ще срещаш постоянно - във всеки текст за изкуствен интелект.
Механизмът е брутално прост, колкото и мистично да звучи отвън. LLM гледа поредица от думи и предполага коя дума идва следващата. После още една. И още една. Цяло изречение, цял абзац, цяла статия се раждат от хиляди такива малки залагания едно след друго. Затова моят регистър за него е машина, която довършва изречения - не защото е просто, а защото точно това прави във всеки момент, само с усет, изграден от прочетени количества текст, какъвто един човек не побира и в хиляда живота.
Тук е разликата с обикновена програма. Excel формула или калкулатор следват правила, които някой е написал предварително: ако е това, направи онова. LLM няма такива правила - има милиарди вътрешни настройки, наречени параметри, които се нагласят сами по време на обучение, докато моделът чете текст след текст и се учи да разпознава кое звучи естествено. Никой не сяда да пише „ако въпросът е за времето, отговори с прогноза“. Моделът сам стига дотам - като статистика, не като логика.
Самият LLM е двигател. Продуктът е интерфейсът, който слагат отгоре - чатбот, с който говориш. ChatGPT е чат приложението на OpenAI (американска компания за изкуствен интелект), построено върху техните GPT модели, и стигна 100 милиона души само за два месеца - най-бързото разпространение на потребителско приложение дотогава. Claude е асистентът на Anthropic. Зад Google стои Gemini. Различните имена, които срещаш навсякъде - GPT, Claude, Gemini, Llama - са различни LLM-та, обучени от различни компании, с различен вкус и различни грешки.
И тук е уловката, която обичам да казвам направо. LLM не проверява факти - той разпознава какво звучи вероятно. Затова понякога звучи напълно уверено и е напълно грешен - явление с вече собствено име, халюцинация. Машината не лъже съзнателно. Тя довършва изречението по най-вероятния начин, а вероятното не винаги е вярното.
Ще го кажа както го мисля
LLM е като много начетен колега, който никога не признава, че не знае нещо. Ще ти отговори гладко, с увереност, дори когато греши. Не е коварен - просто няма механизъм да каже „не съм сигурен“, освен ако някой изрично не го е научил да го прави.
Работя с тези модели ежедневно и границата, която пазя през цялото време, е тази: използвам ги да мисля по-бързо. Не ги оставям да мислят вместо мен. Машината довършва изречения брилянтно. Преценката остава моя работа.