Автор до сих пор чувствует какую-то магию в больших языковых моделях (LLM). В принципе, он в общих чертах понимает, как они работают, и знает, что никакого волшебства там нет. Но разрыв между его знаниями, которые уже устарели, и тем, что происходит в области сейчас, кажется просто огромным. Всё меняется так быстро, что он полгода назад решил немного подтянуть основы и разобраться с тем, что считает одним из главных кирпичиков LLM - механизмом внимания в нейросетях.
Будем учиться вместе с автором
22.10.2025
Похожее
11.09.2026
Как построить Diffusion Language Model
Это, по сути, введение в диффузионные языковые модели, альтернативу авторегресси...
09.09.2026
Агенты лучше нас
Автор утверждает, что оптимизация производительности перестала быть дорогой спец...
05.09.2026
DDD во времена AI
Статья утверждает, что с ростом AI-кодинга идеи Domain-Driven Design становятся ...
29.08.2026
Фундаментальные знания важны
Автор размышляет о том, что значит быть инженером в эпоху агентного ИИ, и приход...