Так как появилось некое социальное давление - начну с репринта первой части главы про ллм.
На этот раз в невиданном для меня формате - аж на 4 площадках, все из которых не-телега =)
Глава, так или иначе переписана, почти целиком - смысл не поменялся, поменялась немного подача и были поправлены фактологические ошибки.
---
Большие модели, маленькие токены.
ЛЛМ - битва за контекст (ч.1)
telegraph: https://t.co/bgED51htoq
habr: https://t.co/53aTcceVN5
Medium (RU): https://t.co/2d7i2zLgZq
Medium (EN): https://t.co/YBLy1xR4De
vc\.ru: https://t.co/7fxQvdQr1q
@mokevnin У меня забавным образом очень много вещей оказалось в параллель с ним сделаны, по-существу, так же.
Пару вещей ессно подглядел и внедрил в свои плагины.
Как-то тенденция, что все приходят к схожим подходам и практикам, с разве что отличиями по стеку.
@kelstar_ Ну и очевидно это не будет работать, если агент работает над вещами, которые требуют конкретного железа, или компиляция кодбазы требует сколь-либо существенные ресурсов или гпу.
@kelstar_ Ну, сейчас бы на дешманские впски таскать креденшалы и конфигурации впнов к копоративным репозиториям🙃
В смвсле как концепт - согласен. Но количество приседаний которые нужно сделать в случае если ты не на гитхабе работаешь - зашкаливает.
Немного контекста: последний раз я писал код "вот этими пальцами" где-то в районе декабря. Хотя вру, кажется, на прошлой неделе показывал интерну как можно лучше и сделал руками просто потому что обьяснять агенту что хочу было дольше чем если бы сам написал.
Наверное, самый главный скилл который приобрел будучи лидом - удержание в голове и способность прыгать по десяткам проектов в день, без особого ущерба качеству.
Помимо 8 разработчиков в команде у меня есть клавдий, которому, в пределах лимитов можно заряжать кучу параллельных задач. Но чтобы оно хорошо работало, без большого количества внимания с моей стороны - надо писать спеку. И это, если что, касается и людей тоже. Просто "почему-то" важность спецификаций мы как человечество, осознали только с приходом железных болванчиков в нашу жизнь. (энтерпрайз за людей не считаем, понятное дело)
Во ворой половине февраля я формализовал окончательно формат моих SDD, который изначально строился с целью быть документом и для клэнкеров и для кожаных мешков. Но формат тот прожил буквально 2 месяца.
4 дня назад я выложил следующую итерацию генератора спецификаций, которую я назвал DRAFT (ну не гений ли? какава игра слов 🤌 и ведь за каждой буквой лежит этам процесса!). Там в корне лежит последовательный поиск понимания между агентом и человеком и последующее выравнивание с реальностью + супер-важная штука которая пришла из DDD - глоссарий.
https://t.co/HFPJEPd7QY
И как же я ржал когда вчера Matt Pockock вчера опубликовал видос про свой grill-with-docs скилл который буквально буква D из моего пайплайна + глоссарий + ADR. Тобишь делает буквально то же что и я, просто в одном скилле. (опять, ссука, получается ситуация с моим cnbuilder и clsx который стал дефолтным в svelte)
А за пару дней до этого я еще и узнал про доклад Декстера Хорти про его QRSPI который просто делает вообще всё то же самое минус глоссарий.
И вот либо гении думают одинаково. Либо... да не знаю, либо дурачки все думают одинаково. Но что-то я сомневаюсь в дурачковости Покока и Хорти🤭
Я не то чтобы пытался хвастаться просто очень приятно осознавать, что видимо, статистически, коммюнити движется к конвергенции подходов. Независимо, при чем.
Кхе-кхе...
Отчаянные времена требуют отчаянных мер.
Я несколько удивлен (в положительном смысле) результатами которые выдает локальный квен.
Из минусов
1) Если в процессе laptop попробовать таки использовать девайс по назначению и положить его на коленки (laptop как никак) - есть неиллюзорный шанс получить ожог.
2) Расход батареи, понятное дело, в космосе - M5 Max при средней интенсивности инференса, скушол 55% батареи за 2 часа.
В остальном - мне какбутобы даже нравится. Как сформирую какое-то мнение еще напишу. В плане именно кода я этого зверя пока не пробовал. Но, чую, придется лезть в сторону `Pi`.
Полезный, так или иначе, сайтец про научные бумаги по ЛЛМкам и АИшке:
https://t.co/pzCF8Cg8JJ
С учётом того что на https://t.co/cMFYg5gCEX совершено невозможный поток статей ежедневно - пусть даже и такой, основанный на моделях, ранкер всё равно выглядит полезным.
Есть, правда, ощущение, что должна вылезать проблема циркулярности. Т.к. ранжированием занимается ЛЛМ, по идее, они должны давать больший вес статьям, которые напоминают те, что были в корпусах на которых модель учили. Что может приводить к снижению скоринга действительно новых или гетеродоксальных статей.
А может я это всё решил написать чтобы пофлексить знанием слова "гетеродоксальный".
I guess we'll never know!