In 10 years, we’ll be able to extend our brain’s capacity.
In 26 years, we will have a first generation AGI.
What predictions could you make on the future?
Qanday qilib o’ynash mumkin bo’lgan minutlarni 66 foizini o’ynagan odam zahirada o’tirgan bo’ladi? Taktik sabablar, o’yinchini jismoniy holatini ushlab turish uchun qilinadigan ishlarni biladilarmi bu kishi.
Argument boshqa, hate boshqa narsa.
@asperouzb To’liq uzilmagan, internally hosted third-party SW bo’lgan library install qilish un proxy sifatida. Agent shundan chiqib ketgan deyishyapti. O’sha sandbox muhimmi tararam olmagani - bu human error aslida.
Man ham shu sohalardan xabari bor odam sifatida fikrlarimni qoldirsam.
Maqolada keltirilgan argumentlar bir qarashda haqiqatdek ko'rinadi, lekin bir qatlam ichkariga kirilsa, muammo u qadar katta emas.
@Shohrook Aggressive himoya chizig’ini 10m tushirib o’ynatsa ham katta ish berardi. Flikni idealogiyasini eng orqadagi 6 ta o’yinchi bir vaqtda amalga oshirishi juda mushkul. Shuni mukammallashtirishga urinyapti 2 yildan beri.
P.S.
Man ham yangi alifboga o'tishni yoqlamayman. Qisqa muddatda, pala-partish qilinsa "net benefit" manfiyga qarab ketadi. Uzoqni o'ylab, bosqichma-bosqich qilinsa musbatga chiqish ehtimoli oshsa kerak IMHO.
Portugaliya pasportlarida shunaqa harflar bor masalan.
Muammo esa yangi alifbo tadbiq qilingan hujjatlarni hujjat muddati tugamasidan yangilash. Hujjat muddati tugaganda tabiiy ravishda yangilangani ma'qul.
"O'g'li"degan so'z ugli deb kiritilganini sababi Machine-Readable Zone (MRZ) ' ni support qilmaydi, lekin õ ni fold qilib o sifatida o'qib olaveradi. Demak, pasportlarda bemalol õğli deb yoziladi, tizim esa uni ogli deb render qilib tanib oladi.
manimcha.
4. Annotatsiyalar, lug'atlar, glossariylar varaqamli ma'lumotlar. Chop etish va poligrafiyada qog'oz xarajatlari borligi rost, lekin raqamli data (fayllar, lug'atlar, DB) qo'lda qayta yozilmaydi.
5. Xorijiy tizimlar va pasport muammosi argumenti bu yerda noo'rin.
aslida katta muammo emas. To'g'ri, xarajatsiz bo'lmaydi, lekin bu ham deterministik jarayon. Masalan, replace(ism,'sh', 'ş'). Murakkablik faqat qoidalar bir-biriga mos kelmaydigan morfologik bo'linishlarda yuzaga kelishi mumkin, lekin bu 4 ta harfda esa bunday ziddiyat yo'q
va h.k yo’llar bilan o'zgaradi. Hatto LLM vector spaceda ham "shahar" va "şahar" so'zlari bir-biriga yaqin. Contextdan kelib chiqib LLM qaysini ishlatishini estimate qila oladi ko'p hollarda. Vaqt o'tishi bilan yanada yaqinlashib boraveradi.
3. Bu yerda keltirilgan muammo
Man ham shu sohalardan xabari bor odam sifatida fikrlarimni qoldirsam.
Maqolada keltirilgan argumentlar bir qarashda haqiqatdek ko'rinadi, lekin bir qatlam ichkariga kirilsa, muammo u qadar katta emas.
Dasturlar, katta til modellari va databazalardan ozroq xabari bor odam sifatida, bu tredni yozishni joiz topdim.
Kelinglar til o'zgarishlarining kelajakdagi ta'sirini texnologiyalar qanday ishlashi nuqtai nazaridan ko'rib chiqamiz.
degan narsani qarab ko'rishni aytgan bo'lardim. Search algorithm indeksiga shu rule-based mappingni kiritib qo'yish kifoya (Googledai Uzbek Language expertlarga tayanamiz). Ommaviy yangi alifboga o'tish buyurilgandan keyin barcha raqamli ma'lumotlar ham 3-da keltirilgan
alifboda ko'rsatiladi. Bu model ichki arxitekturasiga ta'sir qilmaydi, ya'ni re-training shart emas. Internetda yetarlicha yangi alifbo ma'lumotlari yig'ilganda LLMlar fine-tune (LoRa, SFT, etc.) qilinguncha eng optimal yechim shu.
2. Search enginelarda "character folding"
Masalan, ChatGPTda foydalanuvchi "şahar" deb yozsa, tizim uni AIga uzatishdan oldin "shahar"ga o'giradi. Model o'ziga tanish bo'lgan eski matnlar ustida probability estimation qiladi, javob esa foydalanuvchiga (yana o'sha layer orqali o'tib) yangi
Hatto oddiy regex yoki lookup table orqali.
1. Katta til modellari. Matn LLMga kirishi va generatsiya qilingan matn userga chiqishidan oldin bitta translation layer bilan hal bo'ladigan ish bu.
Taklif qilinayotgan o'zgarishlar bor yo'g'i 4 ta va muqobil harflar "1-to-1 replacement" bilan yechiladi. Har qanday shunaqa korpora egasi (website, publisher, Tilmoch(😀), OpenAI) o'zbek tiliga oid datani uzog'i bir kunda o'girib olishi mumkin.
@Xarisuz Kim bilsin ishqilib. Salahni o’zi ham, sobiq misrlik ref ham, hatto Collina ham o’sha 2 ta vaziyatda ref to’g’ri qildi deb turganda, sizdek xolis odam bunaqa deb tursa qiziq bo’larkan.