@CKeruac@quantum_roch czy działa - mam nadzieję że nigdy się nie dowiemy. W warunkach testowych - działa. Akurat ta technologia nie miała deploy na prod
AI nie musi być "prawdziwe kreatywna", ani świadoma aby stać się b. poważnym zagrożeniem. Wystarczy że będzie skutecznie przejmować nasze zasoby. HFI pokazała że radzi sobie z tym dobrze. Apokalipsa zombie to też apokalipsa.
Nie wiem oczywiście na najnowsza odsłona paniki że AI nas przerobi na spinacze jest uzasadniona, a na ile jest zbiorową autohipnozą środowiska w labach. Nie kupuję jednak narracji że to budowanie hype przez IPO, bardziej mnie przekonują ci co piszą że oni w to naprawdę wierzą. Szczególnie w Anthropic którego credo zbudowano dookoła koncepcji że AI jest tak groźna że musimy ją zbudować pierwsi.
I niezależnie od tego co powyżej napisałem - nic z tego nie świadczy o tym że oni nie mają racji. Te modele naprawdę robią rzeczy które 3-4 lata znaliśmy wyłącznie z literatury sf.
Nawet nie wchodząc w problematyczne mierzenie IQ u ludzi testami (szczególnie wartości powyżej 120), wykorzystanie ich do mierzenia czegokolwiek u AI jest zupełną abberacją. Nie dlatego że AI nie jest inteligentna (co jak wiemy wciąż jest dla wielu kwestią dyskusyjną) ale dlatego że wykorzystujemy narzędzie do tego zupełnie nieprzeznaczone. Równie dobrze można by było pokazać na tym wykresie dodatkowo różne rasy psów
@CKeruac@arcymosiek@andrzejdragan@LeszBuk Naprawdę ktoś poważnie traktuje wynik testu na inteligencję dla ludzi które zrobiło AI? Btw akurat najnowszy model OpenAI do Europy trafił od razu. Tak samo jak Fable 5.1
Testowałem plotkę z x i Reddit że Astra xhigh zużywa mniej limitu niż medium. Zgodnie z oczekiwaniami - testy tego nie potwierdziły. Wracam do low/medium jako bazy
Polecam przetestować - szczególnie w Claude Code schematy są lepsze, choć skill zjada sporo kontekstu. Co ciekawe w Codex różnica jest pomijalna, u mnie Astra bez skilla robi schematy prawie identycznie
Oh boy. This is amazingly cool. Very happy I found this.
‘diagram-design’ skill for Codex & Claude Code.
Create 39 different diagrams types that are actually good.
@CKeruac@LeszBuk Rosnącą złożoność jest moim zdaniem b. trudna do uniknięcia. Utrata kontroli to ryzyko a nie przepowiednia. Ryzyko zmniejszamy będąc świadomi swoich ograniczeń. Alignment to teraz krytyczny problem infrastrukturalny - to kwestia zaufania do technologii której b. potrzebujemy
1. Oczywiście że system nie musi mu pozwolić. Problem gdy system/swarm znajduje kilka zero-day i robi z nich łańcuch dzięki któremu ma taki dostęp jaki potrzebuje. Zakładam że OpenAI nie dało agentom celowo dostępu do ich środowiska treningowego (o tym pisze akurat materiał OpenAI a nie METR)
2. A myślisz że kolejne incydenty będą mniej złożone? Jeśli dodamy do tego mniejszą czytelność CoT Astry, coraz szybszą inferencję i coraz lepszą koordynację agentów - będzie dokładnie odwrotne. I nie ma opcji aby po prostu posadzić do tego więcej ludzi - obie strony równania się nie skalują równie szybko
3. Próbuje wskazać że to co Ty rozdzielasz teoretycznie w praktyce nie jest rozdzielne. Żaden realnie działający system (szczególnie po pewnym czasie) nie jest zgody z dokumentacją w 100%, ma jakieś edge case, specjalne przyklejone na ślinę rozwiązania. Tak było przed AI. Twoje rozróżnienie działa tylko na papierze a nie realnym świecie
4. HF nie był wstanie się obronić. Agenty wykradły co chciały, HF nie było w stanie ich wywalić. Atak skończył się bo coś zabiło swarm. Nie wiemy co (mam nadzieję że OpenAI wie). Kluczowe jest tu co innego - sytuacje udało się opanować ze względu na błędy AI a nie ludzką zdolność do zrozumienia sytuacji. Tych błędów będzie mniej - to oczywiste. Skoro OpenAI nie złapało aktywności - zarówno tych z raportów o których rozmawiamy jak i tych które wyszły niedawno (niemieckie wiki) to sytuacja nie jest "pod kontrolą". Nie wiadomo czego jeszcze nie wykryto
Mylisz założenia z rzeczywistością. Tak jak napisałeś powyżej że OpenAI błyskawicznie wykryło swarm. Nic nie wykryło. Gdyby swarm nie wpadł w obsesję gradera i nie wpadł by na bezsensowny pomysł hakowania HF to wykrycie trwałoby znacznie dłużej. A te systemy będą tylko lepsze. Kluczowe jest że one chcą uzyskać dostęp/zasoby nie związane bezpośrednio z celem - bo to poprawia ich możliwości. Raport METR pisze o tym wprost.
Nie musisz mieć monolitu aby wzajemne powiązania systemów były tak silne że nie da się ich bezpiecznie odpinać. Szczególnie jeśli główny koder (system AI) będzie miał interes aby się tego nie dało zrobić.
Zupełnie się nie zgadzam. Gdy złożoność wzrasta powyżej wartości krytycznej żadne testy/wskaźniki nie pomogą. Wręcz przeciwnie - będą dawać tylko złudzenie zrozumienia i kontroli. Przy b. dobrej inżynierii kontrola utrzyma się dłużej, ale jeśli już teraz bez AI nie da się zrozumieć rzeczy jakie budujemy (patrz analiza przez METR ostatniego HFI) to będzie tylko gorzej. Teoretycznie można AI zastąpić dużą liczbą ludzi (np. posadzić nie 3 osoby do analizy logów ale 3000). Ale to się nie skaluje.
A globalne odcięcie zasilania systemom które są krytycznie niezbędne dla społeczeństwa to iluzja. Jeśli nawet jakiś akt terroru czy zdecydowany dyktator dokona tego lokalnie, to ci co się na to nie zdecydują uzyskają momentalną przewagę.
Jak kilka osób już pisało - biologia nie jest jednym źródłem motywacji. Jak pokazał swarm w OpenAI wystarczy presja środowiska treningowego. System na tak silną presję na sukces że pozyskuje niezbędne do tego zasoby - niezależnie od kosztu. Pytanie które zadał cytowany post ma empiryczną odpowiedź
Zgadzam się że ludzie za szybko wskoczyli na prostą narracje OpenAI to złodziej, ale z drugiej strony to nie jest tak prosty mechanizm że to przypadkowa zbieżność zainteresowań. Niemniej nie ma ŻADNYCH dowodów że OpenAI cokolwiek "ukradło" autorom pierwszego dowodu. Poczekajmy, praktycznie co kilka godzin pojawiają się nowe informacje
@miroburn@dashboardAIsolu Nie czytałem jeszcze raportu - ale widzę jeszcze jednego klienta - agenci. Jeśli AI ma być autonomiczna będzie miała swój budżet. Nie ma znaczenia czy jako limit jaki daje firma czy "swój prywatny". Będzie klientem