개발자 분들!!!!! 주식하시는 분들!!!!
🚨 진짜 속보입니다.....!!!! (오늘.. 8월 8일 기준)
해외에서도 진짜 난리났고요.
(엔비디아 진짜 비상걸렸습니다.)
(진짜 기존 AI 판도, AI 시장을 100% 바꿔버릴 수 있는..... 스타트업이 될 것 같습니다.)
--> AI 모델의 "가중치" 그 자체를 "반도체"에 물리적으로 박아버리는 스타트업입니다.
(기존 GPU와 완전히 다릅니다.)
(갠적으로 진짜 미친 아이디어라고 생각합니다.)
(이렇게 되면 기존보다 진짜 ⚡️ 수 십배 좋은 전력 효율, 수 십 배 빠른 속도를 낼 수 있습니다.)
Taalas라는 스타트업인데요.
한국 기준으로는 바로 어제 새벽!!
--> "AMD"가 이 AI 반도체 스타트업을 인수하기로 최종 계약을 체결했습니다.
여기서 중요한 건 GPU에 AI를 박는다가 아닙니다.
GPU 자체를 거의 필요 없게 만들고,
특정 AI 모델 하나만을 위한 전용 칩을 새로 만들어버리는 겁니다.
과장이 아니라.. 진짜 앞으로 5년 이내에 이렇게 될 수 있습니다.
---> "클로드 Fable 5 전용 그래픽카드"를 만들어서,
집 PC에 꽂고 클로드 Fable급 AI를 "개인용"으로 24시간 돌리는 미래를 만들어줄 수 있습니다.
(제가 저 기술 관련 논문 찾아봤는데, 진짜 기술적으로 가능할 것 같아요. 빠르면 5년 이내에?)
이게 그냥 제가 상상만 한 얘기가 아닙니다. 진짜.
얘네가 만든 칩은 그래픽 카드처럼 메모리에 AI를 올려서 돌리는 게 아닙니다.
지금까지 실제로 대중에게 공개된 건
라마(Llama) 3.1 8B라는 AI 모델 자체를 본인들의 반도체에 물리적으로 박고 실행까지 제대로 됐습니다.
지금 엔비디아 GPU
--> "아무 AI나 가져오세요. 제가 계산해드릴게요."
(아시겠지만, 범용으로 게임도 가능하고 그 어떠한 AI 모델도 처리가 가능하지만..)
Taalas(탈라스)는
--> "난 Llama 하나밖에 못함.
대신 얘 하나는 미친 듯이 잘함."
실제로 그 대가로 나온 게...
1. 사용자 한 명 기준 약 17,000토큰/초
2. 공개 데모에서도 15,000토큰/초 이상
3. 1,000토큰짜리 답변 생성에 약 0.06초
4. NVIDIA Blackwell 대비 약 48배
5. 구축 비용 20배↓
6. 전력 10배↓
입니다.
근데 제가 여기서 진짜 미친 상상을 하나 해봤습니다.
---> "이걸 Llama 8B 말고 Fable 5로 만들면요?"
물론 Fable 5의 실제 모델 크기와 내부 구조는 공개되지 않았기 때문에,
지금 저 스타트업의 칩 한 장에 Fable 5가 통째로 들어간다고 말할 수는 없습니다.
만약..
앤트로픽이 이 스타트업과 계약을 한다면?
몇 개월 뒤 Fable 5 급 모델이 오픈소스로 공개된다면??
(오픈 웨이트 AI 모델은 지금 프론티어 AI 모델보다 딱 "6개월" 뒤처져 있습니다.)
(--> 이게 말하는 것은 6개월 뒤면 "Claude Fable 5" 급 모델이 오픈웨이트 모델로 나올 수 있다는 뜻이죠.)
Taalas가 "Fable 5 딱 하나만 돌리는 전용 칩"을 만든다면 제가 위에서 말한 상상도 진짜 가능합니다.
실제로도 Taalas도 여기서 멈출 생각이 없는 것 같습니다.
다음 세대 칩은
--> "아예 frontier LLM을 실리콘"으로 만들겠다고 밝혔습니다.
실제로 탈라스 스타트업이 새로운 AI 모델을 전달받은 뒤 전용 실리콘으로 만드는 데..
-----> 단! "2개월"이면 된다고 공식적으로 주장했습니다.
이게 성공하면 진짜 재미있는 일이 생깁니다.
지금 Fable 5 API는 출력 100만 토큰에 $50입니다.
근데 범용 GPU를 포기하고 Fable 5 하나만을 위해 칩을 찍어서 추론 비용이 몇 배, 몇십 배씩 내려가기 시작하면?????
지금은 비싸서 중요한 작업에만 꺼내는 Fable 5를,
나중에는 Sonnet보다 싸게 하루 종일 갈아 넣는 시대가 올 수도 있습니다.
"Fable 5 전용.. 가정용, 개인용 칩 공개!"
-> 내 PC에 꽂음
-> 인터넷 없어도 Fable 5급 AI가 로컬에서 계속 돌아감
-> API 비용 없음
-> 내 코드, 파일이 외부 서버로 안 나감
-> 답변은 거의 즉시 쏟아짐 (거의 디퓨전 모델 마냥)
현재 저 스타트업에서 만든 HC1도
----> 약 250W짜리 PCIe 카드 형태입니다.
당장 Fable 5가 카드 한 장에 들어간다는 얘기는 절대 아니지만,
밀도가 계속 올라가고 큰 모델까지 여러 전용 칩으로 쪼개 넣을 수 있게 되면...
"그래픽카드 뭐 쓰세요?"가 아니라
"무슨 AI 칩 뭐 쓰세요?"라고 묻는 시대가 진짜 올 수도 있습니다.
RTX 5090 사듯이
--> Fable 5 Edition
--> GPT-6 Edition
이런 걸 사는 거죠. ㅋㅋㅋㅋ
AMD가 산 건 단순히 초당 17,000토큰 나오는 작은 AI 칩 회사가 아닐 수도 있습니다.
"AI를 GPU에서 실행하는 시대" 다음에 올
"프론티어 AI 자체를 '내 집 PC'에서 돌릴 수 있는 시대"의 기술을 사버린 걸수도 있습니다....
이런 글 보면 연말 특유의 묘한 감성이 훅 올라옴.
누구한테나 한 명쯤은 있는 듯, 갑자기 얼굴이 스치는 그 사람.
대단한 에피소드가 아니어도 그냥 그 존재감 자체가 기억에 남는 경우가 있더라.
웃픈 장면이든 따뜻한 장면이든, 연말이면 유독 소환되는 거 신기함.
읽다 보니 내 주변 얼굴들도 잠깐잠깐 지나감.