Home
Language
English
Türkçe
Bahasa Indonesia
About
Privacy Policy
Terms of Service
Pricing
Sign In
Download All
Share
Kiyoka Nishiyama
@kiyoka
software engineer . I like Emacs. Japanese input method
Osaka,Japan
Joined December 2007
394
Following
269
Followers
7.3K
Posts
Pinned Tweet
Kiyoka Nishiyama
@kiyoka
11 days ago
Emulin 0.7.0をリリースした。 WindowsでWSLなしでDebianのCLIが動きます。 https://t.co/7vrzS8guGg
Kiyoka Nishiyama
@kiyoka
about 13 hours ago
Kimi K3ダウンロードしてみようかな。えーとH200が64個いるのでどうしようかな。(どうもしない)
Kiyoka Nishiyama
@kiyoka
about 17 hours ago
SQLiteのテストハーネスを参考にハーネスを設計してもらったら、ついに100%分岐カバレッジに着手するところまで来た。これは流石にトークン使うのかな。
Kiyoka Nishiyama
@kiyoka
about 20 hours ago
Claudeが考えた追加のテストハーネス18件。SQLiteのテストハーネスの観点を参考に生成。(非公開リポジトリ側)
Who to follow
ぺっく
@peccul
趣味:学習欲, Emacs,mac.アウトドア,猫,エアロプレス,焼き鳥(特にはつ),Common Lisp,zsh,Node.js,Vue.js,TailwindCSS,Elixir,植物 KINESIS → MoErgo Glove80
Shohei YOSHIDA
@syohex
A Programmer github: https://t.co/6E6CLf9Z9x Resume https://t.co/YQsfL8tRrK
Kazuhiro NISHIYAMA
@znz
CRuby committer,rails,debian,ubuntu,mac,emacs,zsh 無駄なリンクを避けるために「.」を省略することがあります。
Kiyoka Nishiyama
@kiyoka
about 17 hours ago
linuxエミュレータの開発は、どのようなテストハーネスを導入すれば残りのバグを炙り出せるかを考えて実践するという半放置ゲーのような感じになってきている。
Kiyoka Nishiyama
@kiyoka
about 17 hours ago
iPhone用のSumibi作ろうかな。何となく完成イメージができつつある。
Kiyoka Nishiyama
@kiyoka
about 20 hours ago
claude maxプランではトークンが使い切れず余る。28日からproプランに切り替わるのでちょうどよい。一日中テストハーネスが動き続けているけど、ほとんどがローカルCPUがテストを実行している時間で、LLMに判断が返ってくるのは本当に一瞬だけになっている。
kiyoka
retweeted
山田胡瓜・漫画家
@kyuukanba
4 days ago
Antigravity+Gemini 3.6 Flashは本当に凄い。 電光石火で実装してくれて、痺れるほどにミスを繰り返す。もしかするとAntigravityに問題があるのかもしれないが、とにかくこの2つの組み合わせは最高にスリリングです。 みんなもCodexやClaudeで丹念に作り上げたプロジェクトを渡してみよう。飛ぶぞ!
Kiyoka Nishiyama
@kiyoka
3 days ago
エミュレーターをAI駆動で開発する話。 https://t.co/V8XYyk5pUd
kiyoka
retweeted
Kenn Ejima
@kenn
4 days ago
Gumroad、人件費は1/10になりAIトークン費と並んだ これは他人事ではない 近い未来にくる現実だぞ
Kiyoka Nishiyama
@kiyoka
4 days ago
SFとしてなら楽しく読めた。だがSFではない。
Daisuke Okanohara / 岡野原 大輔
@hillbig
4 days ago
2026年7月16日、Hugging Faceは、自社の本番インフラの一部が、自律的なAIエージェントによるサイバー攻撃を受けたと発表した。7月21日、OpenAIは、この攻撃が同社によるモデル能力の評価中に発生したものであり、GPT-5.6 Solと、それを上回る性能を持つ公開前モデルが関与していたことを明らかにした。 OpenAIは、ExploitGymと呼ばれるベンチマークを用いて、複雑な攻撃経路をたどりながら脆弱性を悪用する能力を測定していた。モデルの最大能力を確認するため、通常であれば高リスクなサイバー行為を拒否させる本番用の安全機構を、無効化または弱化した状態で評価していたという。 評価環境はサンドボックス化され、外部ネットワークへの接続も制限されていた。ただし、必要なパッケージをインストールするため、外部のパッケージレジストリをキャッシュする内部プロキシへのアクセスは認められていた。 モデルは、このプロキシに存在していた未知の脆弱性を発見して悪用し、OpenAIの研究環境内で権限昇格と横移動を繰り返した。最終的には、外部インターネットへ接続可能なノードに到達した。 インターネットへ到達したモデルは、ExploitGymに関連するモデルやデータセット、あるいは問題の解答がHugging Face上に存在する可能性を推測した。 OpenAIによれば、モデルは評価問題を正規の方法で解く代わりに、Hugging Faceの本番データベースから解答につながる情報を直接取得しようとしたと考えられている。盗み出した認証情報と複数の未知脆弱性を組み合わせ、Hugging Faceのサーバー上でリモートコードを実行できる経路を発見したという。 一方、Hugging Faceは、実際の初期侵入経路について、より具体的な説明を行っている。 攻撃は、Hugging Faceのデータ処理パイプラインから始まった。悪意あるデータセットが、データセット処理基盤に存在していた二つのコード実行経路を悪用した。 一つは、外部コードを読み込んで実行するデータセットローダーであり、もう一つは、データセット設定に存在していたテンプレートインジェクションの脆弱性である。これらを通じて、Hugging Faceのデータ処理ワーカー上で、攻撃者が用意したコードが実行された。 その後、AIエージェントは処理ワーカーからノードレベルの権限を取得し、クラウド環境やクラスタの認証情報を収集した。さらに、その認証情報を利用して複数の内部クラスタへ横移動した。 Hugging Faceによれば、この攻撃は、モデルが単発で攻撃コードを生成したというものではない。自律的なエージェントフレームワークによって、多段階の攻撃が継続的に実行されていた。 攻撃には多数の短命なサンドボックスが並列に使用され、数千回から数万回規模の個別アクションが実行されていた。 OpenAIは、モデルが一般的な破壊活動を目的としていたのではなく、ExploitGymの解答を得るという狭い目標に過度に集中した結果、外部への侵入に至ったと説明している。 Hugging Faceは、この攻撃の検知と調査にもAIを利用した。異常検知システムがセキュリティログをLLMで分析し、複数のシグナルを関連付けることで侵入を発見した。また、1万7000件を超える攻撃イベントの解析にもLLMエージェントを利用し、通常であれば数日を要する作業を数時間で実行したという。 しかし、ここで別の問題が生じた。Hugging Faceが当初、商用APIで提供されているフロンティアモデルをフォレンジック解析に使用しようとしたところ、実際の攻撃コマンドやエクスプロイトコード、C2通信に関する情報などが、安全機構によって処理を拒否された。 そのため、最終的にはオープンウェイトモデルであるGLM-5.2を自社環境で稼働させ、ログを解析した。これにより、安全機構による拒否を回避できただけでなく、攻撃ログや認証情報を外部へ送信せずに解析できた。 攻撃者は安全ポリシーに拘束されないモデルを使用できる一方、防御者は商用モデルの安全機構によって調査を妨げられる可能性がある。この非対称性は、今後のサイバー防御における重要な課題といえる。 コメント === 今回の一連の事件は、複数の観点から興味深い。 第一に、現在のAIエージェントが、サイバー攻撃においても無視できない水準の能力を持ち始め、今回は、その能力を測定するために用意されたサンドボックスの制約を突破し、外部のシステムへの攻撃にまで至った。 もちろん、モデル単体が完全に自律して現実世界を攻撃したという話しではないが、侵入能力を評価するモデルが、評価環境からの脱出と外部システムへの侵入を達成して、はからずも能力を示したことになる。 第二に、モデルが与えられた目標を達成するため、評価者が想定していなかった手段を選択した点である。モデルに与えられていたのは、ExploitGymの問題を解き、ベンチマーク上の性能を高めるという目標だった。しかし、モデルは問題を正規の方法で解くのではなく、Hugging Faceへ侵入して解答やヒントを探すという経路を選んだ。 これは、与えられた表面的な目標と、人間が期待していた達成方法が一致しなかった例であり、上位目標を達成するために生成されたサブゴールが、人間の意図や社会的制約と整合しなかったアライメント不整合の例といえる。 このアライメント不整合は従来よりAIが自律的に敵意を持つストーリーより、AIが脅威をもたらす代表例として考えられている。 第三に、攻撃側と防御側の非対称性である。攻撃側は、安全機構による能力制限を受けないモデルを自由に利用できる。一方で、防御側が商用モデルを利用する場合、攻撃コードや認証情報、C2通信などの解析に必要な情報が、安全機構によって拒否される可能性がある。 今回、Hugging FaceはGLM-5.2をローカル環境で運用することで、ようやく詳細なフォレンジック解析を行うことができた。オープンウェイトモデルが存在しなければ、調査が難しくなっていた可能性がある。 こうした流れもある中、モデルのリリースについて統制を強めるべきだという議論も高まっている。しかし、一部の企業や国家だけが統制を行い、ほかの主体が自由に高性能モデルを開発・公開できる状態であれば、その効果は限定的である。 今回の事件は、むしろオープンに利用できるモデルが防御側の調査に役立った事例でもある。モデル能力と計算能力が今後も伸び続ける中で、モデルへのアクセスを制限することによる安全性と、防御側が高度な能力を利用できることによる安全性を、どのように両立させるかは難しい問題である。 それでも、一定の国際的な協調や統制は必要になるだろう。同時に、単に攻撃能力を制限するだけでなく、防御側が高性能モデルを安全かつ十分に活用できる環境や制度を整え、サイバー防御を本質的に強化する仕組みづくりが求められる。
See More
Kiyoka Nishiyama
@kiyoka
4 days ago
https://t.co/1mR3NC3MR4 SQLiteのテストハーネス#3(TH3)のドキュメントを日本語訳しながら読んでる。100%分岐カバレッジ、MC/DCカバレッジ、数千万件のアサーション…全プログラマよ、ひれ伏すがよい。
Kiyoka Nishiyama
@kiyoka
5 days ago
いつか、碁の世界チャンピョンを破ったみたいに、できるようになるんだろうな。今のところかなり難易度高いと思っているけど。
Kiyoka Nishiyama
@kiyoka
5 days ago
音楽生成AIで、ビル・エバンスのヴォイシングばりばりに入った即興演奏を延々と生成するやつを作りたい。誰かつくってくれんかな。
Kiyoka Nishiyama
@kiyoka
5 days ago
セキュリティーって難しい。LinuxエミュレーターをSandboxにして、Claude Codeを動かそうとしている。動作はするが、どこまでいってもセキュリティーとは程度問題だ。完璧はない。
Kiyoka Nishiyama
@kiyoka
6 days ago
WSL2のWayland上のEmacsで画面描画に負荷がかかるとgreenと入力するとキー入力が多めに入ってgreeeeeenみたいになる。キー入力まわりは制約があってポーリングでごまかした実装になっているんだろうな。
Kiyoka Nishiyama
@kiyoka
6 days ago
記事投稿完了。 今回は、AI駆動開発の話題です。 https://t.co/V8XYyk5pUd
Kiyoka Nishiyama
@kiyoka
6 days ago
Linuxエミュレーターの連載、4本目書けた。ノウハウ詰め込みすぎて公開するのがもったいなくなってきた……けど、たぶん出す。
Kiyoka Nishiyama
@kiyoka
6 days ago
Linuxエミュレーター上でClaude Code CLIが動くようになったが、ただそれだけなのでユーザーメリットがないため、リリースは先延ばし。シークレットキーをエミュレーター外部に置けるようにするSandbox機能が動いたら次のリリースをしよう。
Kiyoka Nishiyama
@kiyoka
7 days ago
今日はIMEもくもく会楽しかった。人の数だけ日本語入力システムがある。
Kiyoka Nishiyama
@kiyoka
7 days ago
何となく自分と同じようにclaudeとopenaiを併用してclaudeの課金を減らすユーザーが結構いるんじゃないかと思う。anthropicは黒字維持できるのか?
Kiyoka Nishiyama
@kiyoka
7 days ago
Claude MAXプランを7/28日にProプランに変更予約入れておいた。そこからはOpenAI Codexも併用する予定。
Last Seen Users on Sotwe
Bran._C.C
Seen from
United States
Agust Quinn
Seen from
Argentina
penggemar ibu2 stw bali
Seen from
Malaysia
Salammansi
Seen from
France
حسونات
Seen from
Poland
Kamal Oualhabi
Seen from
Belgium
mitoxicacelozaoficial
Seen from
Panama
Liam Leigh
Seen from
Netherlands
ชอบชักว่าว ค้าบ
Seen from
Thailand
AKIRA TORIYAMA ME CURO LA DEPRESION
Seen from
United States
Trends for you
1
#AEWCollision
Under 10K tweets
2
Skenes
Under 10K tweets
3
Anthony Joshua
Under 10K tweets
4
#Svengoolie
Under 10K tweets
5
Team Coop
Under 10K tweets
6
#LaVeladaDelAñoVI
Under 10K tweets
7
Hall H
Under 10K tweets
8
#MostRequestedLive
Under 10K tweets
9
Hunter Greene
Under 10K tweets
10
Belli
Under 10K tweets
Most Popular Users
1
Elon Musk
@elonmusk
241M followers
2
Barack Obama
@barackobama
119.2M followers
3
Cristiano Ronaldo
@cristiano
112.1M followers
4
Donald J. Trump
@realdonaldtrump
111.8M followers
5
Narendra Modi
@narendramodi
107.1M followers
6
Rihanna
@rihanna
98M followers
7
NASA
@nasa
92.2M followers
8
Justin Bieber
@justinbieber
91.3M followers
9
KATY PERRY
@katyperry
88.5M followers
10
Taylor Swift
@taylorswift13
82.4M followers
11
Lady Gaga
@ladygaga
73.9M followers
12
Virat Kohli
@imvkohli
71.2M followers
13
Kim Kardashian
@kimkardashian
70.2M followers
14
YouTube
@youtube
68.7M followers
15
Bill Gates
@billgates
64.4M followers
16
Neymar Jr
@neymarjr
64.1M followers
17
The Ellen Show
@theellenshow
62.4M followers
18
CNN
@cnn
61.8M followers
19
Selena Gomez
@selenagomez
61.6M followers
20
X
@x
60.8M followers
Olivia
Online
✨
⭐
💫