推論トレース流出とMac仮想GPU
推論の内部出力とApple SiliconのGPU仮想化が、AI機能の安全性とローカル推論の設計を問い直しています。
検索を開いた時点で最新50件だけを読み込みます。過去分は必要なときだけ追加します。
重要な判断では、記事中の直接リンクから原資料を確認してください。取得できなかった情報は更新なしとして扱いません。
推論の内部出力とApple SiliconのGPU仮想化が、AI機能の安全性とローカル推論の設計を問い直しています。
ローカル・エージェント、BM25によるコード探索、生成物の機械可読マーキングが今日の学習テーマです。
Apache 2.0のオープンウェイトで、24〜32GB級の端末上で常駐エージェントを動かすことを狙った30Bモデルです。