最新ノート
iPhone 実機で小型言語モデル 10 種を比較:4K/8K メモリと Agent 精度
Llama 3.2、SmolLM、LFM2.5 を含む 10 種の GGUF モデルを、iPhone の 4K/8K リソースと 96 件の二言語 Agent テストで比較しました。
オンデバイスAILLMモバイル推論ベンチマークエージェントルーティング
一般ノート
Llama 3.2、SmolLM、LFM2.5 を含む 10 種の GGUF モデルを、iPhone の 4K/8K リソースと 96 件の二言語 Agent テストで比較しました。
iPhone 15 Pro Max 上の Qwen3.5-2B に 3,584/7,680-token Prompt を入力し、Prefill、TTFT、生成、メモリ、熱状態を測定しました。
全 96 件の二言語ケースと期待ルートを含め、構造化指標、固定デコード、iPhone 測定、再現証拠、結果の限界まで公開します。