タグ: llm
"llm" が付いた記事と Wiki ページ
AIモデルは意図的に性能を低下させている? OpenAI・Google・Anthropicに共通するパターン
Claude Managed Agents: Anthropicが本番運用可能なエージェント基盤をパブリックベータで公開
Anthropic が公開した Claude Managed Agents のパブリックベータを解説。セキュアなサンドボックス、長時間実行セッション、MCP 統合などの機能、料金体系、導入事例を紹介。
Gemma 4 31B vs Qwen3.5-27B — ローカルLLM最強はどちらか
Google Gemma 4 31BとAlibaba Qwen3.5-27Bをローカル実行の観点で徹底比較。ベンチマーク、メモリ要件、マルチモーダル、日本語対応、推論速度を検証する。
AI エージェント
自律的にタスク実行できる AI システム。複数ステップの処理を自己制御で進める
コンテキスト圧縮
LLM の会話が長くなった際にコンテキストウィンドウを管理する戦略群
プロンプトインジェクション
ユーザー入力にシステムプロンプトを改ざんするコードを混在させる攻撃手法
RAG (Retrieval-Augmented Generation)
外部データベースから情報検索し、それを基に LLM が応答を生成する技術
自己改善エージェント
AI エージェントのハーネスを AI 自身が自律的に最適化するパターン
Ollama
ローカル環境で LLM を実行するためのフレームワーク。無料でオフライン推論が可能
AutoAgent — AIがAIを育てる自己改善エージェントOSSライブラリ
AutoAgent は AI エージェントのハーネス(プロンプト・ツール・オーケストレーション)を AI 自身が自律的に改善する Python 製 OSS ライブラリ。24時間の最適化で SpreadsheetBench・TerminalBench 世界1位を達成。