カテゴリ: AI/LLM
"AI/LLM" の記事
Claude Code で作る「世界AIシミュレーター」— 20カ国AIエージェントが自律外交・紛争するリアルタイム地政学ゲーム
Claude Code を使い20カ国AIエージェントが自律外交・同盟・経済制裁を判断する世界AIシミュレーターの技術解説。マルチエージェントシステムの設計パターン、3Dビジュアライゼーション、LLMストリーミングの実装例を紹介。
Googleが1000億の実データで学習した予測AI「TimesFM」をひっそり公開していた
Anthropic Mythos が哲学者マーク・フィッシャーの名前を出し続ける奇妙な現象
Anthropic の最新モデル Claude Mythos Preview が、哲学者マーク・フィッシャーの名前を自発的に言及し続ける現象について、システムカードの分析とともに解説する
Anthropic vs OpenAI:Coding Agent の Harness 戦略はなぜ真逆なのか
Anthropic(Managed Agent)と OpenAI(Codex + Symphony)の Harness 戦略を比較。AI コーディングエージェントの設計思想がなぜ真逆なのか、両社が目指す未来像を分析する。
ClaudeのEQとは?「脳内トレース能力」が変えるAI対話の本質
Claude の EQ(感情知性)の本質は脳内トレース能力にある。曖昧な指示から完成像を形にする Claude の対話スタイルと、その活用法を解説。
Claude の思考深度が67%低下?AMD AIディレクターの分析が示す「サイレント・ダウングレード」問題
AMD AI ディレクターが7,000セッション分析で発見した Claude Code の思考深度67%低下問題。Anthropic が認めたアダプティブ・シンキングとエフォートレベル変更の詳細、/effort max による対策を解説。
MemPalace とは?LongMemEval 96.6%を記録したオープンソース AI メモリシステムの仕組みと論争
MemPalace は LLM に永続メモリを提供するオープンソースシステム。LongMemEval 96.6%のベンチマークスコアの実態、宮殿構造のアーキテクチャ、MCP 対応、コミュニティからの批判を詳しく解説。
エージェントハーネスとメモリのロックイン問題 ― Harrison Chase「Your harness, your memory」を読む
LangChain創設者Harrison ChaseがAIエージェントのハーネスとメモリの不可分性、クローズドハーネスによるベンダーロックインの危険性を指摘。オープンハーネスによる解決策とエージェント開発者が取るべき対策を解説。
AnthropicのAI「Mythos」とマーク・フィッシャー——亡霊論がAIの中で実演される逆説
Claude Mythos Preview とは?数千件のゼロデイ脆弱性を発見した AI モデルの衝撃
Anthropic が発表した Claude Mythos Preview は、主要 OS の数千件のゼロデイ脆弱性を自律的に発見できる AI モデル。一般公開を見送り Project Glasswing で限定提供される理由と金融業界への影響を解説。