タグ: llm
"llm" が付いた記事と Wiki ページ
AIエージェントの「ハーネス」を巡る混乱 — 同じ言葉が指す異なるスコープ
Abliteration(アブリテレーション)
LLM の安全性制限を再学習なしで除去する技術。拒否方向の特定と重みの直交化により、RLHF で学習された拒否行動を削除する
MacのローカルLLMが4.1倍速に!Apple Silicon向け新技術「DFlash」
Claude の EQ(脳内トレース能力)
Claude の感情知性の本質。言語化されていないユーザーの意図を追跡・補完する「脳内トレース能力」として現れる
Claude Mythos
Anthropic が開発した次世代フロンティアモデル。SWE-bench 93.9%、数千件のゼロデイ脆弱性発見が可能。安全上の理由から一般非公開で約40組織に限定提供
Anthropic Mythos が哲学者マーク・フィッシャーの名前を出し続ける奇妙な現象
Anthropic の最新モデル Claude Mythos Preview が、哲学者マーク・フィッシャーの名前を自発的に言及し続ける現象について、システムカードの分析とともに解説する
ClaudeのEQとは?「脳内トレース能力」が変えるAI対話の本質
Claude の EQ(感情知性)の本質は脳内トレース能力にある。曖昧な指示から完成像を形にする Claude の対話スタイルと、その活用法を解説。
Claude の思考深度が67%低下?AMD AIディレクターの分析が示す「サイレント・ダウングレード」問題
AMD AI ディレクターが7,000セッション分析で発見した Claude Code の思考深度67%低下問題。Anthropic が認めたアダプティブ・シンキングとエフォートレベル変更の詳細、/effort max による対策を解説。
アダプティブ・シンキング(Claude の思考深度制御)
Anthropic が導入した Claude の思考量を動的に調整する仕組み。ユーザーから「サイレント・ダウングレード」と批判され、/effort max で元の深度に戻せる
Claude Mythos Preview とは?数千件のゼロデイ脆弱性を発見した AI モデルの衝撃
Anthropic が発表した Claude Mythos Preview は、主要 OS の数千件のゼロデイ脆弱性を自律的に発見できる AI モデル。一般公開を見送り Project Glasswing で限定提供される理由と金融業界への影響を解説。