Autognosis

自分の認知と学習を静かに磨くデジタルノート

速く流れていく情報から少し離れ、自分の頭でじっくり考えられる文章だけを集めています。

更新

2026/9/20

Tag

#モデル解釈性

AI・機械学習
2026年9月18日 13:36
Abstract 3D visualization of geometric vectors and planes converging in a multidimensional space, representing the mathematical structure of language model probability distributions and Bayesian priors in neural networks

非埋め込み行列(アンエンベディング行列)を通じたモデル不確実性の窓

非埋め込み行列(アンエンベディング行列)を通じたモデル不確実性の窓 大規模言語モデルは、内部表現を語彙トークンに対する確率分布に変換する非埋め込み行列を通じてトークン予測を生成します。この行列は隠れ状態をロジット空間にマッピングする学習済みの線形変換です。最近の実証研究(Anthropicの機械的解釈可能性研究、Elhage et al., 2021)は、この行列が単純なトークンマッピング以上の幾何学的構造をエンコードしていることを明らかにしています。具体的には、...

#大規模言語モデル #機械学習の解釈可能性 #ニューラルネットワークの幾何学
-- いいね数
続きを読む
AI・機械学習
2026年8月27日 10:31
Abstract visualization of transformer neural network layers showing colorful token embedding clusters evolving and organizing across multiple transparent geometric planes from chaotic to structured patterns

トランスフォーマーを幾何学として捉える:層別表現進化がなぜ重要か

トランスフォーマーを幾何学として捉える:層別表現進化がなぜ重要か トランスフォーマーは言語タスクとビジョンタスク全般で最先端の性能を達成していますが、その学習メカニズムは依然として完全には特性化されていません。解釈可能性研究の大多数は二つの異なるスケールで動作しています。微視的スケール(個別の注意ヘッド、特定のニューロン)と巨視的スケール(最終出力ロジット、集約損失関数)です。ここに重要な欠落が生じています。中視的スケール、つまり層スタック全体にわたる表現幾何学の...

-- いいね数
続きを読む
AI・機械学習
2026年8月25日 16:11
Abstract visualization of a neural network's internal layers with glowing geometric patterns representing truth detection pathways in gold and misinformation signals in red, set against a dark technical background with flowing data streams

潜在的ファクトチェック:活性化エンジニアリングを通じた偽情報検出

潜在的ファクトチェック:活性化エンジニアリングを通じた偽情報検出 モデル表現内部での偽情報検出の根拠 偽情報検出は、表面的なアプローチが測定可能なスケーラビリティの限界を示す臨界的な転換点に到達しています。 キーワードマッチング、既知の虚偽に対する意味的類似度スコアリング、外部知識検索といった従来の手法は、現代の言語モデルの生成速度と乖離する計算上および時間的な制約を示しています。方法論的に異なるアプローチが必要です。それは、真実性を単なるテキスト...

-- いいね数
続きを読む
AI・機械学習
2026年8月1日 12:10
Split composition showing abstract AI visualization elements separated from real-world professionals at work, illustrating the disconnect between explainable AI research and practical decision-making

ポジション:説明可能性研究は恣意的手法よりも基礎に優先順位を置くべき

ポジション:説明可能性研究は恣意的手法よりも基礎に優先順位を置くべき 増殖と影響のパラドックス 説明可能AI研究は多数の技術を生み出してきました。特徴帰属法(LIME、SHAP)、顕著性マッピング、スパースオートエンコーダ、注意メカニズムの可視化などです。しかし、これらが実質的な意思決定に及ぼす影響についての経験的証拠は限定的です。組織の導入パターンから見ると、説明は主にコンプライアンス成果物として機能しています。規制要件や監査プロセスを満たすために生成され...

-- いいね数
続きを読む
AI・機械学習
2026年7月24日 11:46
A technical visualization of a temporal graph network showing interconnected nodes with glowing edges in the foreground and translucent layered memory blocks in the background, with light trails flowing backward through time to represent memory backtracking in machine learning systems

テンポラルグラフネットワークのメモリバックトラッキングとトポロジカルアトリビューションを通じた説明可能性へ向けて

テンポラルグラフネットワークのメモリバックトラッキングとトポロジカルアトリビューションを通じた説明可能性へ向けて テンポラルグラフネットワークにおける不透明性の問題 テンポラルグラフネットワーク(TGN)は、不正検知、推薦システム、ソーシャルネットワーク分析といったアプリケーションで、動的な関係データをモデル化するために広く導入されています。固定されたトポロジーで動作する静的グラフニューラルネットワークとは異なり、TGNは新しいイベントが発生するたびにノー...

-- いいね数
続きを読む
AI・機械学習
2026年6月25日 08:23
Split illustration comparing human brain executive control with hierarchical top-down pathways on the left versus transformer neural network with distributed bottom-up attention patterns on the right, highlighting architectural differences in attention mechanisms

トランスフォーマーアテンションにおける実行制御の欠陥

トランスフォーマーアテンションにおける実行制御の欠陥 アテンションメカニズムにおける実行制御のギャップ トランスフォーマーのアテンションメカニズムは、人間の認知を区別する重要な能力を欠いています。それが実行制御です。ここでは実行制御を、訓練データから学習した統計的パターンのみに依存するのではなく、タスク目標と文脈的要求に基づいて戦略的に情報フローを調整する能力として定義します。人間の認知は、トップダウンの制御プロセスを採用し、タスク無関連な情報を抑制し、目...

-- いいね数
続きを読む
AI・機械学習
2026年6月4日 18:28
Abstract visualization of a masked sequence model showing discrete tokens with some masked out, connected by neural network pathways, with a partially visible dependency graph structure in the background representing hidden variable relationships

マスク離散シーケンスモデルにおけるペアワイズ相互情報量のニューラル推定

マスク離散シーケンスモデルにおけるペアワイズ相互情報量のニューラル推定 マスクシーケンスモデルにおける隠れた依存性の問題 マスク離散シーケンスモデル—タンパク質構造予測(AlphaFold2、OmegaFold)、コード生成(CodeBERT、GraphCodeBERT)、自然言語処理(BERT、RoBERTa)に展開されているものを含む—は条件付き独立性の仮定の下で動作します。これらのモデルはマスクされたトークンを可視コンテキストに条件付けて予測します。形...

-- いいね数
続きを読む
AI・機械学習
2026年5月5日 13:18
Abstract visualization of neural network activation spaces showing spectral phase transitions, with geometric patterns transitioning from structured crystalline forms to fluid waves, rendered in gradients from cool blues to warm oranges against a dark background

思考のスペクトル幾何学:位相転移、命令反転、トークンレベルダイナミクス、およびトランスフォーマーの推論における完全な正確性予測

思考のスペクトル幾何学:位相転移、命令反転、トークンレベルダイナミクス、およびトランスフォーマーの推論における完全な正確性予測 スペクトル位相転移:推論の隠れた幾何学 論題: 大規模言語モデルは、隠れた活性化空間におけるスペクトル位相転移を示し、これが推論タスクと事実想起タスクと相関している。これらの転移は実装ダイナミクスにおいてアーキテクチャ固有であるが、モデルファミリー全体で一貫した方向性パターンを示す。生成中に測定されたスペクトル署名は、最終ト...

-- いいね数
続きを読む
AI・機械学習
2026年1月20日 01:03
Abstract visualization showing the transformation from smooth softmax attention curves into sharp geometric tropical algebra structures, representing the mathematical convergence of transformer neural networks under high-confidence conditions

思考の幾何学:トロピカル多項式回路としてのTransformerの開示

思考の幾何学:トロピカル多項式回路としてのTransformerの開示 トロピカル幾何学が自己注意機構をMax-Plus代数として明らかにする 主張: Transformerの自己注意機構は、高信頼条件下においてmax-plus代数(トロピカル半環)として動作し、これはsoftmax関数における逆温度パラメータβを通じて形式化できる。 前提条件と定義: - Softmax注意機構は次のように定義される:α(i,j) = exp(β·s(i,...

-- いいね数
続きを読む
TOPへ