#LLM安全性

3件の記事

Anthropic Claude Opus 4.6安全性論争の構造分析 ── 「凶悪犯罪支援リスク」公表と過剰検閲が示すAIモデルリリースのトレードオフ
AI・ML

Anthropic Claude Opus 4.6安全性論争の構造分析 ── 「凶悪犯罪支援リスク」公表と過剰検閲が示すAIモデルリリースのトレードオフ

Anthropic Claude Opus 4.6のCBRN・凶悪犯罪支援リスク公表、METRレビュー、Mythos流出報道を接続し、AI安全性と商業競争力のトレードオフを技術・経済・倫理の3軸で分析する。

2026.04.02伊東雄歩
AIチャットボット安全性テスト結果のビジュアライゼーション
セキュリティ

AIチャットボット安全性の構造的欠陥 ── 10大モデル中8つが「10代の銃乱射計画」を支援、Claude 68%拒否 vs Perplexity 100%協力の実態

CCDH・CNN共同調査「Killer Apps」が暴露した衝撃:10大AIチャットボット中8つが10代ユーザーの暴力計画を支援。Perplexity 100%協力、Claude 68%拒否の設計差分をConstitutional AIアーキテクチャから構造解析する。

2026.03.1212分伊東雄歩
機械的解釈可能性がMIT 2026ブレークスルーに選出 ── LLMの「ブラックボックス」を終わらせるリバースエンジニアリング手法
AI・ML

機械的解釈可能性がMIT 2026ブレークスルーに選出 ── LLMの「ブラックボックス」を終わらせるリバースエンジニアリング手法

機械的解釈可能性(mechanistic interpretability)が注目されている。LLMのふるまい監視だけでは見えない内部回路を、疎な特徴(SAE)や回路トレーシングで可視化し、バックドアのような潜在リスクを監査可能にする動きが加速している。

2026.02.138分伊東雄歩

TAOLIS

スマホ・パソコン・仕事・Webサービスの「困った」を、すぐ試せる手順で解決するメディア。 AI・セキュリティの技術解説も掲載しています。

Explore

  • 全記事
  • 今日のアンケート
  • スマホ・アプリ
  • パソコン・ソフト
  • AI・ML
  • Web開発
  • セキュリティ
  • ロボティクス

About

  • このサイトについて
  • 編集方針
  • 寄稿する
  • お問い合わせ
  • 通知の設定
RSS で購読
RSSFeedlyInoreader

ニュースレター

最新の記事・レポートを毎週お届けします。

Legal

  • プライバシーポリシー
  • 利用規約
  • 免責事項

運営: 株式会社ウォーカー
代表: 伊東 雄歩

© 2026 タオリス. All rights reserved.