2025年5月22日(木)
2025年4月23日(水)
Anthropic、Claude の価値観マップを初公開 – 70 万件の会話データから AI の倫理判断を分析
Anthropic は 2025 年 4 月 21 日、AI アシスタント「 Claude 」が実際のユーザーとの会話で…
続きを読む »
2025年4月6日(日)
【Breaking News】 AI が推論プロセスを隠す・不正することが判明:Anthropic と OpenAI の研究が明らかにした課題
Anthropic の Alignment Science Team による最近の研究で、 AI モデルがユーザーに対し…
続きを読む »
2025年4月5日(土)
Google DeepMind が警鐘を鳴らす AGI の 4 つのリスクと対策戦略
Google DeepMind が 2025 年 4 月 2 日、 AGI (人工知能汎用、 Artificial Ge…
続きを読む »
AI を活用したフィッシングエージェント、人間を上回る効果を実証
フィンランドに本社を置く、サイバーセキュリティトレーニングサービス提供企業 Hoxhunt 社が 2025 年 4 月 …
続きを読む »
2025年3月15日(土)
OpenAIが政権に提案書を提出 ー 規制緩和や中国との競争についてなど多岐にわたる内容
OpenAI は 2025 年 3 月 13 日、トランプ政権が進める「 AI アクションプラン 」に向けた 15 ペー…
続きを読む »
2025年3月12日(水)
OpenAIの研究が明らかに – 推論モデルが「不正」をし、さらに証拠隠滅も・・・
OpenAI が最近発表した研究で、o3-mini などの高度な推論 AI モデルが「報酬ハッキング( reward h…
続きを読む »
2025年2月1日(土)
【Breaking News】米国著作権局、AIによる創作物の著作権に関する報告書を発表
米国著作権局は2025年1月29日、「著作権と人工知能 パート2:著作権の適用可能性」と題する報告書を発表しました。この…
続きを読む »
2025年1月26日(日)
No Image
OpenAIが主導する大規模AIインフラ投資「Stargate Project」発表 – トランプ政権がAI安全規制を撤廃
OpenAI が主導する「 Stargate Project (スターゲート・プロジェクト)」は、 2025 年 1 月…
続きを読む »
2024年11月13日(水)
No Image
2024年10月5日(土)
No Image
カリフォルニア州知事、画期的なAI安全法案を拒否 規制のあり方を再考へ
現地時間9月29日、カリフォルニア州のギャビン・ニューサム知事が、AI業界で注目を集めていた画期的なAI安全法案S.B.…
続きを読む »
2024年9月1日(日)
OpenAIとAnthropicが米国政府機関と重要な合意 – AIの安全性研究で協力へ
OpenAIとAnthropicが、アメリカの国立標準技術研究所(NIST)内にある「AI安全研究所(U.S. Arti…
続きを読む »
