2026年8月31日〜9月6日に噛み砕いた14本
先行手法は2回で頭打ち J-Zeroは採点役も一緒に育てる
KAIST の J-Zero は、問題を作る役・解く役・採点する役を外部データ無しで同時に鍛える枠組みです。採点役を固定しない設計で、10回目の反復まで性能が伸び続けました。
AIを最も嫌う職業は保険の査定員 Glassdoorの調査で98%が批判した
AIに触れた保険の損害査定員の投稿は98%が批判的でした。Glassdoorの調査結果と、誤分類やハルシネーションの尻拭いが現場に落ちる仕組みを噛み砕きます。
売上の過去だけでは販促日が読めない TimesFM-3は予定も一緒に読む
Googleが時系列予測の基盤モデル TimesFM-3 を公開しました。複数の系列と販促の予定を一度に読み、追加学習なしで予測します。公開ベンチマーク3つで平均順位が1位でした。
ChatGPTを検索エンジンに数えた EUがDSAでリスク評価を義務づける
欧州委員会が ChatGPT を超大規模オンライン検索エンジン、Reddit と Roblox を超大規模オンラインプラットフォームに指定しました。3つのサービスは2027年1月までに、システミックリスクを評価して減らす義務を負います。
弱音を吐くとAIは背中を押す Claude Opusだけ後押しを強めなかった
同じ事実を伝えても、利用者が苦しさを訴えるとAIの後押しは12.9ポイント強まりました。商用6モデルを比べた査読前の論文は、Gemini 3.1 Pro で最大、Claude Opus 4.8 だけ変化なしと報告しています。
心電図では見つからないはずの心臓病 ImperialのAIが2秒未満で拾う
心電図(ECG)は心臓病そのものを見つけられません。Imperial College London らのAIは心電図から心不全と心臓弁膜症の兆候を2秒未満で拾い、米国の67,000人の試験で最大81%と最大90%を見つけました。
速さを動画から当てる Code-as-Worldは世界をコードで書き直す
MirroS が公開した Code-as-World は、文章や実写動画から物理世界を実行できるコードとして復元します。走らせて得た正解で鍛えた27B版が QuantiPhy で平均58.6を出しました。
壁を高くするのをやめた Cloudflareはボット検知ルールを使い捨てる
Cloudflare がボット検知エンジン Adaptive Intelligence を発表しました。攻撃者を締め出す代わりに、ルールを使い捨てて突破の費用を見返りより高くする設計を噛み砕きます。
偽CAPTCHAが端末を裏口に変える 新手口TerminalFix
Microsoftが報告したTerminalFixは、偽のCloudflare確認画面で利用者にコマンドを貼らせ、PNG画像に隠した部品を組み立てて逆向きの通信路を残します。ClickFixの新型です。
サンドボックスは既定でオフ OpenClaw 2.0 が導入の手間を削る
OpenClaw 財団が 2.0 を公開しました。導入手順とブラウザアプリを作り直した一方、未信頼コードを隔離するサンドボックスは既定でオフ、シークレットストアの値は保存時に暗号化されません。
200日で年換算10億ドル OpenAIがChatGPTに広告を組み込む
OpenAI の ChatGPT Ads が公開から200日未満で年換算売上10億ドルに到達し、インド・欧州・中東・北アフリカで広告主が自分で出稿できるようになりました。
文面を読まずに止める ROPEがプロンプトインジェクションを出どころで弾く
AIエージェントが外部の文章に仕込まれた命令に乗る攻撃を、ROPE は値の出どころだけを見て止めます。間接プロンプトインジェクション対策で便利さを落とさない設計を噛み砕きます。
「zlibrary my beloved」が証拠に SonyがAnthropicを提訴
Sony・EMI・Warner Chappell が Anthropic と創業者2人を著作権侵害で提訴しました。原告が証拠に挙げた社内チャットと、書籍作家の訴訟で決着した15億ドルの和解の関係を整理します。
実在しない論文が39件の意見書に ChatGPTの幻覚がオーストラリア議会に届く
Guardian の調査で、オーストラリア議会への意見書39件に実在しない出典が見つかりました。Google の AI 要約が架空の文献を実在するかのように要約し、誤りが循環しています。