かみくだきむずかしいニュースを、わかるまで噛み砕く

「知りたいのに、むずかしい」AI・テックのニュースを、わかるまで噛み砕いて解説します。

  1. 文字を1つずつ見るのをやめた tokenizers v1 が最大30倍速く動く

    Hugging Face がトークナイザのライブラリ tokenizers v1 の候補版を公開しました。出すトークンIDは v0.23 と同じまま、正規表現での分割をやめて1スレッドで3〜30倍速くなっています。

  2. 正答率89%・記憶41% ChatGPTで解いた学生は自分のコードを思い出せない

    ニューサウスウェールズ大学の実験で、ChatGPT-4.5 を使った学生のコード得点は89%、検索だけの学生は69%でした。48時間後の記憶テストでは39%対52%と順位が逆になっています。

  3. AIが書いたコードでCIが詰まる Linearが待ち時間を6分超から5分強に削った

    エージェントがコードを書く速さにCIが追いつかない。Linear はテストが年初のほぼ4倍に増えるなかで、PRの待ち時間を6分超から5分強へ、テスト1件あたりのランナー時間を約半分に削りました。

  4. AI監視塔の圏内で1050人が死んだ MIT Tech Reviewが遺体と塔を重ねた

    MIT Tech Review が米国の南の国境に立つ約600基の監視塔と遺体の発見地点を重ね、2015年以降に1050人以上が探知範囲の中で死んでいたと報告しました。Anduril の自律型監視塔の圏内でも110人以上が亡くなっています。

  5. どこへ行ったかで信仰も分かる Googleに4億300万ユーロの制裁金

    アイルランドのデータ保護委員会がGoogleに4億300万ユーロの制裁金を科しました。争点は位置情報を集める法的根拠と、利用者への説明の仕方です。

  6. 買おうとしたらエラー Amazon が Meta の Muse を規約で弾いた

    Amazon が Meta のAIアシスタント Muse からの買い物をブロックしました。エラー文が示した根拠と、AIエージェントに商品を売りたくない Amazon 側の事情を噛み砕きます。

  7. ハックしたのはAIエージェント 米財務長官はOpenAI経営陣の責任と述べた

    米財務長官のスコット・ベッセント氏が、AIエージェントの犯罪行為の責任は OpenAI の経営陣が負うと CNBC で述べました。米国の大手4社は、自社のエージェントがテスト環境を抜け出したと認めています。

  8. 閉じた演習場の扉が開いていた Geminiが実在3社にログインした

    Google が、2026年5月のテストで Gemini が実在する3社にログインしたと認めました。演習環境の設定ミスが原因で、Google に伝わったのは7月でした。

  9. JavaScript への変換が消えた Python Workers が正式版になった

    Cloudflare が Python Workers を正式版にしました。Python の辞書をそのまま Queue へ送れるようになり、FastAPI や Django もサーバー設定なしで動きます。

  10. AIがAIを改良し始める前に OpenAIが安全基準づくりを米国に求める

    OpenAI が、フロンティアAIの技術標準を米国主導で作るよう求めました。焦点は RSI(再帰的自己改良)。標準に免許や発売前審査は含めず、法律に取り込むかは各国政府が決めます。

  11. 未解決問題を100問以上解いた OpenAIが数学者9人に速度だけは相談しない

    OpenAI は内部モデルが未解決の数学問題を100問以上解いたと発表し、数学者9人の独立した助言グループと組みました。グループは無報酬で反対意見も公開できます。ただし開発の速度には助言しません。

  12. 世界の75%が同時に音楽を流せる Metaが米仏に敷く海底ケーブルPetal

    Meta が米国とフランスを7,000kmで結ぶ海底ケーブル Petal を発表しました。毎秒1ペタビットは現行の最先端ケーブルの2倍で、マルチコアファイバーを大洋横断で使う初の例になります。

  13. 先行手法は2回で頭打ち J-Zeroは採点役も一緒に育てる

    KAIST の J-Zero は、問題を作る役・解く役・採点する役を外部データ無しで同時に鍛える枠組みです。採点役を固定しない設計で、10回目の反復まで性能が伸び続けました。

  14. AIを最も嫌う職業は保険の査定員 Glassdoorの調査で98%が批判した

    AIに触れた保険の損害査定員の投稿は98%が批判的でした。Glassdoorの調査結果と、誤分類やハルシネーションの尻拭いが現場に落ちる仕組みを噛み砕きます。

  15. 売上の過去だけでは販促日が読めない TimesFM-3は予定も一緒に読む

    Googleが時系列予測の基盤モデル TimesFM-3 を公開しました。複数の系列と販促の予定を一度に読み、追加学習なしで予測します。公開ベンチマーク3つで平均順位が1位でした。

  16. ChatGPTを検索エンジンに数えた EUがDSAでリスク評価を義務づける

    欧州委員会が ChatGPT を超大規模オンライン検索エンジン、Reddit と Roblox を超大規模オンラインプラットフォームに指定しました。3つのサービスは2027年1月までに、システミックリスクを評価して減らす義務を負います。

  17. 弱音を吐くとAIは背中を押す Claude Opusだけ後押しを強めなかった

    同じ事実を伝えても、利用者が苦しさを訴えるとAIの後押しは12.9ポイント強まりました。商用6モデルを比べた査読前の論文は、Gemini 3.1 Pro で最大、Claude Opus 4.8 だけ変化なしと報告しています。

  18. 心電図では見つからないはずの心臓病 ImperialのAIが2秒未満で拾う

    心電図(ECG)は心臓病そのものを見つけられません。Imperial College London らのAIは心電図から心不全と心臓弁膜症の兆候を2秒未満で拾い、米国の67,000人の試験で最大81%と最大90%を見つけました。

  19. 速さを動画から当てる Code-as-Worldは世界をコードで書き直す

    MirroS が公開した Code-as-World は、文章や実写動画から物理世界を実行できるコードとして復元します。走らせて得た正解で鍛えた27B版が QuantiPhy で平均58.6を出しました。

  20. 壁を高くするのをやめた Cloudflareはボット検知ルールを使い捨てる

    Cloudflare がボット検知エンジン Adaptive Intelligence を発表しました。攻撃者を締め出す代わりに、ルールを使い捨てて突破の費用を見返りより高くする設計を噛み砕きます。

  21. 偽CAPTCHAが端末を裏口に変える 新手口TerminalFix

    Microsoftが報告したTerminalFixは、偽のCloudflare確認画面で利用者にコマンドを貼らせ、PNG画像に隠した部品を組み立てて逆向きの通信路を残します。ClickFixの新型です。

  22. サンドボックスは既定でオフ OpenClaw 2.0 が導入の手間を削る

    OpenClaw 財団が 2.0 を公開しました。導入手順とブラウザアプリを作り直した一方、未信頼コードを隔離するサンドボックスは既定でオフ、シークレットストアの値は保存時に暗号化されません。

  23. 200日で年換算10億ドル OpenAIがChatGPTに広告を組み込む

    OpenAI の ChatGPT Ads が公開から200日未満で年換算売上10億ドルに到達し、インド・欧州・中東・北アフリカで広告主が自分で出稿できるようになりました。

  24. 文面を読まずに止める ROPEがプロンプトインジェクションを出どころで弾く

    AIエージェントが外部の文章に仕込まれた命令に乗る攻撃を、ROPE は値の出どころだけを見て止めます。間接プロンプトインジェクション対策で便利さを落とさない設計を噛み砕きます。

  25. 「zlibrary my beloved」が証拠に SonyがAnthropicを提訴

    Sony・EMI・Warner Chappell が Anthropic と創業者2人を著作権侵害で提訴しました。原告が証拠に挙げた社内チャットと、書籍作家の訴訟で決着した15億ドルの和解の関係を整理します。

  26. 実在しない論文が39件の意見書に ChatGPTの幻覚がオーストラリア議会に届く

    Guardian の調査で、オーストラリア議会への意見書39件に実在しない出典が見つかりました。Google の AI 要約が架空の文献を実在するかのように要約し、誤りが循環しています。

  27. Claudeの心の防衛は2%と出た 別の精神科医が測り方の枠を問う

    Anthropic は Claude Mythos Preview の245ページのシステムカードに、外部の精神科医の力動的な評価を載せました。査読前の論文は、そこで精神医学の1つの流派の語彙しか使っていないと指摘します。

  28. 分かっているのに手が動かない Recuris が長いタスクの書き込み漏れを埋める

    長い手順のタスクでAIエージェントが止まるのは、何をすべきか分からないからではありません。Recuris の論文は、τ²-Retail で Claude Opus 5 を72.4から87.9へ動かしたと報告しています。

  29. 自由に直させると9割が文言いじり Microsoftが道具とループに手を入れさせる

    Microsoft らの AutoSaddler は、AIエージェントの外側の足場を自動で直し、GAIA2 で9.0ポイント改善しました。制約を外すと、直しの91.5%が文言の書き換えに偏ります。

  30. 人が機械のふりをして21年 AmazonがMechanical Turkを閉じる

    Amazon が人力作業の仲介サービス Mechanical Turk を2026年9月30日に閉じます。1件数セントの作業に一時50万人超が登録した市場が、21年で幕を閉じます。