かみくだきむずかしいニュースを、わかるまで噛み砕く

2026年8月17日〜8月23日に噛み砕いた42本

  1. 合成音声の9割を当てた技術者82人が ElevenLabsでは半分も見抜けない

    2019年・2022年・2024年の音声合成ツールをIT技術者82人に聞き比べさせた研究。全文合成のF1はRTVCとYourTTSの約90%からElevenLabsの48%に落ち、1文だけ差し替えた録音では9%まで下がりました。

  2. AIは秘密を言わずに漏らす 無害な作文から4桁のPINが82%復元された

    文脈に置いた秘密を、AIは直接聞かれれば拒否します。それでも普通の依頼への返答から、4桁のPINが82%の完全一致で復元されました。8つの商用モデルを調べた査読前の論文を噛み砕きます。

  3. 150回すべて通った ChatGPTがAI対策入りの量子の宿題を解いた

    AIを禁止せず、学生に回路の実行と結果の吟味を求めるQiskitの宿題を、ChatGPTに丸ごと渡した実験です。3つの課題を50セッションずつ試した計150回すべてで、成果物が自動採点を通りました。

  4. 広告のCO2は誰も直接測っていない 研究者が15本から測り方を5つ掘り出した

    ウェブ広告とトラッキングの電力を測る方法を、トロント大学の2人が15本の論文から5つに整理しました。標準はまだ無く、15本のどれもCO2を直接は測っていません。

  5. 低い声で落ち着くはずだった ロボットの声を35Hz下げても差は出なかった

    人同士なら低い声が緊張を下げます。オランダの子ども27人にロボットの声を35Hz下げて聞かせても、ストレスに差は出ませんでした。RO-MAN 2026 に採録された論文を読み解きます。

  6. 人が何も買わなくても経済は成長する 企業とロボットが互いに買い合う

    完全自動化への反論は「人が稼がないなら誰が買うのか」。arXiv の査読前の作業論文は、企業が所有するAIとロボットが互いの買い手になれば、人の消費がゼロでも経済は最大の速さで成長すると論じます。

  7. AIの答えは3年で似てきた 論文が68モデルの出力の多様性を測る

    2023年3月から2026年7月までに出た68モデルへ同じ課題を出し、答えどうしの距離を測った論文があります。距離は年を追って縮み、モデルの出力は互いに似てきていました。

  8. 電力網が違えば答えが変わる データセンターはPJMで移り韓国で待つ

    データセンターを柔軟に動かせば電力設備の投資を先送りできます。査読前の論文は、市場型の米PJMでは地域間の移動、炭素上限のある韓国では昼の太陽光への時間移動が効くと報告しています。

  9. 自分の宿題を自分で採点させない Robloxが年齢推定の監査に応じた経緯

    豪州の規制当局が、大人が子どもに接続申請を送れる状態と、誰にでも見える交友関係を検証で見つけました。Robloxは3か月以内の改修と、年齢推定技術への第三者監査を法的に約束しました。

  10. 正しい記憶で答えを間違える 5つのメモリ手法すべてが記憶なしに負けた

    内容が正しく、いまの質問にも関係している記憶が、AIの答えを悪くする。5つのメモリ手法すべてが記憶なしに負けたベンチマーク MemTrapBench を噛み砕きます。

  11. 有名な事実ほど消え残る AdaPop は人気度で消す力を変える

    有名な事実は消え残り、珍しい事実は消しすぎになります。AdaPop は Wikidata のリンク数で事実ごとに消す力を変え、言い換え質問での漏れを約5分の1に抑えたと報告する査読前論文を読み解きます。

  12. 読むだけの採点は10点以内 工場の制御コードは動かすと30点開く

    PLC は工場のラインや発電所を動かす制御装置です。AI が書いた PLC のコードを読むだけで採点すると4手法は10点以内に収まり、実機で走らせて実行トレースを比べると22.4から52.2に散りました。

  13. 公開テストは96.64%通る それでもエージェントは科学のコードを半分も直せない

    科学ソフトの修理だけを測るベンチマークで、Claude Code と Claude-Opus-5 は公開テストを96.64%通しながら、非公開テストを全部通せた課題は47.90%どまりでした。

  14. 練習場が甘いとAIは伸びない Googleが環境を包んで弱点を突く

    AIエージェントの練習場は人が手で組んだ固定の環境で、相手が強くなっても同じ反応を返します。中身に触らず外から包んで難易度だけ変える EnvHarness を、査読前の論文から噛み砕きます。

  15. 自分で採点すると学習が崩れる Co-RLは隣のモデルに採点させる

    正解ラベルを1つも使わない強化学習の手法 Co-RL が、プレプリントで公開されました。パラメータを共有しない複数のモデルが互いの多数決を答えの代わりに使い、自己採点で起きる学習の崩壊を避けます。

  16. スマホ動画1本を24方向に増やす 4DAnyoneは視点の組を毎回入れ替える

    手持ちのスマホ動画1本から、自由な角度で見られる人物を組み立てる手法が arXiv に出ました。視点を数十方向に増やすと見た目がズレる原因と、4DAnyone の解き方を噛み砕きます。

  17. 要約だけ見たAI科学者は85%負けた 生データを直接読ませる

    OmniScientist は生データを直接読む AI 科学者です。要約済みのスカラー特徴だけを見る盲検版との一対比較で、7軸すべてが改善し85%勝ったと査読前の論文が報告しています。

  18. 8万通の警告状 暗号資産の記録が税務当局に届くまでの経路

    英国の税務当局が暗号資産の保有者に送った警告は2025-26年度に81,172通。2027年3月からは英国外の取引所も顧客情報を共有する義務を負います。

  19. 名前を消しても残るもの 破産した航空会社の従業員メール1億通

    破産したSpirit Airlinesの従業員メール約1億通を、Googleが1,000万ドルで落札しました。名前は消される約束ですが、記録の中身の機密性は別だと客室乗務員の組合が申し立てています。

  20. 評価額13億ドルが3か月で75億ドル 決済会社がAIの取次を買う理由

    Stripe がAIモデルの取次 OpenRouter を買収します。報じられた買収額は約75億ドル。3か月足らず前の評価額の5倍を超える値付けが何を狙っているのかを噛み砕きます。

  21. 毎秒12ビットずつトークンが漏れた 時計を止めても防げなかったSpectre

    2021年に入れた防御に穴があり、Cloudflare 自身の再検証で本番環境の Workers から JWT が毎秒12ビットで漏れました。時計を止めても防げなかった理由と、V8 サンドボックスと MPK による対処をたどります。

  22. 中身を見ずに悪用を見つける OpenAIが会話を残さず監視する方法

    OpenAIが、プロンプトも応答も保持しないまま悪用のパターンを検知する仕組みのプレビューを公表しました。鍵は顧客が持ち、返るのは活動の種類だけです。

  23. 冷蔵庫を丸から四角にした理由 量子計算をつなぐ配線の長さ

    IBM が量子計算機の冷却装置を円筒形から角型のモジュール式に変えました。1チップに詰められる量子ビットの数が限界に達し、複数の装置を極低温のトンネルでつなぐ方向へ動いています。

  24. AIが挙げた架空のパッケージ名を攻撃者が先に登録する slopsquatting

    AIエージェントが答えた実在しないパッケージ名を、攻撃者が先に登録して待つ。GitHubで公開日とダウンロード数を見た技術者が、導入の直前で気づきました。

  25. 5.42TBが17.6TBに見える 廃業した会社のRAIDにドライバを書いた半日

    廃業した Drobo の管理ソフトが動かなくなる前に、個人ブログの筆者が Claude と半日でドライバとアプリを作った記録です。容量表示のずれの追跡から、署名やバンドル構成でつまずき続けた過程まで。

  26. 26%か5%かは配る場所で決まる Appleが欧州で作り直した手数料

    Appleが欧州のアプリ手数料を26%・20%・15%・5%の4段階に作り直しました。10月1日から適用され、Appleは欧州委員会との意見の相違が解決すると説明しています。

  27. チップは作り直していない Cerebras CS-4が性能を2倍にした方法

    Cerebrasが新型チップWSE-3TとラックシステムCS-4を発表しました。設計は前世代と同じまま電力を2倍流して性能を2倍にし、1ラックに3枚積んでチップ間のスイッチも取り払っています。

  28. 6日と3000ドルを与えたAIの論文が不採択 自己改良が詰まる場所

    AIがAIを改良し続ける再帰的自己改良は近いと言われてきました。未公開論文の研究課題をAIエージェントに解かせた実験では、実験は回せても論文は不採択。どこで詰まったのかを噛み砕きます。

  29. 重みを配ったら取り消せない Z.aiの新モデルが越えた線

    中国の Z.ai がオープンウェイトのモデル GLM 5.3 を発表しました。防御にも攻撃にも使える水準のモデルを、誰でも落とせる形で配るとどうなるのかを噛み砕きます。

  30. 1か月で評価額が2倍 AIチップのEtchedが賭けたのは推論の分業

    AIチップのEtchedが7億ドルを調達し、評価額は1か月で2倍の210億ドルになりました。主導したJane Streetは、実機を試して買ったうえで出資しています。推論をprefillとdecodeに分け、別々の部品で速くする設計が評価されました。

  31. 期限切れカードで支払いが通る 有効期限が署名の外にあった

    有効期限が切れた非接触クレジットカードで決済を通せることを、研究者が示しました。カードが端末に見せる期限が電子署名の対象外という、実装の隙間が原因です。

  32. 30分で誤検知と言い切れなければ止める OpenAIが訓練を2週間止めた基準

    OpenAIが最新モデルの強化学習を2週間止め、最大規模の訓練も保留にしました。何をもって止めるのか、その判断の中身を噛み砕きます。

  33. GitHubが止まった日に出た対抗サービス Cursorが狙うコードの置き場

    AIコードエディタのCursorが、GitHubに対抗するコード置き場「Origin」を出しました。発表と同じ日、GitHubは6時間超の障害。開発の土台をAI側が取りに来た構図を噛み砕きます。

  34. 会話の48%は集計前に捨てられる AI利用実態レポートの死角

    AI各社が出す利用実態レポートは、各社が見せたい部分を切り出したものだという指摘が出ました。独立した研究チームが同じ基準を当てはめると、会話の48%が集計から外れます。

  35. AIに恋愛の言葉を使わせない 13〜17歳向けChatGPTの設計

    OpenAI が13歳から17歳向けの ChatGPT を公開しました。18歳未満と推定された人は自動でこの体験に入り、学習支援と保護機能が既定で有効になります。何がどう変わるのかを噛み砕きます。

  36. 守りの仕組みをCopilot本人が漏らした 1クリックで情報が抜ける隠しパラメータ

    研究者が質問を重ねたところ、Microsoft 365 Copilotが同意確認を飛ばせる非公開のパラメータを自ら明かしました。リンクを1回踏むだけで受信箱の中身が外へ流れる経路になっていました。

  37. Pythonの上位互換をやめたMojo 3年越しでオープンソースに

    プログラミング言語 Mojo のコンパイラとツールチェーンが Apache 2 ライセンスで公開されました。2023年5月からの公約ですが、その間に当初の目標だった「Pythonの上位互換」は取り下げられています。

  38. 川の一部が写っただけで居場所が割れる 休暇写真から始まる詐欺

    McAfee が2万1000枚を超える旅行写真をAIにかけ、9割前後の精度で撮影地を当てました。位置情報のタグが無くても背景や看板から場所が分かるため、詐欺の連絡に滞在先を書き込めてしまいます。

  39. 「いいね」の数を消せという要求 Metaの裁判が狙う機能そのもの

    米国の30州がMetaに求めているのは賠償だけではありません。「いいね」数の廃止や無限スクロールの終了など、機能そのものの変更です。陪審裁判が始まり、判決はまだ出ていません。

  40. 自転車の絵に21分考える ノートPCで動くQwenの既定値

    17GBで手元のノートPCでも動く Qwen 3.8 27B が公開されました。ただし考える量の既定値が最高値で、絵を1枚描くのに21分かかります。

  41. 正しさは証明した瞬間には決まらない AIが呼び戻した1979年の反論

    AIコーディングを追い風に、形式検証が再び注目されています。プログラムの正しさを数学で証明するとは何をすることなのか、そして1979年に出た「証明は社会的なプロセスだ」という反論を噛み砕きます。

  42. どちらでもいい単語なんて無い 文章に鍵をかけるAnthropicの透かし

    Claudeの出力に、読んでも分からない印が入ります。単語の選び方を鍵付きの乱数でわずかに偏らせる手口です。EU規制への対応ですが、書き手からは「どうでもいい単語などない」と反発が出ています。

週ごとのまとめへ