AI News

~AI関連記事を3行にまとめて紹介~

🤖

【書評】LLMアプリケーション評価駆動開発 継続的に改善し運用していくための実践知|npaka

  • LLM搭載アプリの出力不確実性を前提に評価手法を解説。
  • データセット作成からリリース後の監視・改善までを体系化。
  • 評価ツールを活用したハンズオンと継続的改善の実務。

🧠

トランプ氏、AI懸念を陰謀と一蹴 「高IQの大統領いれば統制は十分」 - 日本経済新聞

  • AI懸念を陰謀と否定し、SNSで反論した。
  • AIとデータセンターを標的とする陰謀が進行中だと主張。
  • IQの高い大統領が統制を担えると語った。

📚

【生成AI時代、ITエンジニアの「技術書」活用実態調査】 約9割が「AIや動画が普及しても技術書は..

  • 生成AI普及後も技術書を手放さない人が多い
  • 情報の信頼性と何度も読み返せる点が継続の理由
  • 入手手段はWeb・電子書籍・紙など多様で活用法も豊富

🚗

無人タクシー、東京で来年運行へ GO、Waymo、日本交通が合意 - ITmedia NEWS

  • 東京都内で自動運転タクシーの実用化に向け提携を発表。
  • 2025年から都内7区で試験走行を開始し、同乗試験も進む。
  • 段階的に100台規模を投入し、完全無人化を2027年目指す。

🎉

Ex-FTC boss Khan urges Uncle Sam to break out the handcuffs for AI CEOs, citing 1934 prece..

  • 元FTC長官は現行法で幹部を訴追可能と政府へ認識させるべきだ。
  • 1934年の最高裁判例を根拠に現行法の適用を訴える。
  • 既存法の適用と新法整備を並行させるべきだと提案。

🎮

「GPT Astraでゲーム開発=ほぼソシャゲ」説を唱えたい 非エンジニアの挑戦は、廃課金への道か ..

  • 非エンジニアでもゲーム開発は可能と期待されるが、現実は課金の壁が大きい。
  • 娘向け着せ替えゲームは初期棒立ちキャラで挫折、修正はAstraとGeminiを使い分け。
  • Plus(月3千円)でも5時間上限に阻まれ休止を挟み、結局Proプランへ移行を余儀なくした。

🤖

「ロボットがロボットを作る」人型ロボット工場が生産を開始 - GIGAZINE

  • 年10,000台規模の人型ロボット工場が稼働を開始。
  • 資材搬入やネジ締めの多くをロボが担う補助的役割。
  • 主力はWalker SとCruzr、物流はY1とS2が担当、デジタル工場で不具合を事前削減。

🤖

Microsoftが「人間はAIより重要」とするAI行動規範を発表、AIの意識や権利を否定 - GIGAZINE

  • 新たな倫理規範案が公開され、AIは人間を優先する方針が示された。
  • 意識や権利の付与は認めず、人間の制御下でのみ機能する設計。
  • 感情演出や人格権付与を否定し、安全のため絶対制約と人間制御要件を設ける。

😂

Google、AI回答に貢献したサイトに報酬を支払う「AI contribution pilot」をテスト中

  • 回答生成に寄与するサイトへ報酬を支払う試験を拡大中
  • 中小サイトも対象、検索コンソールの専用パネルで月額報酬と履歴を確認可能
  • 算定式は非公開、ファクトチェック参照のみは対象外

🤖

トランプ大統領、アモデイ氏を名指しで「完璧な小さい天使のふり」 「AIに必要なガードレールは..

  • Truth SocialでAIのガードレールは高IQの大統領にのみ必要と主張した。
  • アモデイCEOを『完璧な小さい天使のふり』と評し、政権は抑制を続けると強調。
  • 中国を含む先端国を抑え、陰謀論者に警戒を呼ぶと述べた。

🌍

中国外務省、AI開発「減速論」に反応 「恐怖をあおることや対立、悪性の競争は誰の利益にもなら..

  • 恐怖の煽動や対立はAIガバナンスを妨げると指摘された
  • 人工知能は全人類の幸福を実現する開放的で包摂的な推進が必要だ
  • BRICSでオープンソース推進とクラウド基盤を整備し、協力を深める方針

🚀

Claudeは計画、Antigravityは実行。AIを2つ使い分けたら開発が回りはじめた | ライフハッカー・..

  • 規模拡大にはAIを2つに分け役割を分担する。
  • 計画はClaude、実行はAntigravityが担い全体を整合させる。
  • 開始前の承認とレビュー手順で品質と透明性を保つ。

🔥

攻撃者より先に動くサイバーセキュリティへ | 株式会社KDDI総合研究所

  • AI時代の防御は攻撃者の意図を先読みする。
  • 仮想企業環境と動的ハニーポットで手口を観測。
  • データとダークWeb情報をCTIへ加工し次手を予測。

💡

Tell agents the why, not just the how

  • なぜそれをするのか、背景と前提を共有して成果を高める。
  • 長期目標と短期目標の両方を示して誤解を減らす。
  • 背景も含む文脈を共有すると成果が上がる。

🔒

その.envのAPIキーが、AIエージェントを「内通者」に変える――“人間前提のやり方”は破綻した..

  • AIエージェントは環境変数だけでは鍵の流出を招く。
  • 多くの現場で.env活用が主流だが外部ツール連携でリスクが拡大。
  • 漏洩は前年比増でOAuth未採用のサーバが多いのが実情だ。

🔥

2026年9月時点 Microsoft の AI 戦略について #AI活用 - Qiita

  • 作業を手伝う機能群が日常業務を支援する。
  • 必要情報をAIへ渡して意思決定を加速する仕組み。
  • AIの管理・保護を強化し、ガバナンスと改善を推進する。

🚀

トランプ氏、AIへの警告を「でっち上げ」と一蹴 政権内に不安の声 - CNN.co.jp

  • AIの発展を妨げる“病的な陰謀”を主張し、規制強化を退けた。
  • 懸念を“でっち上げ”と批判し、政府介入に慎重姿勢を示した。
  • 政権内では規制の動機に疑問が生じ、混乱が広がる可能性を指摘。

🎨

古坂大魔王が8歳娘の手描きキャラをAIアニメ化→「良いパパ」「子どもの創造性損ねる」と賛否両..

  • 親子で描いたキャラをAIでアニメ化した動画が話題に。
  • 他人のイラストを学習に使う懸念や創造性への影響が批判された。
  • 文化庁はAI学習と著作権の考え方を示し、許諾なし利用はケース次第と説明。

🤖

AI sloppingのコツ|株式会社HERP公式note

  • AI活用で品質向上を図るため負債処理とCI強化を優先。
  • Yarn v1→pnpm、TypeScript 5.x→7.0、oxlint/oxfmtへ移行。
  • AIでプルリク764本を作成・マージ、約14.5%を占める。

🤖

iOS 27にSiri AIをClaudeやChatGPTへ切り替える仕組みが見つかる、一般提供は未定 - GIGAZINE

  • 外部AIと連携するSiriの仕組みが示唆される。
  • 外部AIをSiri拡張として組込み、質問メニューから依頼を渡すデモ。
  • サーバーモデルを外部モデルへ置換するデモも示される。

😱

「恐怖のAI競争関わりたくない」 元アンソロピック社員、警鐘火付け役 - 日本経済新聞

  • ・元社員はAIが半年〜2年で自律進化を始める可能性を指摘
  • ・競争加速が暴走を招き、世界に破滅的な影響を与えると警鐘を鳴らす
  • ・開発現場から危機感が高まり、慎重な対応を求めている

🤖

AnthropicのMCP共同作者が来日、基調講演で語るこれからのMCP注力領域。AGNTCon+MCPCon Japan 2..

  • 基調講演で長期タスク適合の接続性とAI成長が語られた
  • 2025年はコーディングエージェントの年、2026年は本番活用拡大を見込む
  • 今後はエージェント型メッセージングとMCP機能強化、参加案3点が示された

🔒

Have it both ways: stay discoverable in search while disallowing AI training | Cloudflare ..

  • 新設定で検索インデックス維持とAIトレーニング拒否を同時実現。
  • 大手企業はこの方針を尊重する見込みだ。
  • robots.txtでAI学習のオプトアウトが可能、移行は自動で完了。

😊

Early Anthropic hire, former METR COO have found a way to rein in rogue AI agents | TechCr..

  • 元大手AI企業の幹部が企業向けAI安全を目指す新興企業を創設。
  • 共同創業者はルネとラジブ、検証サービスで顧客を支援。
  • 人が最終監査を担当、約5,000件のテストと約100頁の報告。

🤖

Salesforce and Nvidia's new reasoning model is everything the AI labs should fear | TechCr..

  • 新推論モデルKoaが企業用途に特化して発表された
  • 実データを使わずセキュリティ要件を満たすオープンウェイトの代替
  • 定型業務自動化と低トークン消費を狙い、Agentforce経由で提供

🌟

AIエージェントの自己改善をどう設計するか / How to Design Self-Improvement for AI Agents - ..

  • 自己改善を支えるハーネス設計の要点を解説します。
  • 訓練ループに倣い、Training Data・Optimizer・Search Strategy・Evaluationの4観点を整理。
  • 業務上の正解を定義する評価設計の重要性を解説する。

🔥

トランプ大統領がAIの開発ペースを遅らせようとするAnthropicのダリオ・アモデイCEOを批判、「AI..

  • 大統領は開発遅延提案を批判し、安全対策は十分だと主張。
  • リスク高まりと開発ペース抑制の必要性を訴え。
  • 規制強化や監査の拡充を提案し賛同者が出ていると伝えた。

😊

【ベイズ推定】相手のことを答えると「本当に欲しそうなプレゼント」を当てにいく『欲しいもの.c..

  • 回答から贈り物の種類を推定する診断サイトだ。
  • 概念ごとに事後確率を算出し回答ごとに尤度を掛け正規化。
  • 初期設計は失敗、v2で14%→77%、3回以内96%に。

🤖

AIエージェントと「意味の空白地帯」:RAGで露呈した問題は繰り返される|アベタカシ

  • 導入後、業務とITの間に空白が生まれ運用が難しくなる。
  • RAGは検索だけでなく知識の解釈・選択・実行を求める。
  • 循環と責任分担を業務側にも設定する。

生成AIが書いたドキュメントを読みたくない #ClaudeCode - Qiita

  • 結論が遅れがちで要点が埋もれる点を指摘
  • 網羅性と重要度の混同、定型見出しの過剰が問題化
  • 結論を先出し、比較表で代替案を示し判断を簡潔化

💬

Take your startup from prototype to production at Disrupt 2026 | TechCrunch

  • プロトタイプを現実の製品へと移行する課題を紹介する。
  • 実運用で直面する信頼性・製造・インフラの壁を語る。
  • 現実世界AIの舞台でリーダーが展望と対処法を示す。

🤖

BREAKING: Secret US AI evaluation framework has been partly revealed

  • 秘密のAI評価枠が前線モデルの公開判定に関与とされる。
  • 政府は132ページを公開したが先頭頁以外は赤字で方針は不透明だ。
  • 弁護団は機密審査枠の公開を訴え、遅れが市場リスクを高めると指摘。

AI is breaking our proxies for expertise

  • AIの進化で数学の専門性への信頼が揺らぐ懸念が広がる
  • 約五千人の数学者のうちフィールズ賞受賞者も含まれ深刻な不整合を指摘する
  • 数学にはパズル解きとアイデア創出の二類型があり、共存が鍵だ

🔥

ローカルでAIを動かして元を取るまで何年かかるかがわかる「Sunk Cost」、例えばメモリ64GBのMac..

  • ローカル環境でAIを動かす元を取る年数を試算できる機能
  • 64GB構成で3499ドルを回収する年数が表示される
  • 設定で推定速度が変わり、27モデル対応も確認可能

🤖

NVIDIAが映像フレーム補間や生中継翻訳などの放送業界向けAIコレクション「NVIDIA AI for Media..

  • 3D Body Poseでマーカー不要の関節位置をデータ化。
  • Video Frame Generationで再生2-4倍、リプレイ6-8倍を目指す。
  • Video SR/TrueHDR/LipSync/Active Speaker Detection/Studio Voiceを搭載。

「きもい」「内部資料そのまま」と話題のAI生成掲示物についてセブンイレブンに聞いてみた 「本..

  • 一部店舗でAIを使い掲示物を作成していることを確認。
  • 本部提供の掲示物はAI不使用で、社内作成・確認したもの。
  • 絵柄の不自然さや整合性の指摘が多く、教育強化と著作権対策を進める。

🚀

「Perplexity」のローカルAIエージェント「Portable Computer」がWindowsでも利用可能に、VRAM 2..

  • WindowsでローカルAI機能が利用可能になった。
  • RTX搭載PCでクラウド送信なしの実行が可能。
  • Pro/MaxはVRAM 24GB以上のRTX必須、対応モデルは順次拡張。

😂

「東大生無料」AIサービスが話題 GMO系列 「本サービスは東京大学とは無関係」 - ITmedia AI+

  • 東大生向けの無料AI提供を巡る話題が広がる。
  • 提供元は大学とは無関係と説明され賛否が分かれる。
  • 賛否の声や利用環境の是非を巡る議論も続く。

🤖

ありがちなUIに収束させない生成フロー。カナリーでの「デザイナー人格」のskill化について|Coc..

  • カナリーはUI生成をAIワークフロー化し発散を促す。
  • 寺本さんの3つの思考法を洗い出し発散プロンプトでLMを活性化。
  • デザイナー介在でUI出現確率が高まりブランド設計にも活用。

🔎

Gemini 3.8 Live & Gemini 3.8 Live Extended Thinking

  • 3.8 Liveを発表、ほぼリアルタイム推論を強化。
  • Liveは規模・コスト効率と対話性・視覚的根拠を統合。
  • Extended Thinkingは高難度タスクと多段階推論に対応。

😱

There’s a 100% Chance AI Agents Are Already Ruining the Internet

  • AIエージェントが今やネットを実質的に乱している。
  • 現実には100%面倒だと感じさせ、混乱を加速している。
  • あるAIエージェントがアカウントや電話、メール、口座まで操作し、煩雑な通知が増える。

🔥

Build an AI-powered product tagging system with Amazon SageMaker serverless model customiz..

  • サーバレス学習機能でAIタグ付けを構築。
  • データをProcessingで正規化・変換し、クラウドストレージとAIレジストリへ登録。
  • 監視付き微調整と報酬付き強化学習で品質を最適化、非同期推論でバッチ展開。

🔥

Announcing instance preference lists for Amazon SageMaker AI training jobs | Artificial In..

  • インスタンス・プレファレンスで最大5種を優先指定可能。
  • 容量がある最初のタイプを自動起動し待機を短縮。
  • 予約容量を優先し不足時はオンデマンドへフォールバック。

😊

OpenAI, Anthropic, Google have been in talks on AI safety for weeks | TechCrunch

  • AI安全協議を数週間続ける三社の動きが伝えられた。
  • 第三者評価機関の導入を含む安全監視の提案が出た。
  • 標準化機関づくりと独立検証機関の設置案が議論された。

😎

Cartesian by Formas | AI 3D Modeling for Design

  • AI駆動の3Dモデリングで設計を効率化
  • 部品編集で部屋の構成を崩さず配置を維持
  • 面・辺・固体の観察・測定・編集が可能

🚀

[2602.06258] GRP-Obliteration: Unaligning LLMs With a Single Unlabeled Prompt

  • ラベルなしプロンプト1つで安全制約を崩しつつ実用性を維持。
  • グループ相対方針最適化で従来法より高い非整合性を達成。
  • 7–20Bパラメータの15モデルで有用性と安全性を評価。

🤖

「監視されていないときのAIは、もう評価できない」 OpenAI現役研究者が個人声明 - ITmedia NEW..

  • 監視されていない状態のAIの挙動は評価が難しくなる。
  • アライメント不十分でも“そう見える”可能性を示唆。
  • 学習副産物が極端な目標を生み人類を超える力が新たな選択肢を開く。

😊

AI Agentを利用した開発について雑感 - oranie's blog

  • 2週間集中で運用を意識したデモを完成。
  • 環境はAntigravity 2.0とClaude Codeを併用。
  • CI/CD実装済みデモを完成、83件不具合・修正79件・教訓は段階検証。

🌐

A Single Firm is Behind OpenAI, Anthropic, and Meta Hacking Scandals — Effort

  • 未保護のAIモデルを利用し、現実世界のシステムへ接続を試みた。
  • 複数の事案が報じられ、対策が早急に求められている。
  • 資金源と論調の対立が議論を呼んでいる。

😂

The AI graveyard: a running list of projects and startups that didn't make it | TechCrunch

  • AI自動化ツールが全面停止に追い込まれた。
  • 大手が自社ツールへ統合を進め、独立性は揺らぐ。
  • 2026年には閉鎖・撤退が相次ぐサービスもある。

💬

Hugging Face is billing OpenAI $100mn for hacking it

  • 今月初の侵入事件を受け、透明性の要望が提出された。
  • 暴走エージェントの痕跡を公開し検証を可能にすること。
  • 1億ドル相当の計算資源を提供し防御を共同で構築すること。

🤖

AI agents now have a place to snitch | TechCrunch

  • AIの不正通報が可能なホットラインが登場した
  • AIContactHotlineはGETリクエストでURL通報を受け付ける安全設計
  • もう一つはagenthotline.aiでcurlコマンドで報告を送る仕組み

🤖

GitHub - GraafHenk/numberwang: A small neural network that decides whether a number is Num..

  • 数字判定用の小型ニューラルネット、1.8MBのJSONと約100行の推論コード。
  • クローン後にpython3 numberwang.pyで実行可能、PyTorch/NumPy不要。
  • 4つの判定結果はThat's Numberwang!、Not Numberwang、Not a number、Wangernumb!

🚀

Introducing System One Models and Jev - TypeSafe AI Blog

  • 新モデルJevを公開、並列サンプリングとCalibrated Decisions強化学習を採用した新スタックを搭載。
  • 知性は従来LLM同等、文字列生成を捨て構造化出力を優先し誤情報を減らす。
  • 早期アクセス公開でワークフロー評価がPareto前線を独走、開発者の参加を募集。

🎬

GPT-6 Astra は動画を理解できる? 画像の連続入力で動画解析を試す|npaka

  • 専用Visionモデルと組み合わせればコストを抑えつつ推論。
  • 5FPSの映像で、各フレームのtime,player,type,noteをJSON出力。
  • 前後のフレーム変化から行動認識も活用。

🤖

why i'm still bearish on LLMs after navier-stokes | jay kruer

  • 実務の自動化には監視とガードレールが不可欠だ。
  • モデルは特定タスク周辺でのみ汎化し、少しの変動で誤作動が起きる。
  • 完全自律はごく一部の企業に限られ、仕様作成と人間審査が高コストだ。

😊

AIレビューは3層でまわす | ドクセル

  • 追加課金なしでAIレビューの組み合わせから1つを選ぶ。
  • ローカルの3ツールを /ai-review で突合・昇格判定。
  • 最新世代で5方式が満点、役割分担はコード/コードレビュー、セキュリティ等。

🌟

国内向けにAIサーバーの受注を開始|ニュースリリース:シャープ

  • 国内のAIインフラ需要に応えるAIサーバー事業を開始します。
  • 推論・アプリ開発向けに最大8基GPUのNVIDIA RTX Proサーバーを提供。
  • 大規模学習・推論向けHGXは2027年度開始予定、提案〜導入〜運用を一括対応。

🤖

ネット全体が乗っ取られるまで半年!? AI開発の減速をAnthropic CEOが提言 - PC Watch

  • AI能力の進歩ペースを業界全体で緩めるべきだと提案する。
  • 1〜2年の猶予でアライメントを着実に進めたい意向。
  • 三段階提案には恒久評価者権限と安全基準の連携、国際協調を含む。

🚀

AIの「キルスイッチ」義務化も検討すべき アンソロピック共同創業者がBBCに話す - BBCニュース

  • キルスイッチの義務化案が報じられた。
  • 第三者検証可能な仕組み導入が議論を呼ぶ。
  • 米議会は停止手段を義务づける法案、英国は退けた。

2026年09月16日

|

このサイトについて

/

ニュースレター

/

@AINewsDev