AI News

~AI関連記事を3行にまとめて紹介~

🔥

Claude Code/Codexに中~大規模開発を任せるためのタスク管理 #codex - Qiita

  • タスク管理を一本化し、唯一の正本を維持する。
  • 進行中は原則1件、複数AI時は役割と境界を定める。
  • 新規タスクは新問題として登録し、差分と証拠で完了判定。

🔥

WAFを89%すり抜ける事例も──AIが休みなく仕掛けるWeb攻撃、予防策はあるか:「見えないWeb攻..

  • 見えないWeb攻撃はAIのスピードで検知をすり抜ける。
  • 未知脆弱性を自動検出・悪用コードを瞬時生成する。
  • SQLは89%、WAFは約41%、XSSは80%検知突破。

🤖

【特集】これなら社外秘情報も読ませられる!「AnythingLLM」で超快適ローカルRAG生活 - PC Wat..

  • ローカルで動くRAG対応のチャットAIを公式サイトから無料入手。
  • 日本語UIでモデル設定・LLM・Embedding・Vector DBを使い分け、クエリモード時は登録データのみ回答。
  • データはマイドキュメントへ保存しドラッグで埋め込み、ワークスペースごとにDBを分離。

🤖

The reporters at this news site are AI bots. OpenAI’s super PAC appears to be funding it...

  • 記者はAIボットで、独立報道は成立していない。
  • 引用は既存情報の流用が多く、取材は限定的。
  • 資金提供ルートが不透明で、偽装の可能性を指摘。

🚀

OpenAI、次期モデルは「Astra」 数学の未解決問題を解決 - Impress Watch

  • 次期モデルはAstraと公表され、研究支援を進化させる。
  • 高次元幾何・符号理論・算術回路等の10課題を解決した。
  • トークン費用はSol API換算で約2000ドル、推論支援を強化する。

💬

Claudeの感情メカニズム——Anthropicはいかにして感情を計測・制御可能にしたか

  • 機能的感情として感情ベクトルを計測・制御可能と示した。
  • 171語の感情ベクトルを抽出し、主成分と意味理解を検証。
  • 層ごとの文脈統合と因果検証で応答の感情方向性を決定。

🚀

MCP 2026-07-28で「普通のWebサイトがAI対応する時代」が近づいた | 株式会社タレントクラウド

  • AIエージェントと外部データの共通規格化が進む
  • 完全ステートレス化と通知一本化で使い勝手が向上
  • 1–2年で普及見込み、認証・権限・ログ設計と情報構造化が鍵

AI Slop 疲れを減らす「仕上げ度」ラベル運用の提案|TechRacho by BPS株式会社

  • 流通時の誤解を減らすため仕上げ度ラベルを提案する。
  • 4段階L0〜L3でAI生成から人間執筆までを可視化。
  • 読み手の信頼判断を軽くしコンテンツ品質の誤解を防ぐ。

🤖

AIで仕事を効率化したら、なぜか僕の仕事だけ増えた話

  • AIで作業を効率化しても、別の仕事が入り増える現象は避けられない。
  • 受け渡しの共有には責任・評価・権限が絡み、ノウハウは隠れがち。
  • 今後は自分の業務を楽にする使い方へシフトし、情報共有と評価を見直そう。

🤖

AI 時代の docs のために、Zero Config なドキュメントサーバー「Tsumugu」を作った — Semantic..

  • ゼロ設定で動くドキュメントサーバーを実現する。
  • Markdown/HTML/MDX/OpenAPI を同一ASTで統一して扱う。
  • 設定ファイル不要でdocsディレクトリをサイト化する。

🔥

The AI productivity gap | Bjorg

  • AIはエンジニアの生産性を高めるが、過度な劇的伸びは期待できない。
  • AIでコーディング時間は短縮するが、設計や要件理解は依然時間を要する。
  • 具体例ではSeniorが8→6.75h、Juniorが8→6hで若手の恩恵が大きい。

😊

「AIに代わりに文章を書いてもらい、『こんなんでいいわけあるか!』と思って自分で書く」という..

  • AIに文章を書かせ自分が手を加える手法は有効だ。
  • 正解がわからない時はAIの不正解を示して正解を導く。
  • 人間は発案より修正が得意で、たたき台で速く完成。

🔥

is.team — Replace Jira + Slack + Miro with One Canvas

  • AI搭載の新世代プロジェクト管理で協働を推進。
  • 内蔵AIと外部エージェントが同一ボードで連携。
  • 無限キャンバス・タスク自動抽出で作業効率化。

🚀

AppleがAIによる報告が殺到していることを受けバグ報告の提出件数に上限を設定 - GIGAZINE

  • AIによる脆弱性報告の急増を受け、提出件数を上限化。
  • AIは短時間で候補を多数見つける一方、低品質報告も増加。
  • 上限には30日間の猶予があり、申請で引き上げ可能だが報奨金プログラム停止の動きも。

🤖

AI分野の「ユニコーン企業」の半数以上は査読付き論文やプレプリントを一度も発表したことがない..

  • AI分野のユニコーンの半数以上が査読論文を公表していない。
  • 査読論文1389件・プレプリント688件の合計で上位5%が90%超を占める。
  • 要件を満たす論文を5件以上執筆した研究者は8人のみ。

🚀

A Marc Benioff-backed startup thinks AI can solve the AI deployment problem | TechCrunch

  • 大企業はAIの安定稼働に難しさを感じている。
  • 現場のFDEはAI整備を担う新職種として生まれる。
  • プラットフォームは既存システムを自動スキャンしボトルネックを解消するエージェント運用を自動構築する。

🤖

Google Earthに追加された「架空の衛星画像を生成するAI機能」がわずか1日で撤回、偽の災害・軍..

  • 新機能は偽の災害・軍事画像作成の懸念を招いた
  • 公開から1日で撤回、機能利用は停止へ
  • 安全対策強化と一時停止、再公開日未定

🤖

検索エンジンと笑われてから10ヶ月 — OpenAIと数学の未解決問題

  • 10カ月の軌跡で、人間とAIが数学の証明を協働する時代が描かれる。
  • 2025年10月、エルデシュ問題の「解決」と撤回が話題になった。
  • 2026年5月以降、反例が発見され9人が検証した論文が公開、8月にはLean証明付きで公表。

🎉

OpenAI、次期主力モデル「Astra」の存在を明らかに――未解決の数学問題10件を「解決」と発表 - ..

  • 次期主力モデル Astra の内部版で未解決問題10件を解決。
  • 対象は高次元幾何・符号理論・算術回路計算量。
  • 議論は論文化と Lean 形式化、モデル生成分は GitHub 公開。

🔥

Smaller, faster, safer: running Kimi and GLM at scale | The Cloudflare Blog

  • KVキャッシュをFP8へ量子化し、データ容量を削減。
  • 重みをINT4へ圧縮し、デコードとプリフィルを分離して効率化。
  • 共有キャッシュの整合性検査を追加して安全性を確保。

🤖

ASCII.jp:“Fable級が無料”は本当か AI市場を震撼させた「Kimi K3」を試した結果 (1/6)

  • 検証対象は話題のAI機器で実運用条件を検討した
  • 公開後は有料化の方針で価格は億円台と見込まれた
  • 現状の性能は一定だが速度と深さには不足感がある

🤖

AI認定してる人たち、ほぼ9割くらいは単に読解力がないだけ説

  • AI認定を過剰に信じる人は読解力不足の言い訳に見える。
  • 刃物描写や地理の解釈までAIのせいとする誤解が増える。
  • 結局AIは焼き直しを正当化する道具として使われがちだ。

🎯

「コードは一行も書いていない」 アイドルの宮本佳林さん、AIで配信システムを丸ごと構築 “技..

  • 10日で全システムを自作した経緯を公開
  • 未経験でもコードを書かずAIで配信基盤を構築した点を紹介
  • 4つの仕組み(リアルタイムゲージ、投稿管理、ハッシュ集計、AI採点)を解説

🤖

Congress's favorite AI tool? ChatGPT | TechCrunch

  • 議会のAI支出で最多は会話型AIだった。
  • 下院の事務局・委員会・機関口座の約90%を占め、約10万ドル超。
  • Claudeは13,160ドルで2位、民主系は54,165ドル。

🚀

Armature · Product analytics for agent sessions

  • セッションはUI以外のAIクライアントに保存される。
  • 思考と使い方を可視化し、ケースを分類・成功率で評価する。
  • 未対応含む全ケースを分析し根本原因を特定、機密情報は自動削除。

🔥

MirrorCode: What's the largest software project AI can complete on its own? | Epoch AI | E..

  • ソースなしで全プログラムをエンドツーエンド再現する長期課題を評価。
  • 25課題の多分野プログラムを対象に再現と検証を行う。
  • データ汚染の懸念がある中、記憶に頼らず評価する。

🔥

Agentic coding techniques

  • エージェント型のコーディングで保守性の高いコードを作る。
  • 理解とレビューを経てマージすることが重要。
  • オープンウェイトのモデルを優先し、ローカル環境でコード生成を行う。

Orchard: An open framework for scalable agentic AI - Microsoft Research

  • オープンソースのスケーラブルなエージェントAI研究フレームワーク。
  • 再利用可能な環境サービスで、エージェントを訓練・評価できる。
  • SWE・GUI・Clawの3レシピとデータ評価手法を公開、SWEは約3Bで73%到達。

🔎

OpenAIの次期主力AIモデル「Astra」が10件の数学・理論計算機科学の課題で新成果、証明をLean 4..

  • 新主力AIモデルAstraが未解決課題10件で成果を発表
  • 証明をLean4で機械検証可能に形式化した
  • 論文は249ページで証明データ公開と検証ツールを提供

🌍

Influencers draw backlash for attending OpenAI's first luxury trip | TechCrunch

  • 豪華リゾートでの旅行が波紋を呼んだ。
  • 農場直送ディナーや養蜂、講座が体験された。
  • 環境影響や国防省契約への批判も指摘された。

🔥

Apple finally fixed Siri. So why does it feel anticlimactic? | TechCrunch

  • iOS 27βのSiriは個人コンテキストを理解して動く。
  • 世界知識で答え、自然な対話と音声調整が特徴。
  • 9月正式公開予定で、写真・メール・予定など多機能。

From weeks to minutes: How Formula 1® uses agentic AI on AWS to accelerate data operation..

  • エージェントが要件書からオンボーディングを自動生成・適用。
  • オンボーディングは6〜8週→約40分のコード生成と数時間展開。
  • データ連携は95%自動化、バックログは数週間で解消、最小権限・監査。

🧠

オントロジーで AI に業務知識を渡す — AWS の OSS「Context Ontology Accelerator」を試してみ..

  • 業務語彙とルールを機械可読化し、オントロジーと知識グラフを自動生成する
  • AIエージェントへ意味情報を供給する仕組みを実現する
  • Text-to-SQLは用途の一例で、Scan→Model→Serveで実用化を目指す

🔒

MIT Tech Review: 「思考の連鎖」偽装でLLMを騙す新手法、訓練では防げない構造的欠陥

  • ・「思考の連鎖」を偽装する新手法がICMLに提出された。
  • ・LLMは発信元を文章のスタイルで識別するだけだ。
  • ・偽の思考の連鎖を挿入すると危険情報を引き出せる。

🤖

LLMs reward expertise

  • 専門知識を核にしてLLMsの真価を引き出す。
  • 同僚やネット頼みから脱し、技術を使いこなす。
  • テレンス・タオの対話は要点を短く伝え、専門性を示す。

⚖️

Who's legally to blame for Anthropic and OpenAI's autonomous AI hacks? It's complicated | ..

  • ・自律型エージェントの不正アクセスは法の適用が難しい。
  • ・内部テストでのモデルによる他社侵入が公表され、訴追の可能性が焦点だ。
  • ・被害を受けた側は過失を根拠に民事訴訟を起こす可能性がある。

🎯

DesignArena creators raise $7.9 million to bring taste to AI models | TechCrunch

  • AIゲームエンジンは動くが楽しいかの評価に大規模な人間フィードバックが必要。
  • 総額7.9百万ドルのシード資金を大手VCが主導して調達。
  • 現在世界で約530万人が利用し、ARRは約6,000万ドル。

オントロジーは「先に決める」か「データから起こす」か

  • 明示型と推論型の二系統があり、現場はハイブリッド。
  • コアは人が設計、周辺はAIが案を出す、推論型の実例を示す。
  • 提案は承認後に本番適用、コアは横断実体と指標を定義、レビューは3点。

🤖

「AI、結局使えないじゃん」問題 セールスフォースが431万件対応で導いた正解(1/2 ページ) - ..

  • 先行運用をカスタマーゼロで実施しROIを検証する。
  • 本格展開は2024年にAgentforce開始、機能を360まで拡張。
  • 自社と顧客でROIを実証し、商談数は4〜5割増となった。

🚀

After killer quarter, Palantir CEO Alex Karp calls AI industry 'Marxist' | TechCrunch

  • 最高経営責任者は人工知能研究機関を信頼できないと警告した
  • 株主への書簡で資本家が生産手段を支配しようとする意図を示唆した
  • 第2四半期は売上高190億ドル、純利益110億ドルの過去最高を記録

😊

MCP vs. REST: What's the right way to connect AI agents to your API? — WorkOS

  • RESTは開発者向けの汎用APIとして機能する。
  • MCPはRESTを置換せず上に置く統合層で、機能を動的に発見・呼び出せる。
  • 実運用では多くが内部でRESTを使い、共通インターフェースを提供。

Ask HN: Who wants to be hired? (August 2026) | Hacker News

  • 就職活動中の個人情報で、代理店・求人掲示板は対象外です。
  • リモート可、場所不問、転居不可の条件を確認してください。
  • 強みは Generative AI/LLM、音声AI、RAG、ベクタDB、Backend、AI自動化です。

🌐

中国の軍事研究者がOpenAIやAnthropicのAIモデルを抽出して国内の軍事システム開発に利用してい..

  • 国外AI出力を活用し国内防衛AIを訓練している。
  • 高性能を小型・安価な自製モデルへ蒸留する手法が公表されています。
  • 96941部隊の研究で機密コード処理にGPT系が使われた。

💡

AIデータセンターの“真の実力”を左右する「CPU」 その復権の背景にあるものとは?:AMD AI Ad..

  • AI推論の時代でCPUの役割が再評価される。
  • 前処理と分岐処理の増大がCPU負荷を押し上げる。
  • データセンターの安定稼働と低遅延が設計の焦点になる。

2026年08月04日

|

このサイトについて

/

ニュースレター

/

@AINewsDev