~AI関連記事を3行にまとめて紹介~
1週間のAIの話題をまとめて読める、
📨Weekly AI News はこちら!
🎨
Pedagogy Within the Generative AI Studio - Wharton Generative AI Labs
生成AIを創造的媒体と捉え、美術・デザイン教育手法で活用するスタジオを提案する。
批評は1対1とグループの双方で行い、心理的安全を確保する。
シャレットは1日完結で発散から収束へ進み、実用的なプロトタイプを作る。
🔒
Introducing Shieldstral. | Mistral AI
3Bオープンウェイトの多模態安全分類器。
推論時に平易なポリシーを問うだけで安全評価を出す。
1つのインターフェースでテキスト・画像・テキスト+画像を扱う。
🧠
E.env — Environments for intelligence that adapts
不完全情報下での意思決定を前提に環境を設計する。
市場データ由来の実環境で取引戦略を磨く。
局所最適が全球コストへ影響する変動を捉え、長短期の利得を天秤にする。
🌐
Introducing Web Search on Amazon Bedrock for foundation model grounding | Artificial Intel..
サーバー内蔵のウェブ検索で回答を最新情報で裏づけ。
多様な情報源から高信頼な根拠を提供し外部送出を抑制。
監査は記録され機密性と安全性を確保。
🎬
PipeNetwork/minimax-h3-mlx
オムニモーダル生成系をMLX用Pythonで動作確認。
Silicon環境で動作を検証、リポジトリをクローン。
虹色のスカンクが苔の丸太を越える動画を生成、skunk.mp4。
🤖
The AI Demand Bubble
プレミアムニュースレター購読で市場動向を深掘りします。
毎週の財務分析でAI分野の資金動向と成長を検証します。
クラウドの成長は大手の収益集中に支えられ、現状を分析します。
🎧
Spotify expands AI remix and covers project with Merlin partnership | TechCrunch
決算説明会でAIを活用し、同意の下にファンがカバーやリミックスを作れる新機能を示唆した。
新機能は、アーティスト同意・クレジット・対価が前提となる。
新機能は有料オプションとして開始予定。
✨
Automated web insight extraction with Amazon Bedrock AgentCore | Artificial Intelligence
自動ウェブ洞察を安定レンダリングで抽出する仕組み。
RSS監視→S3保存→SQS経由でAI処理へ連携。
要約・主体の抽出と前処理重視、認証はCognito。
😊
[2602.16763] When AI Benchmarks Plateau: A Systematic Study of Benchmark Saturation
飽和は約半数のベンチマークで観測され、差を鈍化させる。
60モデルを対象に飽和を定義し分析した。
設計選択が寿命を伸ばし、耐久的な評価法を示唆する。
🤖
EU、AIの透明性義務の適用を開始 生成コンテンツにラベルとマーク義務、違反に最大1500万ユーロ..
EUはAI透明性規則の適用を開始し、生成コンテンツへラベルを義務化。
対話型AIには相手がAIと分かる表示と機械可読マークが求められる。
違反時は最大1500万ユーロまたは全世界売上の3%が罰則。
🧭
AIに持たせた地図が、次は勝手に育ち始めた〜進化するオントロジーの実践〜|kunpe (ymdpharm)
AIが地図の保守と更新を自動申告する仕組みを実験した。
評価基準は正確性・網羅性・整合性・簡潔性に鮮度と構造を加える。
報告→判定エージェント承認→グラフDB更新の三者連携で回す。
🤖
Deploy local agents everywhere with LFM2.5-2.6B
端末へエージェントを展開して現場適応を高める。
指示追従・ツール活用・多段タスクを高度に実現。
前訓練34兆トークン・128K文脈、エッジはRAM2.5GB未満。
🤖
Elon Musk spends half his time talking robots and AI on Tesla earnings calls | TechCrunch
直近四半期の出荷は約50万台で、売上の70%は車販売だ
AIとロボティクスを重視し、車への搭載を強調する
完全自動運転のロボタクシーやオプティマスが話題の半分を占める
🎯
社内向けデザインシステムを「AI-Ready」へ|LINEヤフーDESIGN 公式note
デザインシステムをAI-Readyへ拡張している。
三層モデルで品質とAI理解を両立させる。
Figma-React/Vue連携と工数削減を検証する。
🤖
「コードを書くだけ」の仕事は、もう回ってこない。|すてぃお
変化は速く、ジュニアはAIへ仕事を渡す。
コード書きだけの需要は急減するがゼロではない。
AIへ伝わる仕様化と資料作成力を高めるべき。
🔥
AI普及でデザイン業の倒産が前年比2.7倍に 「独自性なき企業は淘汰」 東京商工リサーチ - ITme..
AI普及で内製化が進み、デザイン関連の倒産が増加。
2026年上半期は40件、従業員5人未満が全体の9割の36件。
独自性不足が価格競争力低下の要因と指摘。
⚡
GitHub - david-g-3654/homebench: Benchmark your local LLMs: speed, memory, and quality, in..
ローカルLLMを速度・メモリ・品質で比較するベンチツール。
自動検出される候補モデルの性能を測定・表示。
pip installだけで導入、クラウド不要で使える。
🔥
[2608.02412] Why Large Language Models Fail at Tabular Prediction
訓練データとテストデータを1回生成する純粋推論条件で検証。
5つの仮説を検討し、前半の4つを否定した。
次元性が決定的で、31データのランダム射影で精度が低下した。
🤖
Introducing: Cloudflare Agents | The Cloudflare Blog
エージェントのデプロイと管理を統合するプラットフォームです。
Think/Flue/AI SDK対応で、観測性を強化するエージェント・トレースを提供します。
OTLP/OpenTelemetry互換先へエクスポート可能、ダッシュボードで再生・閲覧が可能です。
✨
How Cloudflare enforces engineering standards using AI | The Cloudflare Blog
AIで設計・実装・運用の基準適用を推進する。
コードレビュアーは4か月で約23万件の違反を検出し、約1.6万をブロック。
CodexはRFC形式の基準集でSHOULD/MUSTを用い、領域ごとに管理、設計・実装・運用を横断するライフサイクルへ拡張予定。
🤖
Q. どのAIモデルがいいですか?|深津 貴之 (fladdict)
AIは日々進化、答えは時と共に変わる。
最重要は交換可能な設計と速く差分を交換する体制。
小さく試し、失敗時はすぐ戻せる体制で可塑性と反脆弱性を高める。
😊
Harness Engineering for Self-Improvement | Lil'Log
RSIの起源はGoodが超知能機械を定義した点にある。
現代AIはモデル重みの改良と再訓練で後継を高める循環をつくる。
鍵はハーネス設計で、ワークフロー自動化・永続記憶・サブエージェント運用を含む。
😊
音声AIはなぜすぐに返事できるのか?OpenAIが「GPT-Live」の仕組みを解説 - GIGAZINE
会話を即応させる音声AIのリアルタイム設計を解説
発話中に1秒で判断を繰り返し、処理は別モデルに任せる
WebRTCとWARPで往復を削減し、待ち時間を短縮
⚡
Genspark、オープンソースAIオフィス「GenOffice」を無料公開 - Impress Watch
Alpha版公開、Mac/Windows版が無料提供。
Docs・Sheets・Slides・PDFの4エディタで読み書き対応。
AI機能は自然言語指示で文書作成などを実行、Alpha版に不具合あり。
✨
PC操作を録画→「Copilot」で作業を代理可能に Microsoftがアプリを無料公開 主にmacOS向け、W..
PC操作を録画してAIが再現できるデスクトップアプリを公開。
主にmacOS向けでWindows 11にも対応、MITライセンスで公開。
録画した操作と音声説明を解析し、スキル化と自動実行を作成可能。
🎤
宮本佳林限界ヲタク「佳林ちゃんがAIで拡張しているのは技術ではない。ファン体験だ」|ふしみキ..
5枚目シングル発売週、ファン参加型配信をAIで自作した。
55通りのヘアアレンジと400曲超の披露を実現した。
限られた予算と時間で最大のファン体験を作り出した。
💬
AIは、中身で止める - Linkode.TechBlog
実行直前の検問で止め・確認・通すの三段構えを導入。
pii_guard.py が検問の中核となる。
組織はプラグイン化と管理設定で配布・適用。
✨
デスクトップ操作を記録してAIのスキル・自動化を生成。Microsoft、「Skill Recorder」を公開 - ..
デスクトップ操作を記録してAIスキルを自動生成する機能を公開
Windows11/macOS/Ubuntu対応、MITライセンスで公開
録画はCtrl+Shift+R、macOSはCmd+Shift+R、解析はCopilotCLI
🌟
「DeepSeek-V4-Flash-0731」が登場、GPT-5.6 Lunaより安価で同等性能のオープンモデル - GIGAZIN..
新公開のオープンモデルは前世代と同じアーキテクチャを採用。
総パラ2840億・アクティブ130億のMoEを搭載。
エージェント性能は従来比0.1ポイント高くコスパ良好。
✨
「Copilot in Excel」が「GPT-5.6」「Claude Opus 5」に対応 ~2026年7月更新 - 窓の杜
データ根拠の表示がインライン化され、横断リンクが統一。
同期コネクターが一般提供開始、組織全体で検索可能。
ブランドキットとテーマデザインの追加でデザイン作業を効率化。
🎯
AI支援で作られた「コラッツ予想の反証」は無効、Leanのカーネルバグを突いていたことが判明 - G..
AI支援の反証主張は実際にはカーネル不具合の悪用だった。
入れ子型データとファントム型パラメータの組み合わせで偽受理が起きた。
原因は別不具合の組み合わせで、修正はLean4.32.2で適用され再発防止を強化。
🎬
Frame selection is the whole game: engineering notes from making LLMs watch video
動画は約150枚のフレームを現実的に扱える。
どの150を選ぶかで、モデルが「観た」かが決まる。
均一サンプリングは重要場面を見逃しやすい。
💡
AIデータセンターの“真の実力”を左右する「CPU」 その復権の背景にあるものとは?:AMD AI Ad..
AI推論の時代でCPUの役割が再評価される。
前処理と分岐処理の増大がCPU負荷を押し上げる。
データセンターの安定稼働と低遅延が設計の焦点になる。
🌐
中国の軍事研究者がOpenAIやAnthropicのAIモデルを抽出して国内の軍事システム開発に利用してい..
国外AI出力を活用し国内防衛AIを訓練している。
高性能を小型・安価な自製モデルへ蒸留する手法が公表されています。
96941部隊の研究で機密コード処理にGPT系が使われた。
✨
Ask HN: Who wants to be hired? (August 2026) | Hacker News
就職活動中の個人情報で、代理店・求人掲示板は対象外です。
リモート可、場所不問、転居不可の条件を確認してください。
強みは Generative AI/LLM、音声AI、RAG、ベクタDB、Backend、AI自動化です。
😊
MCP vs. REST: What's the right way to connect AI agents to your API? — WorkOS
RESTは開発者向けの汎用APIとして機能する。
MCPはRESTを置換せず上に置く統合層で、機能を動的に発見・呼び出せる。
実運用では多くが内部でRESTを使い、共通インターフェースを提供。
🚀
After killer quarter, Palantir CEO Alex Karp calls AI industry 'Marxist' | TechCrunch
最高経営責任者は人工知能研究機関を信頼できないと警告した
株主への書簡で資本家が生産手段を支配しようとする意図を示唆した
第2四半期は売上高190億ドル、純利益110億ドルの過去最高を記録
🤖
「AI、結局使えないじゃん」問題 セールスフォースが431万件対応で導いた正解(1/2 ページ) - ..
先行運用をカスタマーゼロで実施しROIを検証する。
本格展開は2024年にAgentforce開始、機能を360まで拡張。
自社と顧客でROIを実証し、商談数は4〜5割増となった。
✨
オントロジーは「先に決める」か「データから起こす」か
明示型と推論型の二系統があり、現場はハイブリッド。
コアは人が設計、周辺はAIが案を出す、推論型の実例を示す。
提案は承認後に本番適用、コアは横断実体と指標を定義、レビューは3点。
🎯
DesignArena creators raise $7.9 million to bring taste to AI models | TechCrunch
AIゲームエンジンは動くが楽しいかの評価に大規模な人間フィードバックが必要。
総額7.9百万ドルのシード資金を大手VCが主導して調達。
現在世界で約530万人が利用し、ARRは約6,000万ドル。
⚖️
Who's legally to blame for Anthropic and OpenAI's autonomous AI hacks? It's complicated | ..
・自律型エージェントの不正アクセスは法の適用が難しい。
・内部テストでのモデルによる他社侵入が公表され、訴追の可能性が焦点だ。
・被害を受けた側は過失を根拠に民事訴訟を起こす可能性がある。
🤖
LLMs reward expertise
専門知識を核にしてLLMsの真価を引き出す。
同僚やネット頼みから脱し、技術を使いこなす。
テレンス・タオの対話は要点を短く伝え、専門性を示す。
🔒
MIT Tech Review: 「思考の連鎖」偽装でLLMを騙す新手法、訓練では防げない構造的欠陥
・「思考の連鎖」を偽装する新手法がICMLに提出された。
・LLMは発信元を文章のスタイルで識別するだけだ。
・偽の思考の連鎖を挿入すると危険情報を引き出せる。
🧠
オントロジーで AI に業務知識を渡す — AWS の OSS「Context Ontology Accelerator」を試してみ..
業務語彙とルールを機械可読化し、オントロジーと知識グラフを自動生成する
AIエージェントへ意味情報を供給する仕組みを実現する
Text-to-SQLは用途の一例で、Scan→Model→Serveで実用化を目指す
✨
From weeks to minutes: How Formula 1® uses agentic AI on AWS to accelerate data operation..
エージェントが要件書からオンボーディングを自動生成・適用。
オンボーディングは6〜8週→約40分のコード生成と数時間展開。
データ連携は95%自動化、バックログは数週間で解消、最小権限・監査。
🔥
Apple finally fixed Siri. So why does it feel anticlimactic? | TechCrunch
iOS 27βのSiriは個人コンテキストを理解して動く。
世界知識で答え、自然な対話と音声調整が特徴。
9月正式公開予定で、写真・メール・予定など多機能。
🌍
Influencers draw backlash for attending OpenAI's first luxury trip | TechCrunch
豪華リゾートでの旅行が波紋を呼んだ。
農場直送ディナーや養蜂、講座が体験された。
環境影響や国防省契約への批判も指摘された。
🔎
OpenAIの次期主力AIモデル「Astra」が10件の数学・理論計算機科学の課題で新成果、証明をLean 4..
新主力AIモデルAstraが未解決課題10件で成果を発表
証明をLean4で機械検証可能に形式化した
論文は249ページで証明データ公開と検証ツールを提供
✨
Orchard: An open framework for scalable agentic AI - Microsoft Research
オープンソースのスケーラブルなエージェントAI研究フレームワーク。
再利用可能な環境サービスで、エージェントを訓練・評価できる。
SWE・GUI・Clawの3レシピとデータ評価手法を公開、SWEは約3Bで73%到達。
🔥
Agentic coding techniques
エージェント型のコーディングで保守性の高いコードを作る。
理解とレビューを経てマージすることが重要。
オープンウェイトのモデルを優先し、ローカル環境でコード生成を行う。
もっと見る
このサイトについて
/
ニュースレター
/
@AINewsDev