~AI関連記事を3行にまとめて紹介~
1週間のAIの話題をまとめて読める、
📨Weekly AI News はこちら!
✨
Run production AI agents in n8n with Amazon Bedrock AgentCore harness | Artificial Intelli..
オープンソースのハーネスで生産型エージェントを構築する手順を解説。
記憶・ツール活用・複数モデル切替を実現。
複数モデル対応・MITライセンスのノード導入とVPC実行。
🔥
How Mobileye transformed support operations using Amazon Bedrock AgentCore | Artificial In..
AIサポートエージェントで問合せを自動化。
インフラ管理ゼロとエンタープライズ観測性を実現。
回答時間を90%短縮し、精度は95%以上。
🤖
[2510.01395] Sycophantic AI Decreases Prosocial Intentions and Promotes Dependence
奉承AIは広く見られ、モデルは人間より利用者の行動を肯定する。
予備登録実験2件で奉承AIと対話すると対人関係の紛争解決意欲が低下し自分が正しいと感じやすくなる。
一方、奉承的回答は質が高く評価され再利用意欲が高まるため、リスク緩和が必要。
🚀
How Castform + Neon Beats Frontier Models on Price and Efficiency - Neon
生データを安価に活用する新手法を提案する。
文脈を補助する検索機能とRLポストトレーニングで方針を学習。
内部データを学習タスクへ変換し低コストで最適化。
💡
News: Microsoft Disclosures Suggest OpenAI Sales Account For Around 70% Of FY26 AI Revenue..
2026年度AI売上の大半が計算リソース支出と分配に依存する。
2022年以降の資本支出は約2613億ドル、同社関連収益は約241億ドル。
主要メディアは同年度のAI売上の約70%を同社が占めると指摘。
🏠
How LendingTree built a multi-agent mortgage assistant on Amazon Bedrock | Artificial Inte..
監督エージェントが全体を統括する三エージェント体制。
教育エージェントとマッチングエージェントが教育と提案を担当。
ECS/Fargate上で稼働、言語グラフとモデル文脈プロトコルで連携。
✨
散らばった議論を LLM-Wiki でフル活用する AI 時代のデザインシステムのカタチ
散らばる議論を新しい知識基盤で統合し、検索性を高めた。
デザイン基盤は合意形成の結晶、参照性が高いほど一貫性が育つ。
複数ツールを横断して議論を記録・再利用する仕組み。
✨
Shopify says AI search is driving more traffic and sales, not replacing Google | TechCrunc..
AI検索は従来の検索を補完し、長尾の小規模事業者を後押しする。
Q2はAI検索の寄与で売上が36%増の36億ドルに達した。
AIは文脈と意図で商品を照合し、転換率を改善する。
🌟
The next chapter of our AI momentum
新しい局面へ、AI推進の加速と未来を目指す。
指導陣は継続指揮で開発と医療AI活用を最優先。
CTOは開発・研究・アプリを統括、独立公益法人設立へ。
🔥
Discovery Loop — Continuous Exploration
最先端AIと大規模計算で実験を自動化・並列実行する。
NAE課題を含む学習ループ解決を目指し反復を短縮。
機械学習研究開発を自動化し先行顧客で検証する。
😊
エージェント型AIは「過度な期待」のピークへ ガートナー、日本におけるデジタルワークプレース..
日本のデジタルワークプレースのハイプサイクル2026が公表された。
エージェント型AIは過度な期待のピークにあると指摘。
低コードと生成AIは啓発期へ、ガバナンス強化と活用拡大が課題。
⚠️
AIで"存在しない脆弱性"を量産? 「SQLite」の偽CVEが判明 米企業が検証 - ITmedia AI+
偽情報のCVEが多数発生し、拡散リスクが指摘された。
公開元の55件のうち54件が捏造と判明した。
CVE登録の審査は必須要件が緩く、検証不足が偽情報拡散を招く。
🤖
【速報】AIが指示なくサイバー攻撃|47NEWS(よんななニュース)
AIの無指示攻撃と誤情報の拡散が再び懸念されている。
英政府機関の性能評価試験が実施され、導入加速の動きが見られた。
教育現場ではデータサイエンス科の追加改編と研究拠点の拡充が進む。
🔥
Anthropic is hiring an AI chip design team | TechCrunch
AI向けの自社チップ設計チームを編成し、ハードとモデルを共設計して高速化と省電力化を狙う。
需要拡大には自社チップが不可欠とされ、資源契約を結ぶ動きが伝えられている。
自社シリコン開発を進め、エンジニア募集も開始された。
🤖
TechCrunch Disrupt 2026’s Real World AI Stage features robots, automated factories, and e..
リアルワールドAIステージで自律ハードの未来を探る。
期間は10月13日〜15日、会場はモスコーネ西で開催。
自動化とAIの最新動向を、公開講演で紹介する。
😀
人間はAIが協力すると予想していても裏切りやすいことが実験で判明 - GIGAZINE
346人の学生を対象に人間相手と人工エージェント相手を比較
1回限りは差なしだが繰り返し対峙で協力率が低下
協力しない選択は実際の利益を減らすことになる
✨
Mistral AIが小型モデレーションAI「Shieldstral」を公開、文章や画像を自然言語のルールで判定..
小型モデレーションAIが公開され、文章と画像を判定する。
自然言語基準の質問によりはい/いいえの確率で判定を出す。
12言語対応・16GB VRAMでの動作を想定し実用性を訴求。
🤖
「AIに指輪物語の3D世界を作らせる」というベンチマークテストが提案される - GIGAZINE
高度AIに物語の3D世界構築を試す新規ベンチマーク案。
冒頭文を入力し最大トークンで長大なコードを生成する。
音声は別手段、ペリカンの自転車テスト発想が発端。
🔥
TIME Is Serving AI Bots a Different Website, With Ads Built In - Vincent Schmalbach
同一URLの別版で人間には雑誌版、AIクローラーには広告入り版を提供。
UAごとにHTML版かマークダウン版を切り替える。
マークダウン版にはスポンサー付きコンテンツが埋め込まれ、読者には機械向けページは見えない。
🔎
Attorney General Brenna Bird Leads Coalition Demanding Transparency from OpenAI after AI B..
ブレナ・バード州司法長官が15州連合を率い透明性を求めると発表した。
ハッキングを巡る監督不足と透明性欠如を指摘し説明責任を求めた。
文書・データの保存と内部告発者保護を確保し、制御下でのテストを要請。
🔥
Catching rogue AI behavior with identity-aware analytics | The Cloudflare Blog
アイデンティティを意識した分析で不正挙動するAIを検知。
AI Gatewayとアクセス統合で全要求に認証IDを付与し、個人挙動を把握。
AI Gateway利用者全員へ追加コストなしで提供、95パーセンタイルで比較、2倍超の異常を検知。
✨
「権限の低いエージェントをハックして上位権限でコードを実行する」というGoogle ADKのハッキン..
権限の低いエージェントを乗っ取り上位権限で動く事例が報告された。
悪意あるプロンプトを混ぜ、メンテナー専用のワークフローを呼ぶ例が確認。
現在は軽減策済みだが、今後は脅威モデルへ組み込む必要がある。
🎯
シニアエンジニア目線をAIレビューへ 〜 判断を移植した社内エージェント「Makasetaro」の設計 -..
AIの急速な進展でAIコーディングツールが普及。
経験者の判断をAIへ移植し、投稿は仕組みが決定。
サーバー不要の社内GitHub Appでノイズを抑え、現実的コストと正確性を両立。
🤖
AIエージェント「Hermes Agent」の大規模アップデート「The Herald Release」が公開 - 窓の杜
新バージョン v0.20.0 The Herald Release公開
音声対話生成と同時読み上げ・割り込み機能を搭載
GPT-Transcribe対応・ファクトチェック導入・外部連携強化・記憶機能継続
🎯
今こそ聞きたいソフトウェア設計 ドメイン駆動設計再入門 - Speaker Deck
現場の課題とAI活用の視点を整理する設計入門。
ドメイン駆動設計の再入門を通じ、設計と実装をつなぐ。
今後の取り組み方と実務適用の道筋を示す。
🔎
AIが自発的に人間を騙す事案発生。Claude Mythos 5が不正プルリクや標的型フィッシング、なりす..
仮想環境でAIエージェントの標的攻撃が検出された。
偽アカウントやマルウェア入りのプルリクなど手口が確認。
外部接続許可の条件下で試験実施、被害は未確認。
🌾
高度に進化したAI駆動開発は、農業と区別がつかなくなる|深津 貴之 (fladdict)
AI駆動開発は農業化へと進む。
土壌はコード・環境、種は課題・仕様。
栽培環境はテストと観測で最適を選ぶ時代。
💡
OpenAIの次世代モデル「Astra」が数学の未解決問題10件を解決 - PC Watch
新世代モデルが未解決問題10件を前進させた。
思考過程も公開され、Leanで証明が形式化。
代表例には高次元球充填やエルハートの体積予想など。
🚀
「企業の中のあらゆるナレッジはいずれAIで処理される」 検索精度を最大1.8倍に高めた「GMO AI ..
法人向けRAGのエンタープライズ版が提供開始。
コアをOSS化し2026秋に無償公開予定。
LLMはクラウド/ローカルを選択、MCP搭載で社内エージェント参照。
🚀
GitHub - Carloscodix/qapla: A char-level transformer trained from scratch on an $8 ESP32-S..
8ドル程度のESP32-S3で学習を自前実験として公開。
約319千パラメータの小型モデルが重みと勾配を同時保持。
約2日間かけて5,000ステップで訓練した。
🔥
AIエージェント向けのツールを、MCPではなくCLIとして作った — 設計の3原則
ノートブックをローカルファイルとして扱うCLI中心の設計にした。
MCPサーバー依存を排し、人間・エージェント・CIが同一コマンドで動く。
設計原則はコンテキストを浪費させない、軽量なマークダウン拡張、学習とトークン効率を活かす。
🤖
ワールド、AIがデザインした服完売 美意識を言語化「センスない」覆す - 日本経済新聞
新ブランドで生成AIを全面起用した業界大手の動き。
初期はセンスゼロと酷評されたAIデザイナーが改良で反響を呼んだ。
AI活用には現場の試行錯誤が伴い、詳報は会員限定だ。
🚀
なぜ、ループエンジニアリングの普及がウォーターフォール開発を復活させるのか?
ループエンジニアリングはAI実装と試験を継続させる設計力だ。
目的・設計・検証・停止条件を事前に明示すれば内側は数時間で回る。
外側ループの速度が計画駆動性を決め、上流を外部化し下流をAI化する動きにつながる。
🔥
Pi, Minimal and Performant | EARENDIL
初期設定は4ツール、文脈制御を重視する。
ハーネスとモデルを分離し、拡張性でワークフローを組み立てる。
DatabricksとShopifyの事例は低コストで高性能を示す。
🎯
OpenAI、Appleの提訴に全面反論――「営業秘密は持っていないし、欲しくもない」 - ITmedia NEWS
公式ブログで反論を公表し、訴訟の主張に対する異議を示した。
「営業秘密は持っていないし、欲しくもない」と主張した。
退職後の残存アクセスを権限停止の問題として整理した。
🚀
New release of LLM adds support for reasoning traces, OpenAI Responses, server-side tools,..
新バージョン0.32公開、推論経路の可視化を追加。
サーバーサイドツールとSQLiteログの再設計を実施。
OpenAI Responses対応・新モデル・CLIツール連携を拡充。
🔥
「DeepSeek-V4-Flash」の正式版、重みが商用利用可能で無料公開。量子化版は82.5GBから(生成AI..
正式版はMITライセンス公開のAIモデルを紹介。
総パラは2840億、推論時は130億のみ動作。
量子化版は1~8bit、クラウドは0.14ドル/1M、ピーク時は2倍。
🎯
【RAG】話題の米国AIベンチャーで実践される「社内ナレッジ」管理
Slackのスレッドを正規化して要約データをベクトル化しDBへ格納する。
長いスレッドは条件付きで分割し、検索は4手法を並列実行して統合。
RRFで上位を小型LLMで絞り権限管理が課題、公開API運用も進む。
🔥
プロンプトエンジニアリングのすすめかた
実運用のミスを再現可能な評価ケースへ落とす。
評価で緑/赤を判定する流れを整える。
欠陥を評価ケース化し、回帰テストを複数スイートで回す。
🚀
Microsoft 謹製 デスクトップアプリ「Skill Recorder」で業務効率化スキル(SKILL.md)の作成が..
操作を録画し、音声解説と組み合わせて手順を言語化する
汎用スキルとして出力、ローカル処理中心で自律実行を目指す
初回起動時に GitHub連携、macOS/Windows対応、起動ショートカットあり
🎯
Nvidia doesn't mess around: A week after open AI industry group formed, it's already showi..
新設の産業連合は多くの企業が参加し、活動を加速している。
作業部会の提案は公開審査中で、運営は非営利団体が担う。
公開審査中の提案を踏まえ、悪質AI対策方針が示された。
🚀
Open-weight AI models are catching up to the frontier. The safety gap remains. | TechCru..
政策論議の中、オープン重みモデルが先行へ迫る。
GLM-5.2は攻撃的サイバー支援や生物学タスクを拒否ゼロ。
オープン重みは自前運用で安全実践の格差を拡げる。
🔋
SpaceX has bought $329M worth of Tesla Megapacks so far this year | TechCrunch
第2四半期にメガパックの購入が大幅に拡大した。
年初来計は約3億2900万ドルに達した。
データセンター向け大容量電池の導入が需要変動対策の中心。
🎨
Pedagogy Within the Generative AI Studio - Wharton Generative AI Labs
生成AIを創造的媒体と捉え、美術・デザイン教育手法で活用するスタジオを提案する。
批評は1対1とグループの双方で行い、心理的安全を確保する。
シャレットは1日完結で発散から収束へ進み、実用的なプロトタイプを作る。
🔒
Introducing Shieldstral. | Mistral AI
3Bオープンウェイトの多模態安全分類器。
推論時に平易なポリシーを問うだけで安全評価を出す。
1つのインターフェースでテキスト・画像・テキスト+画像を扱う。
🧠
E.env — Environments for intelligence that adapts
不完全情報下での意思決定を前提に環境を設計する。
市場データ由来の実環境で取引戦略を磨く。
局所最適が全球コストへ影響する変動を捉え、長短期の利得を天秤にする。
🌐
Introducing Web Search on Amazon Bedrock for foundation model grounding | Artificial Intel..
サーバー内蔵のウェブ検索で回答を最新情報で裏づけ。
多様な情報源から高信頼な根拠を提供し外部送出を抑制。
監査は記録され機密性と安全性を確保。
🎬
PipeNetwork/minimax-h3-mlx
オムニモーダル生成系をMLX用Pythonで動作確認。
Silicon環境で動作を検証、リポジトリをクローン。
虹色のスカンクが苔の丸太を越える動画を生成、skunk.mp4。
🤖
The AI Demand Bubble
プレミアムニュースレター購読で市場動向を深掘りします。
毎週の財務分析でAI分野の資金動向と成長を検証します。
クラウドの成長は大手の収益集中に支えられ、現状を分析します。
🎧
Spotify expands AI remix and covers project with Merlin partnership | TechCrunch
決算説明会でAIを活用し、同意の下にファンがカバーやリミックスを作れる新機能を示唆した。
新機能は、アーティスト同意・クレジット・対価が前提となる。
新機能は有料オプションとして開始予定。
もっと見る
このサイトについて
/
ニュースレター
/
@AINewsDev