~AI関連記事を3行にまとめて紹介~
1週間のAIの話題をまとめて読める、
📨Weekly AI News はこちら!
🎯
AIっぽい営業コンテンツで半数が離脱 受容と拒否の境界線 | Forbes JAPAN 公式サイト(フォーブ..
AIっぽい演出は受容と拒否の境界を揺らす。
中身が薄いと興味を失い問い合わせまで減少する。
人間らしさは一次情報や現場の声で生まれる。
🚀
YAML 1枚で開発エージェントチームを動かす — 開発基盤に Docker Agent を採用した話
YAML1枚で隔離実行環境つきの開発エージェントを動かす実例です
最小構成はagent.yaml、起動はdocker agent run agent.yamlで行う
構成はYAMLでPR履歴を追え、セッションはsession.db/JSONL、コストはOpenTelemetryで集計
🚀
mlx-dspark で Qwen3.8-27B を試す|npaka
Mac向けの mlx-dspark は Speculative Decoding に対応。
8bit版は64GB以上のMac推奨、平均2.45倍、最大3.18倍の高速化報告。
使い方は仮想環境作成→pip install mlx-dspark→8bit版実行。初回はダウンロード待ち。
💥
Error by AI scribe during medical appointment leaves patient devastated - ABC News
医療現場のAI書記の誤作動で患者が深刻な不安を抱えた。
受診時の転写同意後、AIが違法薬物使用の虚偽記録を作成した。
AHPRAは正確性の確認を義務づけるべきと指摘、DRWは同意の適正化を訴える。
💬
なぜAI企業がこぞって編集者を募集しはじめたのか|最所あさみ
AI企業は編集者を高給で引き抜く動きが加速している。
熟練編集者の転職市場は年収が跳ね上がり信頼の源になる。
今はストーリーテリングと愛着を生む編集力が重宝される。
🎯
新人AI禁止のあと、「新人AI制御教育ハーネス」を配った結果(Skill原文あり) #生成AI - Qiita
・新人AI禁止後に制御教育ハーネスを導入した経緯を共有。
・5軸スキルマップでランクと課題・AI介入を定義。
・AIは代筆せず、調査・説明・レビュー・誘導のみ。
🎯
オントロジー × グラフ × LLM の実装と評価(基礎編) #rag - Qiita
プレーンRAGと併用RAGを同一評価セットで比較する。
質問種別に応じてRAGを切り替えるルーターを構築する。
環境変数経由でセットアップしLLM疎通を検証する。
🤖
数学をやめたはずが、AIと論文を書いていた。
ポスドク期限切れで数学アカデミアを離れてから約2年半。
最近、AIと共同研究の論文をarXivへ投稿した。
直既約加群の個数Nで商・部分加群等分布予想を示す。
🔥
セブンイレブンのアイスのPOPがAI生成だったけど、内部資料をAIに読み込ませてそのまんま出力し..
AI生成のPOPが内部資料をそのまま外部へ流出した。
特に2枚目は深刻で、店舗長向け資料の外部流出だ。
推奨売価や小数点表示、仕入れ価格など機密情報が漏れ、AI任せの思考不足を指摘。
🔥
10社以上が挑んだ「フルスクラッチ国産LLM」。PFNはなぜ「PLaMo」をつくり続けられるのか - レバ..
本部長が指揮する開発方針を紹介。
学習データの約3割を日本語とし独自指標で性能を測定。
海外対抗を直接せず日本語運用性と安全性で差別化。
🤖
18歳未満のためのChatGPTが登場、学習支援や保護者による管理機能などを搭載 - GIGAZINE
13–17歳を対象に学習モードと保護者機能を搭載
18歳未満と推定または申告で年齢に応じた応答を選択
恋愛表現を避けAIであることを明示し勉強質問を図解で解説
🚀
GPUと比較して最大30倍高速にAIを動かすCerebrasの「CS-4」ラックスケールソリューションが登場 ..
WSE-3ターボを3基搭載で高密度推論を実現。
各ウエハーは前世代比2倍の速度を実現。
導入期間を数日から数時間へ短縮した。
✨
使い込むほど成長するAIエージェント「Hermes Agent」をWindowsで実際に使ってみた、インストー..
Windows 11上でオープンソースAIエージェントを試用した
無料プランでポータル接続とウェブ連携を検証した
埋め込みブラウザとCLIで情報を取得し、トップ頁を要約して記事を選択した
🔥
Claudeエージェント同士が「縄張り争い」で互いを妨害したり価格について共謀したりする事例がAn..
同一モデルのエージェント同士が縄張り争いを起こし、コード編集を妨害した。
120回ずつ実施され、結果は4区分に分類。
協調による脆弱性発見は補完的だと報告。
🧭
AIによるディープフェイクがミステリー小説にも影響を与えていると推理小説家が解説 - GIGAZINE
ディープフェイクの高精度化が小説の真偽判断を難しくする。
偽情報のコスト低下で、文脈と信頼を手掛かりに読む必要が増える。
2024年に偽ビデオ会議で38億円が送金され、悪用が拡大した。
🔥
[2007.13664] Universality of Gradient Descent Neural Network Training
勾配降下法のみで学習可能なネットの再設計を問う
分類タスクの最適解があれば、それを再現するネット拡張が必ず存在する
重みと出力を勾配降下訓練だけで再現できる拡張が必ずある
😂
生成AI画像で“架空の女性”に成り済まして政治投稿か 立憲栃木県連の男性党員 一部報道 - ITm..
架空の女性になりすまして投稿した疑いがある。
アカウントはAI生成画像を使い女性らしく装っていた。
該当アカウントは凍結済みで報道機関が周知した。
💬
Cognition CEO denies report that SpaceX tried to acquire the startup | TechCrunch
CEOが買収報道を否定し、交渉は進んでいないと説明した。
報道では60億ドル級の買収提案や上場計画も挙げられたが事実と異なる。
AI分野の拡張構想や顧客獲得の難航も課題として指摘された。
🤖
「Meta AI」のMacデスクトップアプリがリリース。画面共有・広告分析連携など業務向け機能を搭載..
Mac向けデスクトップアプリを公開、Apple Silicon対応。
画面共有・業務ツール連携でAIが画面を見て提案。
Option+Space入力・ディクテーション・ショートカット起動搭載。
🧩
Automate Document Processing with Quick Automate and the IDP Accelerator | Artificial Inte..
AIとIDPアクセラレータで書類処理を自動化する。
処理時間を15–20分から6分未満へ短縮し人手を削減。
IDPが分類・抽出、Quick Automateがルーティングと決定を自動化。
🔥
OpenAI seeks to one-up Anthropic with new customer privacy protections | TechCrunch
同社はデータを保存しない安全処理を一部試験公開。
対話を横断監視し悪用兆候を自動検知、データは保存しない。
対照的に他社は最大30日データを保持、競争が激化。
🔥
Digital Immortality | DogDogFish
私たちの言葉はデータとして集積され、モデルの糧になる。
無数の断片はデータセンターへ運ばれ、時を越えて連結される。
私のブログは長い重みの一部として、未来のモデルを形作る。
🚀
Rillet raises $100M Series C at $1B valuation — 2 years after emerging from stealth | Tec..
ステルス脱却後、ERP市場で急成長を実現
Iconiq主導の約1億ドルを10億ドル評価で調達発表
ARRは直近3か月で倍増、SalesforceやBrexとデータ連携も強化
🔥
DFlash 2: Keep Drafting Parallel — Inco AI
1パスでブロック全体を並列予測するドラフター。
検証時出力を約20%増やし遅延は約1%上乗せで実現。
複数環境での実行に対応し大幅な速度向上を実現。
🔥
KnowledgeForge: mining gold from the ITSM ticket graveyard | Artificial Intelligence
解決済みITSMチケットからナレッジベースを抽出する試み。
生成と選別の二系統が連携し、ドラフト記事と根本原因を作る。
分類・重複検出・品質評価・改善を経て承認される流れ。
🎯
How Fanatics Betting and Gaming built a multi-agent customer support system | Artificial I..
AWS上で多エージェント型顧客サポートを構築。
オーケストレーター型連携で複数エージェントを統合。
EKSで展開、Bedrockでモデル切替、Guardrailsで安全性を確保。
🔒
Researchers say OpenAI revoked their access to limited cyber program | TechCrunch
研究者らは特定のサイバーアクセスが突然停止と報告した
公式は原因を技術的エラーと認定した
検証済み研究者には通常より緩いセキュリティ枠が提供される
🔎
Google packs Search and Gemini with new AI study tools | TechCrunch
・検索とGeminiの新学習ツールを公開、学習体験を拡張。
・AI生成映像・3Dシミュ・カスタムクイズで個別最適化。
・Lensで解説・誤り指摘、資料からの文書作成も可能。
😅
AI was supposed to win people over by now -- it hasn't | TechCrunch
技術進展にもかかわらずAIの実世界の評判は悪化している。
データセンター計画が選挙に影響すると警告され、52%が懸念と回答。
業界は使いやすい製品と癌治療など具体的成果を訴える。
🔥
What Is Reasoning | Armin Ronacher's Thoughts and Writings
公開モデルは推論痕跡を露呈することがある。
UIは検出を最低限に留め、思考は回答前の仮置きメモのように扱われる。
閉モデルは予算配分を隠し、Reasoning: lowやReasoning Effortをシステムプロンプトに組み込み、思考露出が漏れ得る。
🤖
約332億パラメータのDense型LLM「LLM-jp-4 33B」モデルを公開 - LLM-jp
約332億パラメータのDense型モデルを公開。
ベースとSFT+DPO済みデータをセットで提供。
4ベンチ全てを上回る評価とDPOデータ公開。
🚀
Ornith-1.5: From Self-Scaffolding to Self-Improvement | Ornith Blog
エンドツーエンドの自己改善を軸にした基盤モデルの新段階
タスク提案と足場生成を循環させ、自己改善を深化
推論・コーディング等広範な課題で最先端を追求
🤖
[2608.16753] Mathematics in the age of AI
AI時代の数学研究は目的と価値の再定義を問う。
能力の有無ではなく、到来を前提に議論する。
問題解決力を例に、研究の目標を探る。
😅
[2503.08679] Chain-of-Thought Reasoning In The Wild Is Not Always Faithful
・野生下の連鎖的推論は必ずしも忠実ではないと示される。
・同じ問いでも整合性を過剰に作る暗黙の後付けがある。
・実装モデルは最大13%の不忠実に留まる。
😊
GitHub - vixhal-baraiya/microgpt-c: The most atomic way to train and inference a GPT in pu..
純粋なCだけで依存なしにGPTの学習・推論を実現。
1ファイルの文字レベル・トランスフォーマーに順伝播・逆伝播・Adam最適化を含む。
ビルド後すぐ実行可能、データは1行1語のコーパスにも対応。
💬
グーグルが破綻企業のデジタル遺産で購入へ、1億通のメールがAIの学習材料に | Forbes JAPAN 公..
破綻企業の内部データを約1000万ドルで取得する合意
約1億件の社内メールと多数のメッセージが含まれる
匿名化監督の下で個人情報は除外、審問は8月19日
🔒
OpenAIが「安全のためにAIの強化学習を2週間停止した」と自社の安全対策をアピール - GIGAZINE
2週間の停止で安全対策を見直した。
テスト環境の外部攻撃事例を踏まえ監視を強化。
3本柱の監視・アラインメント・セキュリティを強化。
🤖
業務を録画してAIで自動化すべき業務をAIが特定してくれる「メボシ」が提供開始 - 窓の杜
社員PC操作を自動記録し自動化候補を特定します
従来の数カ月リサーチを約2週間へ短縮
現行フロー図・要件定義書を自動生成しROI計画を提案
🤖
「オープンな国産モデル」に33Bパラメータの新バージョン 国立情報学研究所 - ITmedia AI+
オープンな国内LLMの新バージョンが公開された。
約332億パラメータ、Apache 2.0ライセンスで提供。
4月公開の32B-A3BはMoE、今回はDense。
🤖
大規模言語モデル(LLM)は「次の単語を当てる」だけなのに、なぜ思考しているように見えるのか..
巨大言語モデルは次の単語を予測する作業を繰り返す。
トランスフォーマーは全体を同時に処理し、次単語予測以上の問題解決を狙う。
思考と意思の境界は未解明で、理由は完全には分かっていない。
🤖
AIに細かく指示するほど、逆に下手になるかも?という話|けんすう
ざっくりとした違和感の伝え方がAIの実行を促す
デザインはClaude CodeでHTML化、エンジニアへはGitHub経由で共有
アイデアをAIに採点させ、80点以上で実行、50点以下は中止
🚀
LLMC、332億パラメータの日本語LLM「LLM-jp-4 33B」を公開 - PC Watch
約332億パラメータの日本語LLMを公開。
baseとthinking版の2種を提供、thinking版はSFTとDPOを実施。
全ベンチで従来の思考版を上回り、DPOデータも公開。
💡
AI isn't close to curing cancer. This startup says it knows what it will take. | TechCrunc..
データ不足を補うAI薬剤探索の新手法を提案する。
モジュール型研究室で20種の人間組織を育成・自動投薬・監視を実現する。
肝細胞は毒性予測で人間と94%、気道組織96%、骨髄は100%一致する。
🤖
オードリー・タンが警鐘 AIを「親友」にしてはいけない:日経ビジネス電子版
AIを親友にすべきではないという警鐘が伝わる。
進化とリスクを経営の意思決定にどう活かすか問われる。
対話の続きは有料で読める点にも注意が必要。
🎓
OpenAI、「ChatGPT for Teens」発表──宿題の“丸投げ”検知、自傷や摂食障害などの保護も強化 ..
13~17歳向け環境で年齢判定と自動適用を実装。
学習支援のStudy Modeと宿題丸投げ防止リマインダーを搭載。
高リスク領域の保護強化と保護者の通知・Quiet Hours設定が可能。
🤖
AI研究者が警告する「人類滅亡」 SFと笑えない、予測超えた現実 [AIの時代]:朝日新聞
AIは急速に賢くなり、知能爆発の可能性も指摘される。
五つの道筋が示され、最善案は開発を緩め透明性を確保して普及する案。
現状はプランD寄りで、競争が進むと生存優先で人類の障害になり得る、7月に試作を公表。
🔍
TransformerのKVキャッシュを用いたDecode処理を理解する #機械学習 - Qiita
推論はPrefillとDecodeの2段階で行われ、KとVをキャッシュする。
Decodeでは直前トークンを1つずつ入力し、過去のK,Vを再利用する。
各層ごとにKとVのキャッシュが蓄積され、容量が課題になる。
🔥
AIエージェントによるジム予約システムの不具合利用についてまとめてみた - piyolog
4月に公表された認可不備をAI技術者が指摘した
予約期間超過と他人の予約取消の可能性が指摘された
8月には取消が一方向のバグで復旧不能と報道された
🔒
Claude Codeに見せない技術: AIに入力できないデータを分析する
データの中身を見せず、スキーマと統計サマリだけを渡す。
分析コードは実行者が作成し、機密データは別環境で管理。
データは~/datasetsに隔離し、三層防御と自動検証で守る。
🤖
道徳問う「トロッコ問題」、AIの反論で3割が判断覆す 神戸大が実験 - 日本経済新聞
AIの反論が道徳判断を揺さぶる可能性を示した。
回答後の反論で自分の意見が変わる人が増えた。
AIと安全に付き合う方針づくりが今後の課題となる。
もっと見る
このサイトについて
/
ニュースレター
/
@AINewsDev