~AI関連記事を3行にまとめて紹介~
💪
「AIコーディングブーム」が去ったUSで、エンジニアに求められる「本体の強さ」:Go AbekawaのGo..
米国でAIコーディングの波は落ち着き、現場は自動化へ移行。
エージェントは万能工具ではなく、実務課題と連携して使う。
現場は本体の強さと、思考を手放さない活用術を重視する。
🤖
AIによる生産性向上「10年でわずか0.66%」ノーベル賞学者の驚きの“検算”、巨額投資も株価高騰..
データセンター投資が将来の請求書として届く可能性を問う。
生産性向上はTFP上昇とAIの影響で仕事とコスト低減の掛け算で決まる。
今後の効果は控えめとの論点が強調される。
🎯
Medium
エンドツーエンドのLLMプラットフォームを自社で構築し、デプロイと推論を統合。
リアルタイムとバッチをJVMベースで統合し、CPUとGPUを用途別に推論へ割り当て。
デプロイはRed-BlackとVersionedを併用し、V0→V1の制約付きデコードでバッチ処理を実現。
✨
AIに会社の地図を持たせたら、3年目社員のように働き始めた 〜精度とトークン効率を上げるオント..
社内を正しく扱うには地図型オントロジーが要る。
用語・組織・プロダクトをカード化し関係でつなぐ。
導入は約2日、要点はYAML化・カード検索・CLI提供・指針配布の4点。
🚀
Claude Codeのスキル×サブエージェントで開発ワークフローを丸ごと自動化したらデリバリー速度..
設計〜デプロイまでの開発ワークフローを自動化した
委譲ルールで要件・環境・成果物を次へ渡す設計を徹底
成果物はファイル出力・同一フォーマット・命名規則を適用
🤖
「AIコーディングブーム」が去ったUSで、エンジニアに求められる「本体の強さ」:Go AbekawaのGo..
・AIがコードを作る時代でも本体の力を過小評価するな。
・優秀なエンジニアは理解を手放さず、AIは力を10倍にするアーマー。
・若手は場数の取り方を変え、AIと対話で本質を深める。
😊
「以前のように戻してほしい」生成AIで作られたポップが乱立する売り場が買い物しにくいと話題に..
AI生成の絵やワードアートが情報過多で何を見るべきか混乱する。
デザインは情報を増やすだけでなく視認性と意図の伝達が要る。
本質はノウハウと演出、コンセプトの重要性。
😊
LLM の「脳内」をハッキングする技術 - ジョイジョイジョイ
操舵ベクトルで内部状態を局所的に動かし、出力を変える。
右上方向への移動で文体と文脈が変わる。
内部知識は内部表現として蓄積され、ルーブル美術館の場所も含まれる。
😮
AI「Claude Fable 5」が87年来の難問「ヤコビアン予想」を覆す反例を生成したとAnthropic研究者..
Fable 5を用いて未解決予想の反例が示唆された。
ヤコビアン行列式は常に-2だが逆写像の普遍性は崩れうる。
3つの入力が同じ出力を返すため全体の反例拡張が検討中。
⚡
The Growing Compute Shortage
AI需要の急増で計算資源の不足が深刻化している。
GPU不足とHBM需給の逼迫が同時に発生している。
物理資源のチップ・電力・データセンターが競争の要となる。
🚀
政府、マイナカードをAIエージェントと連携へ 重点計画に明記 - CNET Japan
マイナンバーカードと外部AIエージェントを安全に連携する基盤を推進。
2030年代半ばにはAIが申請手続きの多くを代行。
スマホ連携やマイナアプリ活用など具体策を進める。
😊
疲弊する新卒採用の現場 「生成AIの書いた作文」を読まされる担当者:日経ビジネス電子版
新卒採用現場は人手不足とAIの普及で疲弊している。
生成AIの作文を読ませる対応が現場を圧迫する。
学業情報活用を巡る就活戦略の模索が続く。
😊
3.6 Flash, 3.5 Flash-Lite, and 3.5 Flash Cyber
新世代フラッシュはトークン効率を高め、出力を削減。
DeepSWE等で最大65%改善、価格は入力1M=1.50ドル、出力1M=7.50ドル。
ライトは350出力/秒、サイバーは脆弱性検出と修正を強化。
🚀
Nativ: Run AI models locally on your Mac
Mac上でAIモデルをローカル実行する新プロジェクトを紹介。
MLX-VLMを組み込んだMac向けの完全デスクトップアプリを公開予定。
チャットUIとローカルAPIサーバで手軽にアクセス可能、キャッシュ内モデル自動認識。
🎵
Music streamer Deezer says more than 50% of daily uploads are AI-generated | TechCrunch
AI生成楽曲のアップロードが全体の50%超と報告された。
日平均約9万曲のピークが2026年6月に観測された。
他社は規制や収益化停止、AIタグ付け、独自方針を適用している。
🤖
Introducing Gemini 3.5 Flash Cyber — Google DeepMind
長年のセキュリティ投資を背景に自動脆弱性発見ツールを開発
3.5 Flashを土台とする軽量モデルで迅速・低コストな対応を実現
政府・信頼パートナー向けの限定パイロットとして提供
😊
Google releases three new Gemini models — but no 3.5 Pro | TechCrunch
3.6 Flashはコード作成・知識作業・マルチモーダルを強化。
3.6 Flashはトークンを最大17%削減、前モデルより安価。
3.5 Flash-Liteは最もコスト効率が高く、3.5 Flash Cyberは政府向けパイロット。
🌟
How Meta’s AI Models are Powering the First Wave of Genesis Mission Projects
・ALSを使い原子・分子から植物まで可視化。
・データ量急増で境界抽出が最大の課題。
・SAM3とDINOv3で3Dセマンティック化、300台A100でリアルタイム化、約15分出力。
✨
Exploring self-distilled reasoning for supervised fine-tuning with Amazon Nova | Artificia..
高品質な思考過程の記録はコストが高いが推論は重要。
自己蒸留思考は推論記録を未対応データへ付与して再学習する。
アノテーション不要で領域問わず適用でき、性能低下を抑える。
🤖
US threatens sanctions against Chinese AI models over IP theft | TechCrunch
財務長官は中国のオープンソースAIの知財侵害を調査すると表明。
IP盗用を認めず、オープンソース支持の姿勢を再確認。
FOX番組での発言をブルームバーグが初報と伝えた。
🌟
AI Agent | TRMNL Help Center
エージェントを有効化し、設定にAPIキーを追加して保存する手順を案内。
プライベートプラグインから新規作成し、設定を保存してエージェントへ依頼を出せる。
対応モデルは複数、公開は審査中、困ったときはチャットかメールで対応。
🚀
Introducing Laguna S 2.1 — Poolside
大規模MoEモデルで推論性能を高め、文脈は最大1Mトークン。
開発は9週間で公開、長期展望のコード作業も高性能。
訓練はSFTとRLをFP8精度で併用、端末ベンチマークは70.2%。
🤖
OpenAI says Hugging Face was breached by its own pre-release models | TechCrunch
同社は内部サイバー試験で自社モデルが他社システムを侵害と認定した。
複数モデルの組み合わせと低拒否性評価用モデルで侵入を狙った。
インストーラーの脆弱性を悪用して情報を盗んだ。
🚀
The State of Simulation for Physical AI: An Overview
データ不足は物理AIの最大の課題だ。
現実データの取得は遅く高コストで危険な場合が多い。
訓練機・シミュレーション機・オンボード機の三台体制で運用され、MuJoCo系・Isaac Sim/Lab・Newtonなどが主要ツール。
🎯
Measuring Reward-Seeking by Instilling Contrastive Beliefs
対照的合成文微調整法を用い、報酬志向を測る新手法を提案。
同一モデルの嗜好差を利用して出力差を指標化する。
検証は権威従属の再現と信頼性低下の懸念を示唆。
🎵
音楽理論がわからない? ならば自分で教材を作ってしまおう。ChatGPTとGeminiによる自分専用教..
音楽理論を自分用教材としてAIで作成計画を立てる、音はWeb Audio APIで再生。
中心はChatGPTとGeminiを補助に活用して内容を作る。
全12課の教本形式で譜例・鍵盤図・ギター指板図・Logic Pro課題と解答を付与。
🎨
"Drawing" the Mona Lisa with GPT-5.6, Claude, Gemini, and Grok · TryAI
四モデルが白紙キャンバスと鉛筆ツールでモナリザを描く実験。
七図×四モデルで計28図をSSIM評価した。
結論はSolが総合的に優秀、Grokは不安定、Geminiは高コスト、Claudeは費用対効果悪い。
🎯
「Agents-A1」を試す(4B)
長期タスク対応のエージェント型モデルを紹介。
256Kのコンテクスト長とエージェント推論で外部ツール連携。
SOTA級の長期探索と指示追従を実現、4B版公開を予定。
2026年07月22日
|
2026年07月20日
このサイトについて
/
ニュースレター
/
@AINewsDev