AI News

~AI関連記事を3行にまとめて紹介~

🔥

Opus 4.8に肉薄するオープンソースモデル「GLM-5.2」、VRAM4.5GBで動くコーディング特化AI「Gemm..

  • GLM-5.2に近づくモデルとOpus4.8の動向を解説。
  • DreamX-World 1.0の遅延削減と記憶機能を紹介。
  • Looped World ModelsとGemma4-12B-Coderを要点整理。

🌐

米アンソロピック、政府の承認受け最新AIモデルの提供を一部再開 写真1枚 国際ニュース:AFPBB..

  • 政府の承認でミトス5の提供再開が一部で進む
  • フェイブル5の再提供と協議が続く
  • 監視と自律兵器の利用批判も残る

📚

LLMによる情報抽出入門 | 技術評論社

  • 非構造データから価値ある情報を抽出する実践ガイド。
  • 前処理・後処理・評価・運用の要点を体系的に解説。
  • プロンプトとPythonサンプル、クラウド環境で即実践。

💻

🚀ローカル LLM 選び、もう「VRAM に入..

  • CLIでLLMを選択・実行する手順を解説。
  • モデル別のVRAM要件とスコア指標の目安を示す。
  • 実機例としてRTX 4060 Ti 16GBや61.6GB RAMの構成を紹介。

😊

アンソロピック AI「ミュトス5」米の一部企業などに提供再開へ | NHKニュース | 生成AI・人工知..

  • 政府命令で停止していた提供が再開された。
  • 米国内の一部企業へ限定して利用が進む。
  • 安全対策と監視強化が前提と説明されている。

🔥

無料でAI最適化「AEO」をChatGPT・Google AI Overviews・Perplexity・Gemini・Copilot・Grokなど..

  • 無料の自ホスト型AI最適化ツールを検証可能
  • 複数の回答を記録・引用元・競合状況を可視化
  • Windows 11でDocker/Nodeから構築可能なオープンソース

💡

シニアエンジニアがコードをほぼ書かなくなった理由

  • AIがコードを作成し、人は仕様決定と検証に集中する時代だ。
  • 上流設計は仕様駆動で人が判断、実装はAIと協調する。
  • 2025年以降、適用が進み残業が減り生産性が向上した。

ぜんぜんわからない、俺たちは雰囲気でAI適用をやっている - 理系学生日記

  • インプットを整備し、対話→仕様化→プロトタイピングを試す。
  • 出力を自動検証できるかを確認し、不可なら人の介在を検討。
  • 合意形成は人とAIの協業を前提に進め、一次情報を重視する。

💪

Ford rehires ‘gray beard’ engineers after AI falls short | TechCrunch

  • ベテラン技術者を350人再雇用し品質を見直す。
  • AIで欠陥を工場へ届く前に見つける技術者が復職。
  • 再雇用と訓練で今年10億ドルのコスト削減を見込む。

AI エージェントフレームワーク Flue を試してみた

  • TypeScript製のAIエージェント構築フレームワークを試す。
  • ハーネス駆動アーキテクチャで機能が明快。
  • チャット連携で外部チャットサービスとHTTP通信可能。

🚀

GitHub - kamaludu/bash4llm: Bash-first wrapper for Groq’s OpenAI-compatible API. Secure, ..

  • 安全で完全監査可能な Bash ラッパーCLI。
  • 1ファイル自含スクリプトで動作、Unix系環境対応。
  • 動的モデルリスト取得・ストリーミング・長文自動保存/Termux対応。

😊

GitHub - JustVugg/nanoeuler: GPT-2-style LLM built from scratch in C/CUDA with hand-writte..

  • C/CUDAで自作GPT-2級言語モデルを実装・検証。
  • 手書きのバイトレベルBPEトークナイザとCUDAエンジン搭載。
  • 前学習は書籍とWebで、微調整後にチャットへ。

🧠

Do LLMs pass the mirror test? — Quants & Qualia

  • 赤点サルの元祖ミラーテストをLLMに適用すると測定は不十分だ。
  • 出力を自分のものか問う方式は実質的に模倣検出に近い。
  • Gemma4-31B-ITは自己認識の有無を観察し、GLMと Claudeは模倣へ走る。

🔥

We have Mythos at Home: GLM 5.2 beats Claude in our Cyber Benchmarks | Semgrep

  • 同一データと同じプロンプトで評価を実施した。
  • F1は39%対32%で上回る結果だった。
  • オープンウェイトは低コスト寄与が大きい。

🚀

[2401.07013] Knowledge Distillation of Black-Box Large Language Models

  • 高性能ブラックボックス型LLMからの知識蒸留は難しい。
  • 代理モデルを介してブラックボックス教師から小型モデルへ伝達する。
  • 実験はProxy-KDが従来手法を上回ることを示した。

🔥

数十ページのPDFを1回で処理、ローカルOCRモデル「Unlimited OCR」をバイドゥが無料公開。商用利..

  • 長文を一度に処理するOCR技術を紹介
  • 参照窓アテンションで長文化のキャッシュを抑制
  • MITライセンスで商用利用可、32Kトークン長で一括計算

2026年06月29日

|

このサイトについて

/

ニュースレター

/

@AINewsDev