読む価値のあるもの

今でも開く価値のある記事の短いリストです。アーカイブのすべてではありません。

AI Research

Netflix GenRec:vLLM上のLLMランカーが、ラベルデータ40分の1で成熟推薦を上回った理由

Netflix GenRecは推薦をコンテキストエンジニアリングに転換。vLLMのprefill-onlyで配信し、オフラインMRR +1.6%、オンラインは統計的有意な改善、Phase-2ラベルは約10〜40分の1。

AI & Technology

Ox Alpha AIモデルとは?匿名「ステルスモデル」の特徴と正体に関する有力説

Ox Alphaは、100万トークンのコンテキスト、多モーダル入力、コーディングエージェント向け機能を備える匿名AIモデルです。注目される理由と、開発元をめぐる推測を解説します。

AI Research

Microsoft Agent Lightning v1.0:出荷するのと同じハーネスでAIエージェントを訓練する

Agent Lightning v1.0は、実際のコーディングエージェント向けのharnessed agentic RLを実現します。約3,500行、ほぼゼロ改修で、約6K例だけでQwen3.5-9BがSWE-bench Verifiedで14.6ポイント向上。

AI & Technology

DeepSeek Harness:「すべてがプラグイン」でAIエージェント開発に革命を起こす

DeepSeek Harness v0.1は、Cordis上に構築されたMITライセンスのローカルファーストなオープンソースエージェントランタイムです。モデル、ツール、セッション、サンドボックス、ループ自体がすべて差し替え可能なプラグインです。

デスクからさらに

1本につき1ノート。商品グリッドではなく、編集ページとして読めるように。

AI Security

プロプライエタリLLM APIから推論トレースを盗む:重大なセキュリティ脆弱性が露呈

Anthropic、OpenAI、GoogleなどのプロプライエタリLLM APIから隠された推論トレースを抽出できることが示され、知的財産とプライバシーにリスクをもたらします。

AI Industry

Meta の Muse Glimmer:ローカルエージェントワークフローを革新するオープンウェイト AI モデル

Meta が Muse Glimmer を発表——300億パラメータの Apache 2.0 オープンウェイトモデル。常時稼働のローカルエージェント向けに最適化され、NVIDIA 単一 GPU で約毎秒 20,000 トークン。

AI Infrastructure

Cloudflare が Kitesurf を発表:AI エージェント専用の革命的ブラウザ

Cloudflare が世界初のエージェントファーストブラウザ Kitesurf を正式リリース。Workers 上の V8 アイソレートで動作し、一般的なエージェントタスクで Chromium より CPU・メモリを 3〜7 倍少なく使用。

AI & Technology

AI駆動Webクローリング完全ガイド:Crawl4AI vs Firecrawl vs Scrapy vs Apify 2026年比較

2026年のCrawl4AI、Firecrawl、Scrapy、Apifyを速度・機能・価格・ユースケースで比較。RAG、大規模スクレイピング、マネージド運用に最適なツールを選びましょう。

AI Infrastructure

Cloudflare が AI を革新:Kimi & GLM モデルを 41% 高速化、30% コスト削減

Cloudflare の画期的な最適化技術が大規模言語モデルの展開を変革——Kimi と GLM でスループット 41% 向上、トークンあたりコスト 30% 削減。

AI & Technology

次世代AIエージェント:QM YC Agent SystemがOpenClawとHermesを超える理由

QM YC(yc-software/qm)は約6日で10.9k超のGitHubスターを獲得。真のマルチエージェント調整、階層的メモリ、適応的ツール統合、エンタープライズ級の計画でOpenClawとHermesを超えます。

ソリューションを探す