毎日更新2521 検証済みのストーリー
AIニュース。 ノイズなしで。
製品の発売、政策の変更、安全性研究、業界の動向についてソースチェックされた AI の報道が、非営利教育チームによって平易な英語で説明されます。
検証済みの調達
すべてのストーリーは、入手可能な最強の証拠、つまり入手可能な場合はオリジナルの情報源、それ以外の場合は明らかに帰属が明記された報道にリンクしています。
平易な英語
何が起こったのか、なぜそれが重要なのか、何を観るべきなのかを、専門用語を使わずに説明します。
フィラーなし
信号が薄い場合は、フィードをパディングするだけで何も公開しません。
さらに多くのストーリー
9 物語革新
FlashPrefill V2 の論文では、ブロックスパース アテンションによる大規模なロングコンテキストの処理速度の向上が報告されています
arXiv の論文では、ロング コンテキスト LLM サービス用のブロック スパース アテンション システムである FlashPrefill V2 について説明し、NVIDIA H20 GPU 上の 128K コンテキストで FlashAttendant-2 と比較して最大 47.26 倍の高速化を報告しています。arxiv.org革新
SWE-bench Science ベンチマークでは、コーディング エージェントが科学ソフトウェアに苦戦していることが判明
新しい arXiv プレプリントでは、科学ソフトウェアでコーディング エージェントをテストするための 119 タスクのベンチマークが紹介されており、最もパフォーマンスの高いエージェントのスコアが pass@1 で 50% 未満であると報告されています。arxiv.org革新
ArXiv の論文では、長期的な LLM エージェント向けのマイルストーンベースのトレーニングを提案しています
MileGPO は、マイルストーンの発見とローカルの証拠を使用して、言語モデル エージェントを長時間の複数ステップのタスクでトレーニングする際の単位の割り当てを改善します。著者らはALFWorldとWebShopで最先端の結果を報告しているが、主張は依然として論文の実験に限定されている。arxiv.org革新
プレプリントは、LLM エージェントがいつ記憶、確認、または質問すべきかを知っているかどうかをテストします
新しいベンチマークは、言語モデルエージェントが、インタラクションから派生した情報をいつ保存、確認、一時的に使用するか、ユーザーに明確にするかを正しく決定するかどうかを評価します。arxiv.org革新
言語モデルのウォーターマークにおける言語間の公平性の監査
大規模言語モデルにおける透かし入れスキームの新しい評価フレームワークが、言語間の公平性に焦点を当てて提案されています。arxiv.orgポリシー
スタンフォード AI 指数、主権と投資の乖離に伴い AI 政策が拡大していることが判明
スタンフォード HAI の 2026 年 AI インデックスによると、国家 AI 戦略は広がりつつあるものの、データ ローカリゼーション ルール、国家支援のコンピューティング能力、公共投資は依然として地域間で不均一なままです。hai.stanford.edu革新
Together AI ベンチマーク: GLM-5.3 は最初の試行では GPT-5.6 Sol を下回り、再試行では半額で勝利
904 件の DeepSWE ロールアウトの Together AI 分析では、OpenAI の GPT-5.6 Sol が最初の試行のコーディング精度でリードし、再試行が許可されるとオープンウェイトの GLM-5.3 が試行あたりのコストの約半分でリードすることが報告されています。together.ai革新
Preprint proposes a locally tokenized AI model for robust time-series watermarking
An arXiv preprint proposes an AI generative model and watermarking method for more reliable multivariate time-series data after editing. Authors report tests across finance, energy and neuroimaging benchmarks, but the abstract gives no numerical results or evidence of deployment.arxiv.org革新
Natural Language Code Retrieval for 1C:Enterprise: An Open Benchmark and Efficient Bi-Encoder
Natural language code retrieval is a rapidly evolving task in computer science. However, the 1C:Enterprise ecosystem combines Russian syntax with highly domain-specific terminology, for which open datasets and specialized models have been virtually non-existent.arxiv.org
毎週 1 回の有益なブリーフィング
フィードに依存せずに AI に追いつきます。
今週の検証済み AI ニュース、オリジナル データ、便利なツール、おすすめの学習情報、最新の AI ジョブを入手します。
AI を学習している人々にリーチする
AI の専門家を雇いますか、それとも便利な AI 製品を立ち上げますか?それを学び、行動するためにここに来た人々の前に置きます。
AI の仕事を投稿するAIツールを提出する