毎日更新2396 検証済みのストーリー

AIニュース。 ノイズなしで。

製品の発売、政策の変更、安全性研究、業界の動向についてソースチェックされた AI の報道が、非営利教育チームによって平易な英語で説明されます。

検証済みの調達

すべてのストーリーは、入手可能な最強の証拠、つまり入手可能な場合はオリジナルの情報源、それ以外の場合は明らかに帰属が明記された報道にリンクしています。

平易な英語

何が起こったのか、なぜそれが重要なのか、何を観るべきなのかを、専門用語を使わずに説明します。

フィラーなし

信号が薄い場合は、フィードをパディングするだけで何も公開しません。

9 物語
  1. 革新革新7 min 読む

    ベンチマークによると、上位のマルチモーダル モデルは、ペンの音と手の動きから単語を読み取る際のスコアが 10% 未満である

    新しい arXiv 論文では、インクが見えない状態で、モデルがペンで擦る音声と手の動きのビデオから書かれた単語を推測するテストが紹介されています。著者らは、人間の順序文字精度は 80% 以上で、主要なモデルは 10% 以下であり、モデルに両方のモダリティを与えると結果が悪化することが多いと報告しています。arxiv.org
  2. 革新革新7 min 読む

    Paper は、より強力なモデルへの収束を測定することにより、ラベルを使用せずに AI セキュリティ エージェントを評価することを提案しています

    新しい arXiv プレプリントでは、セキュリティ チームは、不足または古いことが多いラベル付きのベンチマークではなく、より強力な「教師」モデルとのギャップをどの程度縮めるかを測定することで、メモリまたは検索機能を備えた AI エージェントが学習しているかどうかを判断できると主張しています。同様のパワーを備えたモデルから判断すると、使用可能な信号は得られませんでした。arxiv.org

毎週 1 回の有益なブリーフィング

フィードに依存せずに AI に追いつきます。

今週の検証済み AI ニュース、オリジナル データ、便利なツール、おすすめの学習情報、最新の AI ジョブを入手します。

Send me
One email a week. Switch any time.

AI を学習している人々にリーチする

AI の専門家を雇いますか、それとも便利な AI 製品を立ち上げますか?それを学び、行動するためにここに来た人々の前に置きます。

AI の仕事を投稿するAIツールを提出する