Google adds AI study tools to Search, including quizzes, Lens coaching and notebooks
Google says Search is adding five education features: interactive visuals, practice quizzes, Lens-based guidance, AI Mode notebooks and custom study files.
Aktualizowane codziennie1795 sprawdzone historie
Relacje AI sprawdzone przez źródła dotyczące premier produktów, zmian polityk, badań nad bezpieczeństwem oraz działań branżowych, wyjaśnione prostym językiem przez zespół edukacyjny organizacji non-profit.
Każda historia odnosi się do najsilniejszych dostępnych dowodów: oryginalnych źródeł, gdy są dostępne, innych wyraźnie przypisanych relacji.
What happened, why it matters, and what to watch — without the jargon.
Kiedy sygnał jest słaby, nie publikujemy niczego, zamiast uzupełniać kanał.
Source-checked AI stories, newest first, for people who need to understand AI without chasing hype.
Google says Search is adding five education features: interactive visuals, practice quizzes, Lens-based guidance, AI Mode notebooks and custom study files.
Apple researchers present a formal complexity result for evaluating Boolean query DAGs over inverted indexes and propose ComputePN, an algorithm designed to avoid exponential query expansion and universe-scale scans.
NVIDIA SkillEvaluator measures the impact of verified skills on AI agent performance through a three-tier evaluation process.
A 24-author preprint had frontier AI agents attempt the central research questions of two unpublished NeurIPS 2026 submissions, then had the papers' own authors grade the results. The agents handled the engineering unaided over six days but were unambiguously rejected on the research.
Warp is taking early-access requests for Warp Factories, which defines fleets of coding agents as code — repos, models, permissions and human checkpoints in one YAML file, driven by CLI, API, SDK and MCP. Its automation and cost figures are vendor claims: no pricing, general availability date or independent testing.
W nowym artykule arXiv wprowadzono test, w którym modele muszą wywnioskować słowo pisane na podstawie dźwięku rysowanego piórem i wideo poruszającego ręką, bez widocznego atramentu. Autorzy podają, że dokładność liter w przypadku ludzi przekracza 80%, a modele wiodące poniżej 10%, a dawanie modelom obu modalności często pogarszało wyniki.
Nowy wydruk arXiv opisuje CacheScout, warstwę zbudowaną na serwerze vLLM typu open source, która decyduje, co zachować w pamięci podręcznej klucz-wartość modelu, w zależności od tego, który agent prawdopodobnie zostanie uruchomiony jako następny. Autorzy zgłaszają dwucyfrowy wzrost opóźnień i przepustowości; obciążenia, modele i sprzęt nie są wymienione w streszczeniu.
Dwóch badaczy twierdzi, że dowód lematu w rozdziale 6 dokumentu matematycznego OpenAI zawiera błąd polaryzacji: test pod względem średniego sukcesu, w którym następny krok wymaga dużego warunkowego niepowodzenia. Podają kontrprzykład i poprawiony dowód oraz ostrzegają, że nie jest to weryfikacja głównego twierdzenia rozdziału.
Przedruk wykonany przez dwóch badaczy odtwarza wcześniejsze badanie dotyczące tego, dlaczego równa liczba FLOPów nie oznacza równego czasu wykonania. Potwierdza podstawowe twierdzenie, ale informuje, że formuła korekcji α-FLOPs generalnie nie docenia czasu działania na nowszym sprzęcie, co pokazuje skoki i oscylacje, których formuła nie wychwytuje.
Nowy preprint arXiv porównuje ze sobą cztery architektury zapytań do korporacyjnych baz danych w języku naturalnym w syntetycznym teście dwujęzycznym. Żaden z nich nie odpowiedział poprawnie na więcej niż jedną czwartą przypadków, a projekt, który uzyskał najwyższą ocenę, nie był najbezpieczniejszy ani najtańszy.
Nowy wydruk wstępny arXiv dowodzi, że zespoły ds. bezpieczeństwa mogą ocenić, czy agent AI wyposażony w pamięć lub funkcję odzyskiwania uczy się, mierząc, w jakim stopniu zmniejsza to lukę w stosunku do silniejszego modelu „nauczyciela”, a nie na podstawie oznaczonych etykietami testów porównawczych, które są często rzadkie lub nieaktualne. Sądząc po modelu o podobnej mocy, nie dał on żadnego użytecznego sygnału.
Raport techniczny 17 autorów opublikowany w arXiv przedstawia MobileMem, punkt odniesienia i platformę dla długoterminowej pamięci urządzenia zbudowanej na podstawie rocznej kolekcji doświadczeń mobilnych. Streszczenie opisuje projekt, ale nie podaje żadnych wyników, a kluczowe szczegóły dotyczące podstawowych danych pozostają nieujawnione.
Jedno przydatne briefing co tydzień
Otrzymuj zweryfikowane wiadomości o AI na ten tydzień, oryginalne dane, przydatne narzędzia, wskazówki edukacyjne oraz świeże oferty pracy w AI.
Zatrudniasz specjalistę od AI czy wprowadzasz na rynek przydatny produkt AI? Pokaż to ludziom, którzy przyjechali tu, by się uczyć i działać.
Opublikuj pracę w AI Prześlij narzędzie AI