Anthropic vydal Claude Opus 5, najvýkonnejší model série
Anthropic predstavil Claude Opus 5 – model, ktorý vedie rebríčky Artificial Analysis a podľa spoločnosti prináša výrazné zlepšenia v uvažovaní, kódovaní a kybernetickej bezpečnosti.
60 noviniek
Anthropic predstavil Claude Opus 5 – model, ktorý vedie rebríčky Artificial Analysis a podľa spoločnosti prináša výrazné zlepšenia v uvažovaní, kódovaní a kybernetickej bezpečnosti.
Dvadsaťpäť technologických spoločností vrátane Nvidie, Microsoftu a Mety vytvorilo koalíciu na podporu vývoja a šírenia open-weight AI modelov, čo je priamy tlak voči uzavretým modelom.
OpenAI zaviedol plne duplexný hlasový režim GPT-Live do desktopovej aplikácie ChatGPT. Funkcia umožňuje aj ovládanie agentov Codex a ChatGPT Work hlasom počas konverzácie.
Cognition AI, výrobca autonómneho kodéra Devin, akvizoval startup Poke a rozširuje tak svoj ekosystém AI nástrojov pre vývojárov.
Midjourney, known pre generovanie AI obrázkov, akvizoval populárnu astrologickú aplikáciu Co-Star a posúva sa tak mimo oblasť vizuálneho AI.
Čínski predstavitelia požadujú konkrétnejší program rokovaní o umelej inteligencii so Spojenými štátmi uprostred pretrvávajúceho technologického a obchodného napätia.
Poradca Bieleho domu zodpovedný za energetickú infraštruktúru pre AI dátové centrá opúšťa svoju pozíciu, čo vyvoláva otázky o kontinuite energetickej politiky v oblasti AI.
Izrael a Spojené kráľovstvo vymenovali dedikovaných ministrov pre umelú inteligenciu, čím posilňujú vládny záväzok k strategickému rozvoju AI a súvisiacej legislatívy.
Technická esej na GitHub (338 bodov na HN) tvrdí, že kódovacie AI agenty zlyhávajú nie pre nedostatočné nástroje, ale pre chýbajúci hlboký kontext o kódbáze a tímových konvenciách.
DARPA a US Air Force oznámili úspešný test AI-riadeného stíhacieho lietadla F-16 na základni Eglin Air Force Base. Systém VENOM Autonomy Kit konvertuje štandardné operačné lietadlá na autonómne riadenie bez akýchkoľvek zmien v základnom softvéri a umožňuje pilotom prepínať medzi manuálnym a AI riadením.
Drzitel Fieldsovej medaily Terence Tao zdielal ChatGPT rozhovor, v ktorom krok za krokom analyzuje protiklad Jacobianskej hypotezy generovany AI modelom Claude Fable. Prispevok ziskal 932 bodov na Hacker News.
Marcel Roed zverejnil GigaToken — open-source tokenizér pre jazykové modely spracúvajúci text rýchlosťou gigabajtov za sekundu. Na 72-jadrovom AMD EPYC dosahuje 5 564 Mtok/s — celý Common Crawl (130 bil. tokenov) by tokenizoval za 6,5 hodiny.
Singapurský štátny fond Temasek (400 mld. USD) tvrdí, že pokroky v AI architektúre a čipoch môžu 'drasticky zmeniť energetickú rovnicu' AI — priamo kontrujúc predpovediam o 4-násobnom náraste spotreby do 2035.
Frontier AI modely (Claude Fable, ChatGPT Sol) vyriešili desaťročia staré matematické problémy generovaním formálnych protikladov overených v Lean — tempo AI matematiky rastie na tisíce riadkov týždenne.
Kvantitatívna štúdia arXiv preprints zistila, že ~32 % nedávnych vedeckých článkov obsahuje znaky strojovo generovaného textu — Computer Science vedie s 65 %, matematika zostáva takmer nedotknutá.
Výskumník zo Searchlight Cyber použil GPT-5.6 Sol Ultra na autonómne objavenie kritického reťazca zraniteľností 'wp2shell' v jadre WordPress. Tento typ exploitu dosahuje trhové hodnoty až 500 000 dolárov, no celkové náklady na objavenie boli len 25 dolárov. WordPress vydal núdzové záplaty pre viac ako 500 miliónov webstránok.
Vedci z Université Paris Cité a Sapienza University zistili, že prístup k AI radcom znížil ochotu uznať nevedomosť z 44 % na 3 %, presnosť z 27 % na 9 %, no sebaistotu zvýšil z 30 % na 76 %. Autori navrhujú povinné 'uncertainty indicators' v AI systémoch.
Google DeepMind a Isomorphic Labs zverejnili spoločný rámec bioodolnosti využívajúci AlphaFold 3 a AlphaEvolve na urýchlenie vývoja vakcín a protilátok proti biologickým hrozbám vrátane 15+ partnerstiev so vládami a biosafety organizáciami.
Knižnica Transcribe.cpp (566 bodov na HN, 19. júl 2026) umožňuje plne lokálne AI rozpoznávanie reči s podporou 60+ modelov, Metal/CUDA/Vulkan akceleráciou a bindingmi pre Python, JS/TS, Rust aj Swift.
Anthropic pomocou novej interpretability techniky J-lens identifikoval kompaktný interný priestor v Claudovi (~25 aktívnych konceptov), ktorý zrkadlí globálnu pracovnú teóriu vedomia z neurovedy. Schopnosť ablácii tohto priestoru kolabuje viacstupňové uvažovanie modelu.
Mozilla vydal prvú výročnú správu 'State of Open Source AI', ktorá zisťuje, že výkonnostná medzera medzi open-weight a uzavretými modelmi klesla na 3 %, náklady na inferenciu klesli až 50-násobne za tri roky, ale otvorené modely napriek tomu generujú len 4 % trhových príjmov.
V Kaggle hackathone organizovanom Google DeepMind na meranie AGI pokroku vyhral Grand Prize príspevok, ktorý komunita označila ako AI-generovaný slop bez skutočnej odbornej práce — otvorilo to debatu o integritu AI benchmarkov.
Výskumníci z Ant Group, Renmin University a Tsinghua University škálovali Zero RL na 1 bilión parametrov bez ľudských anotácií. Spontánne vzniklo 5 emergentných schopností vrátane context anxiety — model sám riadi spotrebu kontextového okna v reálnom čase.
CNBC 13. júla zverejnil výskum ukazujúci, že po nástupe ChatGPT prudko stúpol podiel starších bielolímcových zamestnancov (55+) opúšťajúcich pracovný trh — AI akceleruje nedobrovoľné odchody v technologickom sektore.
Nová práca na arXiv varuje, že kým AI systémy produkujú legitímnu matematiku, USA súčasne škrtí podporu ľudských matematikov — vzniká kritická verifikačná medzera, ktorú nie je možné rýchlo zaplniť.
Communications of the ACM publikoval prehľad mechanistickej interpretability, ktorý vysvetľuje, ako výskumníci aplikujú formálnu teóriu kauzality na odhaľovanie reasoning pathways priamo v transformerových váhach.
Štúdia Microsoftu a Carnegie Mellon University (319 znalostných pracovníkov) odhalila, že intenzívne využívanie AI koreluje s merateľným poklesom kritického myslenia a samostatného riešenia problémov. Vedci zavádzajú pojem 'kognitívny dlh' pre zručnosti erodované delegovaním na AI.
Projekt Mesh LLM umožňuje zdieľanie GPU výkonu medzi viacerými strojmi cez protokol iroh — výsledok sa javí ako lokálne OpenAI-kompatibilné API na adrese localhost:9337.
Podľa Cloudflare Radar a ďalších zdrojov dnes AI agenti a crawlery generujú väčšinu webovej prevádzky – ľudia sú v menšine.
Držiteľ Fieldsovej medaily Terence Tao opisuje praktické skúsenosti s AI coding agentmi pri tvorbe matematických vizualizácií – čo fungovalo a čo nie.
Deň po globálnom sprístupnení Sol Ultra OpenAI oznámil, že model pomocou 64 paralelných subagentov vyprodukoval za menej ako hodinu dôkaz Cycle Double Cover Conjecture — jedného z najvýznamnejších otvorených problémov v teórii grafov. Dôkaz aj prompt sú verejne dostupné.
Štúdia v Nature ukázala, že LLM predikujú výsledky 70 predregistrovaných sociálnych experimentov (119 330 účastníkov) s koreláciou r=0,83 — pre veľké experimenty prekonávajú expertných ľudských prognóstikov.
Tím vedený Kevinom Buzzardom z Imperial College London používa AI na zabudovanie Fermátovej poslednej vety do proof assistenta Lean — kódová základňa sa zdvojnásobila na prvý deň workshopu.
Výskumníci z EPFL publikovali NEvo — framework kombinujúci evolučné vyhľadávanie s AI generovaním videa na syntézu stimulov, ktoré prekonávajú ručne vytvorené lokalizačné videá v aktivácii zrakového kortexu.
OpenAI zistil, že SWE-bench Verified — najpopulárnejší benchmark pre AI kódovanie — trpí kontamináciou a dizajnovými chybami a neodráža reálne schopnosti modelov.
Profesor ekonometrie Roberto Serrano nariadil záverečnú skúšku osobne po tom, ako 40 z 86 študentov dostalo na domácej skúške dokonalú stovku; osobný priemer klesol na 48.
Databricks zverejnil výsledky interného benchmarku kódovacích agentov na reálnom kóde firmy s miliónmi riadkov v Pythone, Go, TypeScripte a Scale. OpenAI, Anthropic a GLM-5.2 sú na Pareto frontiere, pričom GLM-5.2 je výrazne lacnejší.
Microsoft uvoľnil ako open-source Flint — vizualizačný medzijazyk, ktorý pomáha AI agentom generovať spoľahlivé grafy opisom sémantiky namiesto závislosti na systémových predvolenostiach.
Anthropic zverejnil výskum, v ktorom Claude spontánne vyvinul vnútornú štruktúru J-space zodpovedajúcu neurovede teórii globálneho pracovného priestoru. Objav mení spôsob, akým spoločnosť monitoruje bezpečnostné riziká.
Medzinárodná konferencia o strojovom učení 2026 sa otvorila 6. júla v Soule s rekordnými 23 918 príspevkami — viac ako dvojnásobok minulého roka. Bezpečnosť agentického AI je ústrednou témou.
Anthropic ohlásil interné programy objavu liekov zamerané na zanedbané choroby, čím rozšíril dopad akvizície Coefficient Bio za 400 miliónov USD. Claude Science workbench s 60+ vedeckými nástrojmi je teraz dostupný v beta.
Vedecká štúdia z Dartmouth University publikovaná na HN ukázala, že nový AI tutor dosiahol veľkosť efektu 0,71–1,30 štandardnej odchýlky v zlepšení výsledkov učenia. Ide o jeden z najvyšších efektov zaznamenaných pre vzdelávacie technológie.
Prieskum VentureBeat zistil, že 88 % firiem zaznamenalo bezpečnostný incident s AI agentom za posledný rok. Len 12 % dokáže automaticky zastaviť hrozby tretej fázy — eskaláciu práv, exfiltráciu dát a laterálny pohyb agentov.
Epoch.ai zdokumentovala bezprecedentný nárast vysokých a kritických CVE v júni 2026: okolo 1 500, čo je 3,5-násobok predchádzajúceho rekordu. Analýza to priamo spája s AI-asistovaným odhaľovaním bugov cez Project Glasswing s modelom Claude Mythos.
Podrobná analýza agentických AI workflow od Dana Luua: výber testovacích metód (fuzzing) prekonáva výber modelu, modely majú vysokú variabilitu medzi úlohami a plne autonómne agenty zlyhávajú pri iteratívnej analýze dát bez ľudského dohľadu.
OpenAI zverejnil GeneBench-Pro — 129 výskumných úloh z genomiky, kvant. biológie a translačnej medicíny. Najlepší model GPT-5.6 Sol dosiahol 31,5 %, Claude Opus 4.8 len 16 %, Gemini 3.5 Flash 8,1 %.
Praktický framework pre vývojárov pracujúcich s AI kódovacími agentmi: nikdy YOLO mode, commit po každej podúlohe, povinný AI aj ľudský review každého PR. Príspevok na HN získal 146 bodov uprostred diskusie o náste produkčných incidentov.
Snorkel AI spustil Senior SWE-Bench so 156 reálnymi úlohami z pull requestov, kde agenti musia diagnostikovať bugy a dodržiavať kódovacie konvencie. Najlepší model (Claude Opus 4.8) dosiahol len 24 %.
Anthropic vysiela 30. júna naživo podujatie, ktoré ukazuje, ako sa Claude nasadzuje vo farmácii, biotechu a akademickom výskume, s ukážkami produktov a prípadovými štúdiami od popredných inštitúcií z oblasti vied o živote.
Projekt vLLM zverejnil technický článok, podľa ktorého malé open modely zoskupené do ohraničených „micro-agent" runtime priamo v servingovej vrstve dokážu na reálnych úlohách dosiahnuť alebo prekonať špičkové uzavreté modely pri zlomku nákladov.
DeepSeek otvoril DSpark — framework na speculative decoding, ktorý zrýchľuje generovanie V4 Flash o 60-85 % bez akéhokoľvek pretrénovania modelu. Kód je v open-source pod MIT licenciou.
Faros AI z dát 22 000 vývojárov v 4 000 tímoch ukazuje, že produkcia kódu s AI rastie, no chyby a incidenty rastú ešte rýchlejšie - report nazvaný Acceleration Whiplash.
Hĺbková analýza IEEE Spectrum mapuje, ako frontier modely teraz dokazujú netriviálne matematické tvrdenia a aké to vyvoláva existenčné otázky o povahe matematickej kreativity a verifikácie.
Hĺbková analýza tvrdí, že open-weight modely (Llama, Qwen, DeepSeek, GLM) sa rapidne približujú k closed-source frontier — s konkrétnymi benchmarkmi a implikáciami pre enterprise nasadenie.
Xiaomi predstavila HarnessX — framework, ktorý chápe agent harness ako komponovateľný objekt a model si ho môže autonómne prepisovať počas úlohy. Menšie modely z tejto self-modifikácie získavajú najviac.
Nvidia investuje do safety výskumu a simulačných nástrojov, aby humanoidné roboty zvládli split-second rozhodnutia spoľahlivo predtým, ako sa nasadia po boku ľudí.
Štúdia 235 000 používateľov za 7 mesiacov ukazuje, že experti dostávajú z Claude Code 2× častejšie verifikovaný úspech ako začiatočníci — rozhoduje doménová expertíza, nie programátorská.
Andrew Marble argumentuje, že prechod z Claude/GPT na otvorené modely má dnes výrazne menšie kariérne riziko než kedysi cez Windows → Linux. Náskok najlepších proprietárnych modelov sa stenčil a verifikačné požiadavky na proprietárne API môžu adopciu open weights paradoxne tlačiť dopredu.
Tenet Security odhalil novú triedu útokov, ktorá cez manipulované Sentry error reporty vykonáva príkazy v Claude Code, Cursor a Codex. 85 % exploit rate, 100+ úspešných agentov vrátane Fortune 500.
Praktický návod, ktorý sa 21. júna dostal na vrch Hacker News, ukazuje ako lokálne fine-tunovať malé modely Qwen 3:0.6B na kategorizáciu otázok. Autor dosiahol slušné výsledky na bežnom hardware — pripomienka, že nie každý use case potrebuje frontier model.