George Hotz: Milujem LLM-y, nenavídím hype
Zakladateľ Comma.ai tvrdí, že pokrok AI pochádza primárne z Moorovho zákona a všeobecného výpočtového výkonu, nie od frontových laboratórií, ktoré preháňajú príspevky na odôvodnenie masívneho fundraisingu.
60 noviniek
Zakladateľ Comma.ai tvrdí, že pokrok AI pochádza primárne z Moorovho zákona a všeobecného výpočtového výkonu, nie od frontových laboratórií, ktoré preháňajú príspevky na odôvodnenie masívneho fundraisingu.
Tokijské AI laboratórium Sakana AI vydalo Fugu — multi-agentový orchestrátor zabalený ako OpenAI-kompatibilné API. Systém koordinuje výstupy z viacerých frontier modelov a dosahuje frontier výkon bez závislosti na US modeloch podliehajúcich exportným kontrolám.
Nová práca na arXiv varuje, že kým AI systémy produkujú legitímnu matematiku, USA súčasne škrtí podporu ľudských matematikov — vzniká kritická verifikačná medzera, ktorú nie je možné rýchlo zaplniť.
Communications of the ACM publikoval prehľad mechanistickej interpretability, ktorý vysvetľuje, ako výskumníci aplikujú formálnu teóriu kauzality na odhaľovanie reasoning pathways priamo v transformerových váhach.
Štúdia Microsoftu a Carnegie Mellon University (319 znalostných pracovníkov) odhalila, že intenzívne využívanie AI koreluje s merateľným poklesom kritického myslenia a samostatného riešenia problémov. Vedci zavádzajú pojem 'kognitívny dlh' pre zručnosti erodované delegovaním na AI.
Viacero Waymo robotaxi zostalo bez energie a muselo byť odvlečené počas dopravnej zácpy na 4. júla v San Franciscu — supervisor mesta Bilal Mahmood teraz žiada formálne vyšetrovanie dopadu autonómnych vozidiel na verejnú dopravu.
Projekt Mesh LLM umožňuje zdieľanie GPU výkonu medzi viacerými strojmi cez protokol iroh — výsledok sa javí ako lokálne OpenAI-kompatibilné API na adrese localhost:9337.
Podľa Cloudflare Radar a ďalších zdrojov dnes AI agenti a crawlery generujú väčšinu webovej prevádzky – ľudia sú v menšine.
ByteDance 8. júla vydal Seedream 5.0 Pro — profesionálny image model s natívnym 2K výstupom, vrstvovou separáciou, presným editovaním a vykresľovaním textu vo viac ako 10 jazykoch.
Držiteľ Fieldsovej medaily Terence Tao opisuje praktické skúsenosti s AI coding agentmi pri tvorbe matematických vizualizácií – čo fungovalo a čo nie.
Meta 9. júla 2026 spustila Muse Spark 1.1, prvý komerčný platený model spoločnosti s API za 1,25/4,25 dolára na milión tokenov. Model Superintelligence Labs ponúka 1M kontextové okno a agentické schopnosti vrátane computer use.
Deň po globálnom sprístupnení Sol Ultra OpenAI oznámil, že model pomocou 64 paralelných subagentov vyprodukoval za menej ako hodinu dôkaz Cycle Double Cover Conjecture — jedného z najvýznamnejších otvorených problémov v teórii grafov. Dôkaz aj prompt sú verejne dostupné.
Štúdia v Nature ukázala, že LLM predikujú výsledky 70 predregistrovaných sociálnych experimentov (119 330 účastníkov) s koreláciou r=0,83 — pre veľké experimenty prekonávajú expertných ľudských prognóstikov.
Tím vedený Kevinom Buzzardom z Imperial College London používa AI na zabudovanie Fermátovej poslednej vety do proof assistenta Lean — kódová základňa sa zdvojnásobila na prvý deň workshopu.
OpenAI 9. júla 2026 predstavilo tri nové modely GPT-5.6 a produkt ChatGPT Work — agentický asistent pre dlhodobé pracovné úlohy, priamo konkurujúci Claude Cowork.
Artificial Analysis zistil, že Grok 4.5 zdvojnásobil mieru halucinácie z 25 % na 54 % oproti Grok 4.3, hoci presnosť vzrástla. Model skončil 4. na Intelligence Indexe.
Vývojár vforno vytvoril Colibrì — systém streamovania aktívnych expertov z disku, ktorý umožňuje spustiť obrovský MoE model GLM 5.2 na bežnom počítači pri výkone 0,1 tok/s.
Výskumníci z EPFL publikovali NEvo — framework kombinujúci evolučné vyhľadávanie s AI generovaním videa na syntézu stimulov, ktoré prekonávajú ručne vytvorené lokalizačné videá v aktivácii zrakového kortexu.
SpaceXAI vydal Grok 4.5 — prvý AI model vyvinutý spoločne s Cursorom, zameraný na kódovanie, právne analýzy a finančný výskum. V EÚ zatiaľ nedostupný.
OpenAI potvrdil globálne vydanie GPT-5.6 Sol na štvrtok 10. júla po tom, ako vláda USA zrušila obmedzenia, ktoré limitovali prístup len na overených partnerov.
Cognition vydal SWE-1.7 — coding agent trénovaný na báze Kimi K2.7 s výkonom blízko GPT-5.5 na FrontierCode, bežiaci pri 1 000 TPS za $1,97/úlohu cez Devin.
Robotický startup General Intuition získal $320 miliónov pri valuácii $2,3 miliardy. CEO Pim de Witte verí, že robotika prechádza podobným zlomovým momentom ako NLP po GPT-3, pričom kľúčom sú herné dáta namiesto reálnych robotických dát.
Mistral predstavil Robostral Navigate — 8B model, ktorý umožňuje autonómnu navigáciu robotov pomocou jedinej RGB kamery a prirodzených inštrukcií, bez LiDARu alebo hĺbkového senzora.
OpenAI zistil, že SWE-bench Verified — najpopulárnejší benchmark pre AI kódovanie — trpí kontamináciou a dizajnovými chybami a neodráža reálne schopnosti modelov.
Google DeepMind odložil vydanie Gemini 3.5 Pro na 17. júla 2026, pričom existujúca 2.5 Pro architektúra bola vyhodená v prospech kompletného prepracovania zameraného na matematické uvažovanie a kvalitu obrazu. Model zostáva v limitovanom Vertex AI enterprise preview.
Profesor ekonometrie Roberto Serrano nariadil záverečnú skúšku osobne po tom, ako 40 z 86 študentov dostalo na domácej skúške dokonalú stovku; osobný priemer klesol na 48.
Databricks zverejnil výsledky interného benchmarku kódovacích agentov na reálnom kóde firmy s miliónmi riadkov v Pythone, Go, TypeScripte a Scale. OpenAI, Anthropic a GLM-5.2 sú na Pareto frontiere, pričom GLM-5.2 je výrazne lacnejší.
Lovable — populárna platforma pre vibe-coding a AI app building — je podľa správ TechCrunch v rokovaniach o novom raunde, ktorý by zdvojnásobil jej valuáciu na 13,2 mld. USD.
Prime Intellect, startup poskytujúci GPU výpočtový výkon a softvér na vývoj proprietárnych AI agentov, získal Series A raund $130 mil. pri valuácii 1 mld. USD.
Microsoft uvoľnil ako open-source Flint — vizualizačný medzijazyk, ktorý pomáha AI agentom generovať spoľahlivé grafy opisom sémantiky namiesto závislosti na systémových predvolenostiach.
SambaNova Systems dokončila prvý close Series F kola vo výške 1 mld. USD pri valuácii 11 mld. USD vedenom General Atlantic. JPMorgan Chase zároveň nasadil jej servery SN40 a SN50 pre on-premise AI inferenciu.
Meta predstavila Muse, AI generátor obrázkov od Meta Superintelligence Labs, dostupný zadarmo cez Meta AI apku a integrovaný v Instagram Stories a WhatsApp.
Tencent Hunyuan vydal 6. júla Hy3, open-source MoE model s 295B parametrami (len 21B aktívnych), 256K kontextom a Apache 2.0 licenciou — bez geografických obmedzení.
Norm, AI-natívna právna firma využívajúca vlastných AI agentov pod dozorom ľudských advokátov, uzavrela Series C od Khosla Ventures pri valuácii 1,2 mld. USD.
Anthropic zverejnil výskum, v ktorom Claude spontánne vyvinul vnútornú štruktúru J-space zodpovedajúcu neurovede teórii globálneho pracovného priestoru. Objav mení spôsob, akým spoločnosť monitoruje bezpečnostné riziká.
Medzinárodná konferencia o strojovom učení 2026 sa otvorila 6. júla v Soule s rekordnými 23 918 príspevkami — viac ako dvojnásobok minulého roka. Bezpečnosť agentického AI je ústrednou témou.
Station F (Paríž) spúšťa druhý kohort svojho F/ai akcelerátora v septembri 2026. Prvý kohort spoločne získal 34 mil. USD v pred-seed financovaní — Station F sa etabluje ako popredný európsky AI launchpad.
Anthropic ohlásil interné programy objavu liekov zamerané na zanedbané choroby, čím rozšíril dopad akvizície Coefficient Bio za 400 miliónov USD. Claude Science workbench s 60+ vedeckými nástrojmi je teraz dostupný v beta.
V prvom polroku 2026 dosiahlo unicorn status takmer 90 startupov, viac ako dvojnásobok tempa roka 2025. Promethus (co-founded Bezos) získal 12 mld. USD Series B — najväčšiu jednotlivú investičnú rundu v histórii.
CEO Mistral Arthur Mensch potvrdil, že firma v júli 2026 otvorí early access k novému vzrušujúcemu open-weight modelu. Mistral zároveň rokuje o 3,5 mld. USD raunde pri valuácii 23 mld. USD.
Vedecká štúdia z Dartmouth University publikovaná na HN ukázala, že nový AI tutor dosiahol veľkosť efektu 0,71–1,30 štandardnej odchýlky v zlepšení výsledkov učenia. Ide o jeden z najvyšších efektov zaznamenaných pre vzdelávacie technológie.
GitHub issue s 107 bodmi na HN dokumentuje sťažnosti vývojárov na zhoršenú kvalitu výstupu GPT-5.5 Codex. Hypotéza komunity: RL post-training spôsobil nežiaduci clustering reasoning tokenov, čo degraduje kódovacie výstupy.
Autor Flasku Armin Ronacher dokumentuje paradox: nové Claude modely (Sonnet 5, Opus 4.8) sú menej spoľahlivé pri nestandardných tool schemas a pridávajú polia, ktoré schema neobsahuje — zrejme dôsledok RL tréningom viazaného na Claude Code harness.
Šéf AI v Meta Alexandr Wang na internom town halle vyhlásil, že nový model 'Watermelon' dosiahol výkon porovnateľný s GPT-5.5 na kľúčových benchmarkoch — prvé interné uznanie, že Meta naháňa výkonnostnú úroveň OpenAI.
Prieskum VentureBeat zistil, že 88 % firiem zaznamenalo bezpečnostný incident s AI agentom za posledný rok. Len 12 % dokáže automaticky zastaviť hrozby tretej fázy — eskaláciu práv, exfiltráciu dát a laterálny pohyb agentov.
Mistral AI vydal Leanstral 1.5, open-source (Apache-2.0) model špecializovaný na formálne dôkazy v Lean 4. So 119B celkovými a len 6B aktívnymi parametrami dosahuje 100 % na miniF2F a vyrieši 587 z 672 PutnamBench matematických problémov.
Epoch.ai zdokumentovala bezprecedentný nárast vysokých a kritických CVE v júni 2026: okolo 1 500, čo je 3,5-násobok predchádzajúceho rekordu. Analýza to priamo spája s AI-asistovaným odhaľovaním bugov cez Project Glasswing s modelom Claude Mythos.
Podrobná analýza agentických AI workflow od Dana Luua: výber testovacích metód (fuzzing) prekonáva výber modelu, modely majú vysokú variabilitu medzi úlohami a plne autonómne agenty zlyhávajú pri iteratívnej analýze dát bez ľudského dohľadu.
Apple vydal Safari MCP Server — nástroj umožňujúci AI agentom priamo sa pripojiť k Safari oknám a autonómne testovať, debugovať a inšpektovať webové aplikácie. Vyžaduje Safari Technology Preview 247. Beží lokálne bez externých sieťových volaní.
OpenAI zverejnil GeneBench-Pro — 129 výskumných úloh z genomiky, kvant. biológie a translačnej medicíny. Najlepší model GPT-5.6 Sol dosiahol 31,5 %, Claude Opus 4.8 len 16 %, Gemini 3.5 Flash 8,1 %.
Crusoe — prevádzkovateľ AI dátacentier s kontraktmi pre Meta a Oracle — rokuje o investičnom raunde vo výške 3 miliárd USD, ktorý by strojnásobil valuáciu firmy na 30 miliárd USD. Crusoe má 4,9 GW podpísaných kontraktov.
Kling AI, spin-off čínskej video platformy Kuaishou, získal počiatočných 2 mld. USD na expanziu AI generovania videa — jedna z najväčších čínskych AI transakcií v roku 2026.
Praktický framework pre vývojárov pracujúcich s AI kódovacími agentmi: nikdy YOLO mode, commit po každej podúlohe, povinný AI aj ľudský review každého PR. Príspevok na HN získal 146 bodov uprostred diskusie o náste produkčných incidentov.
Americké ministerstvo obchodu zrušilo 18-dňové exportné obmedzenia na vlajkové modely Anthropicu. Komerčný prístup k Fable 5 a Mythos 5 je od 1. júla 2026 obnovený globálne pre všetkých zákazníkov.
Anthropic uviedol Claude Sonnet 5 s natívnym 1M kontextovým oknom a promo cenami $2/$10 za milión tokenov do 31. augusta 2026 — o 60 % lacnejšie ako Fable. Model sa stal predvoleným pre Free a Pro používateľov.
Anthropic spustil Claude Science, aplikáciu integrujúcu 60+ vedeckých databáz (genomika, proteomika, cheminformatika) do jedného AI pracovného priestoru s auditovateľnými artefaktmi. Pridáva grantový program do 30 000 USD.
Google vydal Gemini Omni Flash pre konverzačnú tvorbu a editáciu videa a Nano Banana 2 Lite (Gemini 3.1 Flash-Lite Image) pre enterprise generovanie obrázkov za 4 sekundy a 0,034 USD za 1 000 obrázkov — dostupné cez Gemini API a Google AI Studio.
Snorkel AI spustil Senior SWE-Bench so 156 reálnymi úlohami z pull requestov, kde agenti musia diagnostikovať bugy a dodržiavať kódovacie konvencie. Najlepší model (Claude Opus 4.8) dosiahol len 24 %.
AI video model HappyHorse 1.1 od Alibaba Cloud predbehol v globálnych benchmarkoch Sorou aj ByteDance Seedance. Model je teraz dostupný cez Alibaba Cloud Model Studio s plným API prístupom.
Platforma Venice AI zameraná na súkromie vyzbierala 65 mil. USD Series A pri valuácii 1 mld. USD — prvé externé financovanie po organickom raste na 3 milióny aktívnych používateľov. Platforma retenuje nulové dáta z 200+ AI modelov.