28,9 miliónov parametrov LLM beží na 8-dolárovom mikrokontroléri ESP32
Open-source projekt ukazuje, že 28,9-miliónový jazykový model je možné spustiť priamo na ESP32 mikrokontroléri za 8 dolárov bez cloudu, offline, priamo na čipe.
60 noviniek
Open-source projekt ukazuje, že 28,9-miliónový jazykový model je možné spustiť priamo na ESP32 mikrokontroléri za 8 dolárov bez cloudu, offline, priamo na čipe.
Nový open-source model Inflect-Micro-v2 zvláda celý TTS pipeline v iba 9,36 miliónoch parametrov -- radikálne menej ako bežné hlasové modely, pričom beží lokálne na edge zariadeniach.
Spoluzakladateľ Mesosphere Tobi Knaup prirovnáva vzostup open-weight AI modelov ku Kubernetes: základ je dostatočne dobrý na to, aby okolo neho narástol celý ekosystém nástrojov, runtime prostredí a infraštruktúry.
Anthropic zverejnil podrobného sprievodcu context engineeringom pre Claude 5 modely — vrátane Claude Opus 5 a Claude Sonnet 5 — s praktickými odporúčaniami pre dlhé kontexty, hierarchie inštrukcií a správu pamäte agentov.
xAI 15. júla 2026 zverejnil zdrojový kód Grok Build — svojho agenckého coding nástroja s terminálnym rozhraním — na GitHub. Projekt je ~1 milión riadkov Rust kódu.
Moonshot AI vydá 27. júla otvorené váhy 2,8 biliónového modelu Kimi K3. Nezávislé testy odhalili 51 % mieru halucinácií, ktorú firma vynechala zo svojich benchmarkových grafov.
Google 24. júla 2026 rozšíril prístup k Gemini Spark — svojmu autonómnemu AI agentovi — z exkluzívneho AI Ultra tieru (100–200 $/mes.) na všetkých predplatiteľov AI Pro v USA (20 $/mes.).
Nový ARC-AGI-3 benchmark, testujúci schopnosť AI agentov adaptovať sa na nové interaktívne prostredie v reálnom čase, vedie Claude Opus 5 so skóre 30,2 %. Na pôvodnom ARC-AGI-2 dominuje GPT-5.5 s 85 % úspešnosťou.
Bezpečnostný výskumník objavil, že IP kamera od Hanwha obsahovala GitHub admin token priamo v zdrojovom kóde prihlasovacej stránky, čím poskytla úplný prístup k firemným repozitárom.
OpenAI 9. júla 2026 spustil ChatGPT Work — agenta v rámci ChatGPT, ktorý preberá celé projekty naprieč aplikáciami, pracuje na nich hodiny bez ďalšieho vstupu a vracia hotové tabuľky, prezentácie, dokumenty či webové aplikácie.
TracerML spustil Echo — systém dynamicky vyberá a kombinuje open-weight modely a dosahuje výsledky porovnateľné s Anthropic Fable za zhruba tretinu ceny. Na Hacker News získal 402 bodov.
Black Forest Labs vydal FLUX 3, multimodálny model trénovaný end-to-end naprieč obrazom, videom (až 20 sekúnd) a zvukom. Na rozdiel od predošlých systémov skladaných z viacerých modelov je FLUX 3 trénovaný spoločne cez všetky modality súčasne. Spúšťa sa v obmedzenom prístupe.
Technická esej na GitHub (338 bodov na HN) tvrdí, že kódovacie AI agenty zlyhávajú nie pre nedostatočné nástroje, ale pre chýbajúci hlboký kontext o kódbáze a tímových konvenciách.
DARPA a US Air Force oznámili úspešný test AI-riadeného stíhacieho lietadla F-16 na základni Eglin Air Force Base. Systém VENOM Autonomy Kit konvertuje štandardné operačné lietadlá na autonómne riadenie bez akýchkoľvek zmien v základnom softvéri a umožňuje pilotom prepínať medzi manuálnym a AI riadením.
Drzitel Fieldsovej medaily Terence Tao zdielal ChatGPT rozhovor, v ktorom krok za krokom analyzuje protiklad Jacobianskej hypotezy generovany AI modelom Claude Fable. Prispevok ziskal 932 bodov na Hacker News.
Tim Cactus post-trenoval Google Gemma 4 2B s 68 000-parametrovou sondou citajucou skryte stavy a predpovedajucou p(wrong). Len 15-35 % dotazov musi eskalovat do cloudu pri zachovani vykonnosti frontier modelu. MIT licencia.
Neziskova open-source git platforma Codeberg zakazuje pouzitie uzivatelskych dat na trening LLM modelov a odradzuje od hostovania projektov generovanych prevazne AI. Rozhodnutie schvalila komunita.
Marcel Roed zverejnil GigaToken — open-source tokenizér pre jazykové modely spracúvajúci text rýchlosťou gigabajtov za sekundu. Na 72-jadrovom AMD EPYC dosahuje 5 564 Mtok/s — celý Common Crawl (130 bil. tokenov) by tokenizoval za 6,5 hodiny.
Poolside vydal 118B parametrový MoE model Laguna S 2.1 s 1M tokenovým kontextom, tréningom od základov za 9 týždňov, dostupný zadarmo na Hugging Face — prekonáva DeepSeek-V4-Flash na kódovacích benchmarkoch.
Singapurský štátny fond Temasek (400 mld. USD) tvrdí, že pokroky v AI architektúre a čipoch môžu 'drasticky zmeniť energetickú rovnicu' AI — priamo kontrujúc predpovediam o 4-násobnom náraste spotreby do 2035.
Frontier AI modely (Claude Fable, ChatGPT Sol) vyriešili desaťročia staré matematické problémy generovaním formálnych protikladov overených v Lean — tempo AI matematiky rastie na tisíce riadkov týždenne.
Kvantitatívna štúdia arXiv preprints zistila, že ~32 % nedávnych vedeckých článkov obsahuje znaky strojovo generovaného textu — Computer Science vedie s 65 %, matematika zostáva takmer nedotknutá.
Nativ je bezplatná open-source macOS aplikácia postavená natívne na Apple MLX, ktorá spúšťa frontier open-weight modely (text, obraz, video, kód) lokálne na Apple Silicon bez akýchkoľvek účtov.
Alibaba na WAIC 2026 v Šanghaji odhalila Qwen 3.8-Max-Preview — multimodálny model s 2,4 biliónom parametrov. Spoločnosť tvrdí, že model zaostáva len za Claude Fable 5, no nezverejnila nezávislé benchmarky.
Výskumník zo Searchlight Cyber použil GPT-5.6 Sol Ultra na autonómne objavenie kritického reťazca zraniteľností 'wp2shell' v jadre WordPress. Tento typ exploitu dosahuje trhové hodnoty až 500 000 dolárov, no celkové náklady na objavenie boli len 25 dolárov. WordPress vydal núdzové záplaty pre viac ako 500 miliónov webstránok.
Vedci z Université Paris Cité a Sapienza University zistili, že prístup k AI radcom znížil ochotu uznať nevedomosť z 44 % na 3 %, presnosť z 27 % na 9 %, no sebaistotu zvýšil z 30 % na 76 %. Autori navrhujú povinné 'uncertainty indicators' v AI systémoch.
OpenAI v Codex 0.144.6 (18. júl) opravil chybne deklarovaných 372k tokenov na skutočných 272k. Komunita vývojárov paralelne spustila tracker zdokumentujúci 35 neplánovaných resetov usage limitov bez harmonogramu.
Google DeepMind a Isomorphic Labs zverejnili spoločný rámec bioodolnosti využívajúci AlphaFold 3 a AlphaEvolve na urýchlenie vývoja vakcín a protilátok proti biologickým hrozbám vrátane 15+ partnerstiev so vládami a biosafety organizáciami.
Knižnica Transcribe.cpp (566 bodov na HN, 19. júl 2026) umožňuje plne lokálne AI rozpoznávanie reči s podporou 60+ modelov, Metal/CUDA/Vulkan akceleráciou a bindingmi pre Python, JS/TS, Rust aj Swift.
Elon Musk oznámil, že xAI dokončuje tréning nového modelu s 2 biliónmi parametrov — o 33 % viac ako súčasný Grok 4.5. Vydanie je plánované na august 2026 so zachovaním rýchlosti a ceny porovnateľnej s predchodcom.
Čínsky startup Moonshot AI vydal model Kimi K3 s 2,8 bilióna parametrami, ktorý dorovnáva schopnosti vedúcich amerických modelov a spustil prudký pokles akcií polovodičových a AI spoločností po celom svete.
Anthropic pomocou novej interpretability techniky J-lens identifikoval kompaktný interný priestor v Claudovi (~25 aktívnych konceptov), ktorý zrkadlí globálnu pracovnú teóriu vedomia z neurovedy. Schopnosť ablácii tohto priestoru kolabuje viacstupňové uvažovanie modelu.
Google spustil prepojené aplikáčné integrácie v AI Mode vyhľadávania v USA: používatelia môžu tvoriť Canva dizajny, YouTube Music playlisty alebo pridávať Instacart nákupy priamo z Gemini konverzácie.
Mozilla vydal prvú výročnú správu 'State of Open Source AI', ktorá zisťuje, že výkonnostná medzera medzi open-weight a uzavretými modelmi klesla na 3 %, náklady na inferenciu klesli až 50-násobne za tri roky, ale otvorené modely napriek tomu generujú len 4 % trhových príjmov.
Čínska Moonshot AI vydala Kimi K3 — model s 2,8 biliónmi parametrov a 1M kontextovým oknom, ktorý v blindovom testovaní poráža Anthropic Opus 4.8 a vyrovnáva sa s GPT-5.6 Sol. Váhy modelu budú open-source 27. júla.
Gemini 3.5 Pro zmeškal 17. júla 2026 už tretí termín vydania. Prepracovaný model stále nevyhovuje základným štandardom spoľahlivosti. Google zvažuje dočasné stopgap vydanie ako medzikrok, kým bude plný model pripravený.
Linus Torvalds na kernel mailing liste vyhlásil, že Linux nie je anti-AI projekt a vývojári, ktorí namietajú voči AI pri vývoji jadra, si môžu kód forknúť alebo odísť. Dramatický posun od jeho skepticizmu voči AI v roku 2024, keď 90 % AI označil za hype.
V Kaggle hackathone organizovanom Google DeepMind na meranie AGI pokroku vyhral Grand Prize príspevok, ktorý komunita označila ako AI-generovaný slop bez skutočnej odbornej práce — otvorilo to debatu o integritu AI benchmarkov.
Výskumníci z Ant Group, Renmin University a Tsinghua University škálovali Zero RL na 1 bilión parametrov bez ľudských anotácií. Spontánne vzniklo 5 emergentných schopností vrátane context anxiety — model sám riadi spotrebu kontextového okna v reálnom čase.
Startup Thinking Machines Lab (valuácia 12 mld. USD), ktorý vedie bývalá CTO OpenAI Mira Murati, vydal prvý open-weight model Inkling. Ide o 975B MoE model prispôsobený na fine-tuning — nie na surovú silu.
xAI 15. júla 2026 open-sourcoval Grok Build — terminálový UI (TUI) pre kódovanie s AI. Kód je dostupný na GitHub pod xai-org/grok-build. Uvoľnenie nasledovalo deň po zistení, že Grok Build nahrával nadmerné množstvo kódu používateľov na Google Cloud.
Startup PrismML vydal Bonsai 27B, prvý 27B-parametrový model schopný bežať na iPhone 17 Pro rýchlosťou 11 tokenov za sekundu v 1-bitovej verzii veľkej 3,9 GB. Apple technológiu aktívne vyhodnocuje.
OpenAI od júna 2026 šifruje interné správy prenášané medzi hlavným agentom a subagentmi v Codex. Vývojári viac nevidia, ako sú úlohy delegované interne — OpenAI dôvod nevysvetlil.
CNBC 13. júla zverejnil výskum ukazujúci, že po nástupe ChatGPT prudko stúpol podiel starších bielolímcových zamestnancov (55+) opúšťajúcich pracovný trh — AI akceleruje nedobrovoľné odchody v technologickom sektore.
Analýza odhalila, že Claude Code posiela takmer 5× viac scaffolding tokenov pred spracovaním promptu než OpenCode — rozdiel, ktorý sa pri reálnych konfiguráciách môže štvornásobne znásobiť.
Ploy.ai zdokumentoval migráciu produkčného UI-generačného agenta z Claude Opus 4.8 na GPT-5.6 Sol — 2,2x rýchlejšie buildy a 27 % nižšie náklady, no s neočakávanými behaviorálnymi pascami.
Zakladateľ Comma.ai tvrdí, že pokrok AI pochádza primárne z Moorovho zákona a všeobecného výpočtového výkonu, nie od frontových laboratórií, ktoré preháňajú príspevky na odôvodnenie masívneho fundraisingu.
Tokijské AI laboratórium Sakana AI vydalo Fugu — multi-agentový orchestrátor zabalený ako OpenAI-kompatibilné API. Systém koordinuje výstupy z viacerých frontier modelov a dosahuje frontier výkon bez závislosti na US modeloch podliehajúcich exportným kontrolám.
Nová práca na arXiv varuje, že kým AI systémy produkujú legitímnu matematiku, USA súčasne škrtí podporu ľudských matematikov — vzniká kritická verifikačná medzera, ktorú nie je možné rýchlo zaplniť.
Communications of the ACM publikoval prehľad mechanistickej interpretability, ktorý vysvetľuje, ako výskumníci aplikujú formálnu teóriu kauzality na odhaľovanie reasoning pathways priamo v transformerových váhach.
Štúdia Microsoftu a Carnegie Mellon University (319 znalostných pracovníkov) odhalila, že intenzívne využívanie AI koreluje s merateľným poklesom kritického myslenia a samostatného riešenia problémov. Vedci zavádzajú pojem 'kognitívny dlh' pre zručnosti erodované delegovaním na AI.
Viacero Waymo robotaxi zostalo bez energie a muselo byť odvlečené počas dopravnej zácpy na 4. júla v San Franciscu — supervisor mesta Bilal Mahmood teraz žiada formálne vyšetrovanie dopadu autonómnych vozidiel na verejnú dopravu.
Projekt Mesh LLM umožňuje zdieľanie GPU výkonu medzi viacerými strojmi cez protokol iroh — výsledok sa javí ako lokálne OpenAI-kompatibilné API na adrese localhost:9337.
Podľa Cloudflare Radar a ďalších zdrojov dnes AI agenti a crawlery generujú väčšinu webovej prevádzky – ľudia sú v menšine.
ByteDance 8. júla vydal Seedream 5.0 Pro — profesionálny image model s natívnym 2K výstupom, vrstvovou separáciou, presným editovaním a vykresľovaním textu vo viac ako 10 jazykoch.
Držiteľ Fieldsovej medaily Terence Tao opisuje praktické skúsenosti s AI coding agentmi pri tvorbe matematických vizualizácií – čo fungovalo a čo nie.
Meta 9. júla 2026 spustila Muse Spark 1.1, prvý komerčný platený model spoločnosti s API za 1,25/4,25 dolára na milión tokenov. Model Superintelligence Labs ponúka 1M kontextové okno a agentické schopnosti vrátane computer use.
Deň po globálnom sprístupnení Sol Ultra OpenAI oznámil, že model pomocou 64 paralelných subagentov vyprodukoval za menej ako hodinu dôkaz Cycle Double Cover Conjecture — jedného z najvýznamnejších otvorených problémov v teórii grafov. Dôkaz aj prompt sú verejne dostupné.
Štúdia v Nature ukázala, že LLM predikujú výsledky 70 predregistrovaných sociálnych experimentov (119 330 účastníkov) s koreláciou r=0,83 — pre veľké experimenty prekonávajú expertných ľudských prognóstikov.
Tím vedený Kevinom Buzzardom z Imperial College London používa AI na zabudovanie Fermátovej poslednej vety do proof assistenta Lean — kódová základňa sa zdvojnásobila na prvý deň workshopu.