Anthropic vydal Claude Opus 5, najvýkonnejší model série
Anthropic predstavil Claude Opus 5 – model, ktorý vedie rebríčky Artificial Analysis a podľa spoločnosti prináša výrazné zlepšenia v uvažovaní, kódovaní a kybernetickej bezpečnosti.
60 noviniek
Anthropic predstavil Claude Opus 5 – model, ktorý vedie rebríčky Artificial Analysis a podľa spoločnosti prináša výrazné zlepšenia v uvažovaní, kódovaní a kybernetickej bezpečnosti.
Dvadsaťpäť technologických spoločností vrátane Nvidie, Microsoftu a Mety vytvorilo koalíciu na podporu vývoja a šírenia open-weight AI modelov, čo je priamy tlak voči uzavretým modelom.
OpenAI zaviedol plne duplexný hlasový režim GPT-Live do desktopovej aplikácie ChatGPT. Funkcia umožňuje aj ovládanie agentov Codex a ChatGPT Work hlasom počas konverzácie.
Cognition AI, výrobca autonómneho kodéra Devin, akvizoval startup Poke a rozširuje tak svoj ekosystém AI nástrojov pre vývojárov.
Midjourney, known pre generovanie AI obrázkov, akvizoval populárnu astrologickú aplikáciu Co-Star a posúva sa tak mimo oblasť vizuálneho AI.
Čínski predstavitelia požadujú konkrétnejší program rokovaní o umelej inteligencii so Spojenými štátmi uprostred pretrvávajúceho technologického a obchodného napätia.
Poradca Bieleho domu zodpovedný za energetickú infraštruktúru pre AI dátové centrá opúšťa svoju pozíciu, čo vyvoláva otázky o kontinuite energetickej politiky v oblasti AI.
Izrael a Spojené kráľovstvo vymenovali dedikovaných ministrov pre umelú inteligenciu, čím posilňujú vládny záväzok k strategickému rozvoju AI a súvisiacej legislatívy.
TracerML spustil Echo — systém dynamicky vyberá a kombinuje open-weight modely a dosahuje výsledky porovnateľné s Anthropic Fable za zhruba tretinu ceny. Na Hacker News získal 402 bodov.
Black Forest Labs vydal FLUX 3, multimodálny model trénovaný end-to-end naprieč obrazom, videom (až 20 sekúnd) a zvukom. Na rozdiel od predošlých systémov skladaných z viacerých modelov je FLUX 3 trénovaný spoločne cez všetky modality súčasne. Spúšťa sa v obmedzenom prístupe.
Tim Cactus post-trenoval Google Gemma 4 2B s 68 000-parametrovou sondou citajucou skryte stavy a predpovedajucou p(wrong). Len 15-35 % dotazov musi eskalovat do cloudu pri zachovani vykonnosti frontier modelu. MIT licencia.
Poolside vydal 118B parametrový MoE model Laguna S 2.1 s 1M tokenovým kontextom, tréningom od základov za 9 týždňov, dostupný zadarmo na Hugging Face — prekonáva DeepSeek-V4-Flash na kódovacích benchmarkoch.
Nativ je bezplatná open-source macOS aplikácia postavená natívne na Apple MLX, ktorá spúšťa frontier open-weight modely (text, obraz, video, kód) lokálne na Apple Silicon bez akýchkoľvek účtov.
Alibaba na WAIC 2026 v Šanghaji odhalila Qwen 3.8-Max-Preview — multimodálny model s 2,4 biliónom parametrov. Spoločnosť tvrdí, že model zaostáva len za Claude Fable 5, no nezverejnila nezávislé benchmarky.
OpenAI v Codex 0.144.6 (18. júl) opravil chybne deklarovaných 372k tokenov na skutočných 272k. Komunita vývojárov paralelne spustila tracker zdokumentujúci 35 neplánovaných resetov usage limitov bez harmonogramu.
Elon Musk oznámil, že xAI dokončuje tréning nového modelu s 2 biliónmi parametrov — o 33 % viac ako súčasný Grok 4.5. Vydanie je plánované na august 2026 so zachovaním rýchlosti a ceny porovnateľnej s predchodcom.
Čínsky startup Moonshot AI vydal model Kimi K3 s 2,8 bilióna parametrami, ktorý dorovnáva schopnosti vedúcich amerických modelov a spustil prudký pokles akcií polovodičových a AI spoločností po celom svete.
Google spustil prepojené aplikáčné integrácie v AI Mode vyhľadávania v USA: používatelia môžu tvoriť Canva dizajny, YouTube Music playlisty alebo pridávať Instacart nákupy priamo z Gemini konverzácie.
Čínska Moonshot AI vydala Kimi K3 — model s 2,8 biliónmi parametrov a 1M kontextovým oknom, ktorý v blindovom testovaní poráža Anthropic Opus 4.8 a vyrovnáva sa s GPT-5.6 Sol. Váhy modelu budú open-source 27. júla.
Gemini 3.5 Pro zmeškal 17. júla 2026 už tretí termín vydania. Prepracovaný model stále nevyhovuje základným štandardom spoľahlivosti. Google zvažuje dočasné stopgap vydanie ako medzikrok, kým bude plný model pripravený.
Startup Thinking Machines Lab (valuácia 12 mld. USD), ktorý vedie bývalá CTO OpenAI Mira Murati, vydal prvý open-weight model Inkling. Ide o 975B MoE model prispôsobený na fine-tuning — nie na surovú silu.
Startup PrismML vydal Bonsai 27B, prvý 27B-parametrový model schopný bežať na iPhone 17 Pro rýchlosťou 11 tokenov za sekundu v 1-bitovej verzii veľkej 3,9 GB. Apple technológiu aktívne vyhodnocuje.
OpenAI od júna 2026 šifruje interné správy prenášané medzi hlavným agentom a subagentmi v Codex. Vývojári viac nevidia, ako sú úlohy delegované interne — OpenAI dôvod nevysvetlil.
Analýza odhalila, že Claude Code posiela takmer 5× viac scaffolding tokenov pred spracovaním promptu než OpenCode — rozdiel, ktorý sa pri reálnych konfiguráciách môže štvornásobne znásobiť.
Ploy.ai zdokumentoval migráciu produkčného UI-generačného agenta z Claude Opus 4.8 na GPT-5.6 Sol — 2,2x rýchlejšie buildy a 27 % nižšie náklady, no s neočakávanými behaviorálnymi pascami.
Zakladateľ Comma.ai tvrdí, že pokrok AI pochádza primárne z Moorovho zákona a všeobecného výpočtového výkonu, nie od frontových laboratórií, ktoré preháňajú príspevky na odôvodnenie masívneho fundraisingu.
Tokijské AI laboratórium Sakana AI vydalo Fugu — multi-agentový orchestrátor zabalený ako OpenAI-kompatibilné API. Systém koordinuje výstupy z viacerých frontier modelov a dosahuje frontier výkon bez závislosti na US modeloch podliehajúcich exportným kontrolám.
Viacero Waymo robotaxi zostalo bez energie a muselo byť odvlečené počas dopravnej zácpy na 4. júla v San Franciscu — supervisor mesta Bilal Mahmood teraz žiada formálne vyšetrovanie dopadu autonómnych vozidiel na verejnú dopravu.
ByteDance 8. júla vydal Seedream 5.0 Pro — profesionálny image model s natívnym 2K výstupom, vrstvovou separáciou, presným editovaním a vykresľovaním textu vo viac ako 10 jazykoch.
OpenAI 9. júla 2026 predstavilo tri nové modely GPT-5.6 a produkt ChatGPT Work — agentický asistent pre dlhodobé pracovné úlohy, priamo konkurujúci Claude Cowork.
Artificial Analysis zistil, že Grok 4.5 zdvojnásobil mieru halucinácie z 25 % na 54 % oproti Grok 4.3, hoci presnosť vzrástla. Model skončil 4. na Intelligence Indexe.
Vývojár vforno vytvoril Colibrì — systém streamovania aktívnych expertov z disku, ktorý umožňuje spustiť obrovský MoE model GLM 5.2 na bežnom počítači pri výkone 0,1 tok/s.
SpaceXAI vydal Grok 4.5 — prvý AI model vyvinutý spoločne s Cursorom, zameraný na kódovanie, právne analýzy a finančný výskum. V EÚ zatiaľ nedostupný.
OpenAI potvrdil globálne vydanie GPT-5.6 Sol na štvrtok 10. júla po tom, ako vláda USA zrušila obmedzenia, ktoré limitovali prístup len na overených partnerov.
Cognition vydal SWE-1.7 — coding agent trénovaný na báze Kimi K2.7 s výkonom blízko GPT-5.5 na FrontierCode, bežiaci pri 1 000 TPS za $1,97/úlohu cez Devin.
Mistral predstavil Robostral Navigate — 8B model, ktorý umožňuje autonómnu navigáciu robotov pomocou jedinej RGB kamery a prirodzených inštrukcií, bez LiDARu alebo hĺbkového senzora.
Google DeepMind odložil vydanie Gemini 3.5 Pro na 17. júla 2026, pričom existujúca 2.5 Pro architektúra bola vyhodená v prospech kompletného prepracovania zameraného na matematické uvažovanie a kvalitu obrazu. Model zostáva v limitovanom Vertex AI enterprise preview.
Meta predstavila Muse, AI generátor obrázkov od Meta Superintelligence Labs, dostupný zadarmo cez Meta AI apku a integrovaný v Instagram Stories a WhatsApp.
Tencent Hunyuan vydal 6. júla Hy3, open-source MoE model s 295B parametrami (len 21B aktívnych), 256K kontextom a Apache 2.0 licenciou — bez geografických obmedzení.
CEO Mistral Arthur Mensch potvrdil, že firma v júli 2026 otvorí early access k novému vzrušujúcemu open-weight modelu. Mistral zároveň rokuje o 3,5 mld. USD raunde pri valuácii 23 mld. USD.
GitHub issue s 107 bodmi na HN dokumentuje sťažnosti vývojárov na zhoršenú kvalitu výstupu GPT-5.5 Codex. Hypotéza komunity: RL post-training spôsobil nežiaduci clustering reasoning tokenov, čo degraduje kódovacie výstupy.
Autor Flasku Armin Ronacher dokumentuje paradox: nové Claude modely (Sonnet 5, Opus 4.8) sú menej spoľahlivé pri nestandardných tool schemas a pridávajú polia, ktoré schema neobsahuje — zrejme dôsledok RL tréningom viazaného na Claude Code harness.
Šéf AI v Meta Alexandr Wang na internom town halle vyhlásil, že nový model 'Watermelon' dosiahol výkon porovnateľný s GPT-5.5 na kľúčových benchmarkoch — prvé interné uznanie, že Meta naháňa výkonnostnú úroveň OpenAI.
Mistral AI vydal Leanstral 1.5, open-source (Apache-2.0) model špecializovaný na formálne dôkazy v Lean 4. So 119B celkovými a len 6B aktívnymi parametrami dosahuje 100 % na miniF2F a vyrieši 587 z 672 PutnamBench matematických problémov.
Apple vydal Safari MCP Server — nástroj umožňujúci AI agentom priamo sa pripojiť k Safari oknám a autonómne testovať, debugovať a inšpektovať webové aplikácie. Vyžaduje Safari Technology Preview 247. Beží lokálne bez externých sieťových volaní.
Americké ministerstvo obchodu zrušilo 18-dňové exportné obmedzenia na vlajkové modely Anthropicu. Komerčný prístup k Fable 5 a Mythos 5 je od 1. júla 2026 obnovený globálne pre všetkých zákazníkov.
Anthropic uviedol Claude Sonnet 5 s natívnym 1M kontextovým oknom a promo cenami $2/$10 za milión tokenov do 31. augusta 2026 — o 60 % lacnejšie ako Fable. Model sa stal predvoleným pre Free a Pro používateľov.
Anthropic spustil Claude Science, aplikáciu integrujúcu 60+ vedeckých databáz (genomika, proteomika, cheminformatika) do jedného AI pracovného priestoru s auditovateľnými artefaktmi. Pridáva grantový program do 30 000 USD.
Google vydal Gemini Omni Flash pre konverzačnú tvorbu a editáciu videa a Nano Banana 2 Lite (Gemini 3.1 Flash-Lite Image) pre enterprise generovanie obrázkov za 4 sekundy a 0,034 USD za 1 000 obrázkov — dostupné cez Gemini API a Google AI Studio.
AI video model HappyHorse 1.1 od Alibaba Cloud predbehol v globálnych benchmarkoch Sorou aj ByteDance Seedance. Model je teraz dostupný cez Alibaba Cloud Model Studio s plným API prístupom.
Antoine Posepny popisuje, ako spustil Claude Code s Opus 4.8 nad celým DICOM exportom svojej MRI — model si sám nainštaloval Python balíčky a napísal vlastný analyzačný pipeline. Príbeh spustil veľkú HN debatu o konzumnej medicínskej AI.
Semgrep publikoval evaluáciu, podľa ktorej GLM-5.2 dosiahol 39 % F1 v detekcii IDOR za $0.17/vuln a porazil Claude Opus 4.8 (28 %) aj Opus 4.6 (37 %). Esej argumentuje, že export controls na uzavreté US modely stratili zmysel.
xAI nasadil Grok 4.5 postavený na novom modeli V9 s 1,5 bilióna parametrov do privátnej bety v SpaceX a Tesle s plánom mesačnej kadencie nových modelov pre zvyšok roka.
Zakladateľ Conno Christou nakŕmil PET a MRI snímky do Claude, ktorý priradil 90 % pravdepodobnosť reaktivácii týmusu po chemoterapii — neskôr ju potvrdil špecialista. Prípad rozprúdil debatu o LLM v medicíne.
Krea zverejnila 12B parametrické verzie svojho modelu Krea 2 - Raw pre fine-tuning a Turbo na lokálne generovanie 2K obrázkov za ~2 sekundy.
Open-source projekt Wayfinder Router smeruje dotazy medzi lokálne a hostované LLM podľa deterministických pravidiel namiesto LLM klasifikátorov. Cieli na audit-friendly hybridné deployments.
OpenAI 9. júla 2026 verejne spustilo tri nové modely GPT-5.6 pre všetkých používateľov ChatGPT a API vývojárov. Pre prvýkrát v histórii AI mali tri frontové laboratóriá súčasne verejne dostupné modely.
Mistral spustil OCR 4 — dokumentový model s bounding-boxes, klasifikáciou blokov a confidence skóre v 170 jazykoch. Cena je 4 USD za 1000 strán, dostupný cez Mistral API, Amazon SageMaker a od prvého dňa aj v Microsoft Foundry.
Google ticho posunul Gemini 3.5 Pro z júna na júl 2026, dôvodom je feedback testerov ohľadom efektivity tokenov a výkonu pri dlhých úlohách. Odklad postaví Gemini Pro priamo proti GPT-5.6 a Claude Opus 4.7 v polovici júla.
Google vydal DiffusionGemma, experimentálny 26B MoE model (3,8B aktívnych) s difúznou hlavou, ktorý generuje text paralelne v blokoch namiesto token po tokene. NVIDIA optimalizovala beh na RTX GPU a DGX Spark.