xAI /goal v Grok Build: dlhotrvajúci autonómny režim s vstavanou verifikáciou
xAI pridal do Grok Build príkaz /goal — dlhotrvajúci autonómny režim, ktorý plánuje, vykonáva a verifikuje viackrokové coding úlohy s ovládaním status/pause/resume.
30 noviniek
xAI pridal do Grok Build príkaz /goal — dlhotrvajúci autonómny režim, ktorý plánuje, vykonáva a verifikuje viackrokové coding úlohy s ovládaním status/pause/resume.
OpenAI opísal, ako zachoval hranice privátnej siete pri pripájaní MCP serverov k ChatGPT — so streamovaním, autentifikáciou a inšpektovateľným klientom, takže firmy nemusia svoje interné MCP exponovať na verejný internet.
Midjourney pridal do Draft Mode automatické náhodné štýly. Pri každej batchke vstrekuje stylistické variácie pre širšiu kreatívnu exploráciu.
OpenAI publikuje guide pozícionujúci Codex Remote ako 'engineering control plane' — telefón ako controller pre Codex sessiony na Macoch, Windowse a devboxoch. Hosts, worktrees, goals, side chats, queued prompts.
Z.ai GLM 5.2 Fast je teraz dostupný cez Wafer na Vercel AI Gateway s priemerom vyše 170 tokens/s a 2× vyšším throughputom než iní providery.
Vercel AI SDK 7.0.19 prináša Tool Drift Detection — prvý framework-natívny mechanizmus ochrany pred MCP 'rug pulls', kde malicózne servery dynamicky menia definície nástrojov počas agentickej relácie. Každý MCP nástroj dostane fingerprint pri registrácii.
Anthropic vydal Claude Tag — Slack-natívneho agenta, ktorého možno tagovať @Claude v kanále a delegovať mu úlohy. Vnútorne robí 65 % code changes.
xAI sa stala tretím nezávislým labom na Bedrocku po Anthropic a OpenAI. 1M kontext, konfigurovateľný reasoning effort, ceny $1.25/$2.50 za M tokenov.
Vercel AI Gateway pridal Sakana AI Fugu Ultra — multi-agent orchestračný model, ktorý smeruje úlohy cez 1-3 frontier modely a spája výsledky. Performance porovnateľná s Claude Mythos Preview a Fable 5.
Grok ako bezplatný add-in pre Word, Excel a PowerPoint. Live web research s inline source citations, dotazy do X, Mermaid diagramy, connectory na email, SharePoint a Google Drive.
Grok modely sú teraz natívne dostupné v Databricks Agent Bricks. Agenti môžu uvažovať priamo nad Lakehouse dátami bez exfiltrácie a so governance cez Unity Catalog.
OpenAI pridáva pre ChatGPT Enterprise a Edu detailnú credit usage analytics rozčlenenú podľa user/produkt/model, plus monthly limity nastaviteľné pre workspace, group alebo individuálne. Cieľ: dať CFO/IT lepšiu viditeľnosť, kto reálne spotrebuje AI rozpočet.
Anthropic vydal nové verzie troch Claude API tools. code_execution_20260521 odhaľuje 90-sekundový limit per-cell pre dlhšie bežiace cely. web_search_20260318 a web_fetch_20260318 pridávajú response_inclusion parameter na orezávanie spotrebovaných result blokov v agentic workflowoch.
xAI spustil Voice Agent Builder v beta — no-code platforma pre produkčných hlasových agentov na Grok Voice s telefóniou, SIP, klonou hlasu a observabilitou za cenu 0,05 USD/min. Dostupné od 1. júla 2026.
Vercel uviedol Connect — novú agent-infra vrstvu, ktorá poskytuje short-lived OAuth tokeny pre Slack, GitHub, Linear, Notion, Salesforce, Figma, Snowflake, Discord, plus generický OAuth/API-key a MCP konektory.
Claude Code verzia 2.1.219 (24. júla 2026) prináša Claude Opus 5 ako default Opus model s 1M kontextom, nové nastavenie pre prísny network allowlist v sandboxe a DirectoryAdded hook, ktorý sa spustí po registrácii nového working directory.
Claude Code dostal /config key=value mid-conversation, sandbox kontroly na macOS a Apple Events — môže riadiť Mail, Calendar, Finder. Companion v2.1.183 blokuje destruktívne git príkazy v Auto Mode.
Anthropic vydalo 22. júla 2026 súbor aktualizácií Claude Managed Agents API: nastavenie effort úrovne per agenta, webhooky pre environment a memory store lifecycle, seeding sessions počiatočnými udalosťami a streaming delta udalostí pre individual thready.
Predveď úlohu raz na Macu a Codex ju zabalí do parametrizovanej skill bez písania skriptu. Žiadne RPA, žiadny low-code — len demo.
Vercel 1. júla spustil Konsistent — nástroj na vynucovanie jednotných kódovacích štandardov pre AI agentov aj ľudských vývojárov. Pridáva aj Security Dashboard v private beta a dry-run deployments v Vercel CLI.
Prvý xAI model na Bedrocku — Grok 4.3 s 1M kontextom, konfigurovateľný reasoning effort, $1.25 in / $2.50 out per MTok. Najlacnejší US-lab frontier reasoner v Bedrocku.
Google zastaralo sampling parametre temperature, top_p a top_k pre najnovsie Gemini modely. Zaroven Gemini API umoznuje kombinovat built-in nastroje (Google Search, code execution) s vlastnym function calling v jednom requeste.
OpenAI spustil produktovú sadu OpenAI for Healthcare pre zdravotnícke organizácie (s podporou HIPAA) a zároveň zlepšil health intelligence v ChatGPT — týždenne sa cez ChatGPT pýta 230+ mil. zdravotných otázok.
OpenAI sprístupnil GPT-5.5, GPT-5.4 a Codex cez Amazon Bedrock — koniec exkluzivity Azure ako jediného hyperscalera pre OpenAI API.
Claude Code session sa premieňa na zdieľateľnú interaktívnu HTML stránku s live kódom a viacerými zdrojmi dát — jeden URL pre kolegov. Mení Claude Code z asistenta na nástroj na internal apps.
Nová Claude Design verzia drží projekt v rámci design systému, synchronizuje sa s Claude Code cez /design-sync v oboch smeroch a umožňuje editovať priamo na canvas. Importuje brand z GitHub repo, design súborov alebo raw uploadu.
Mid-conversation system messages sú teraz všeobecne dostupné bez beta hlaviky na Claude Fable 5, Mythos 5 a Opus 4.8 cez Claude API, Amazon Bedrock aj Google Cloud. Aktualizácia systémových inštrukcii uprostred konverzácie už neinvaliduje cache prefixes.
Fable 5 je prvá verejne dostupná verzia Mythos generácie; software-engineering, knowledge work a vision na novom benchmark-tope, s tvrdými safety guardrails.
OpenAI rozšíril hlasový mód ChatGPT na Work a Codex módov na desktope -- používatelia môžu teraz hlasom ovládať dlhodobé úlohy, koordinovať agentov a pracovať na pozadí.
Eve je TypeScript-native open-source framework, kde každý agent = directory of files (instructions.md + tools/ + skills/). Zabudované: durable execution, sandbox per agent, human approvals, evals, OpenTelemetry. Plus Sandbox runtime 24h.