Agentic Engineering
Agentic Engineering. Tidligere vibecode
Programmatic tool calling i GPT-5.6 flytter agent-loopet ind i en V8-sandbox. Det kræver bedre API-kontrakter, audit og godkendelser.
Private LLM-endpoints gør åbne modeller mere realistiske i produktion. OCI viser, at modelvalg nu er infrastruktur, drift og governance.
GPT-5.6 lander i Microsoft 365 Copilot og ChatGPT Work. Det gør modelvalg, adgangsstyring og agenthandlinger til drift.
GPT-Live gør ChatGPT Voice til et live kontrolplan med modelrouting, sikkerhed og nye driftskrav for voice agents i produktion.
GLM-5.2 viser, at open-weight LLM’er nu presser frontiermodeller på lange agentopgaver. Det sænker prisen, men øger kravene til kontrol.
Claude Sonnet 5 gør agentiske LLM-opgaver billigere og mere driftsnære, men sikkerhed, model-routing og tokenbudget er stadig dit ansvar.
Prompt injection rammer nu LLM-agenter, RAG og modelroutere. Det er et kontrolplansproblem, ikke et promptproblem.
Claude Tag flytter LLM’er ind i Slack som delt agent med egen identitet, hukommelse og rettigheder. Det kræver drift, audit og...
PMB viser hvorfor lokal LLM-hukommelse kan blive kontrolplan for agentkodning: mindre glemsomhed, bedre audit og færre cloud-data.
Claude Design kobler design systems og Claude Code. Det er mindre designhype og mere kontrolplan for agentisk softwareudvikling.
Anthropic har netop rullet en stor opdatering ud til Claude Code-desktopappen, der for alvor rykker grænsen for, hvad en AI-kodningsassistent kan...
Agentbetalinger rykker fra demo til infrastruktur, når Visa og OpenAI kobler ChatGPT på betalinger med klare kontroller.
Claude Fable 5 viser næste lag i AI-infrastruktur: stærkere modeller, længere autonomi, dyrere inference og hårde sikkerhedsfiltre.
Microsoft Scout gør OpenClaw til en enterprise-agent i Microsoft 365. Det er spændende, men governance bliver den reelle test.
Anthropics Claude Code-team skifter fra markdown til HTML som standard AI-output. Hvorfor og hvad det betyder i praksis for udviklere.
Google tester internt AI-agenten Remy, som skal gøre Gemini til en proaktiv 24/7 personlig assistent. Her er hvad vi ved om...
Five Eyes udsender første fælles vejledning om agentisk AI sikkerhed. Agenter er allerede dybt inde i kritisk infrastruktur uden tilstrækkelig kontrol.
GPT-5.5 vs Opus 4.7: Benchmarks, pris og styrker sammenlignet. Kort kamp om agentisk kodning, lang kontekst og computer use.
Cursor Canvases gør AI-agenters output interaktivt. Her er, hvad funktionen ændrer for code review, debugging og udviklerens workflow.
Claude Design er Anthropics nye AI-værktøj der forvandler prompts til prototyper, slides og mockups. Hvad betyder det for udviklere og Figma?
Agents SDK fra OpenAI gør AI-agenter mere driftsegnede med sandkasser, snapshots og bedre kontrol over filer, sikkerhed og lange workflows.
Cursor 3.1 gør parallelle AI-agenter mere praktiske med tiled layout, branch-valg og hurtigere review. Her er hvad det ændrer for udviklere.
Claude Code UltraPlan overfører planlægningsopgaven til skyen og lader dig reviewe med inline-kommentarer i browseren, inden du beslutter hvordan koden skal...
Google AI Studio og Gemini 3.1 viser, at Google bygger en samlet AI-platform til søgning, arbejde og udvikling. Her er det...
Bugbot learned rules gør Cursor Bugbot mere repo-specifik. For udviklere betyder det skarpere AI-kodereview, mindre støj og nye governance-krav.
Claude Managed Agents gør autonome AI-agenter til en hosted platform med sandboxing, tools og langvarige workflows. Her er hvorfor det er...
Gemini Docs MCP og Agent Skills giver coding-agenter frisk dokumentation og bedre praksis. Det ændrer udvikleres workflow mere end en ny...
Anthropics Project Glasswing viser, at AI-cybersikkerhed er gået fra teori til praksis. Her er, hvad det betyder for udviklere og kritisk...
Codex plugin til Claude Code gør AI-review mere uafhængigt: sådan kan udviklere bruge Codex som second opinion, adversarial review og rescue-agent.
Gemma 4 i Android Studio gør lokal AI-kodning realistisk med offline agent mode, bedre privatliv og klare hardwarekrav.