{"id":1811,"date":"2026-08-19T09:46:53","date_gmt":"2026-08-19T07:46:53","guid":{"rendered":"https:\/\/vittrup-graversen.dk\/?p=1811"},"modified":"2026-08-19T09:46:53","modified_gmt":"2026-08-19T07:46:53","slug":"glm-5-3-viser-hvorfor-llm-traening-flytter-ind-i-drift","status":"publish","type":"post","link":"https:\/\/vittrup-graversen.dk\/index.php\/2026\/08\/19\/glm-5-3-viser-hvorfor-llm-traening-flytter-ind-i-drift\/","title":{"rendered":"GLM-5.3 viser, hvorfor LLM-tr\u00e6ning flytter ind i drift"},"content":{"rendered":"\n<p class=\"wp-block-paragraph\">Z.ai har lanceret GLM-5.3, og nyheden er mere interessant end endnu en tabel med benchmarktal. Modellen bygger p\u00e5 samme grundmodel som GLM-5.2. Leverand\u00f8ren siger, at fremskridtet kommer fra en m\u00e5ned med mere posttr\u00e6ning: flere k\u00f8rende opgavemilj\u00f8er, flere typer opgaver og mere beregningstid i den efterf\u00f8lgende tr\u00e6ning.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Det flytter fokus fra parameterkapl\u00f8bet til noget, der er sv\u00e6rere at k\u00f8be sig til: gode milj\u00f8er, hvor en agent kan arbejde, fejle og blive m\u00e5lt p\u00e5 et resultat. For teams, der bruger modeller til kodning, er det et langt mere brugbart sp\u00f8rgsm\u00e5l end om n\u00e6ste model har f\u00e5et et st\u00f8rre tal p\u00e5 kassen.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">Posttr\u00e6ning er blevet selve produktet<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">En sprogmodel l\u00e6rer f\u00f8rst brede m\u00f8nstre i store datam\u00e6ngder. Posttr\u00e6ningen bagefter former den til konkrete opgaver, v\u00e6rkt\u00f8jer og arbejdsgange. Z.ai beskriver GLM-5.3 som samme base som GLM-5.2, men tr\u00e6net videre med milj\u00f8er, der skal ligne l\u00e6ngerevarende engineering-opgaver: kodebaser, dokumentation, lagring, eksperimenter og flere afh\u00e6ngige skridt.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Det er plausibelt, at den slags arbejde giver mere end endnu en omgang generel pretraining. En coding-agent fejler sj\u00e6ldent, fordi den ikke kan skrive en enkelt funktion. Den fejler, n\u00e5r den mister kontekst, v\u00e6lger forkert test, misforst\u00e5r en intern afh\u00e6ngighed eller afleverer en patch, som ser fornuftig ud, men \u00f8del\u00e6gger resten af systemet.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Z.ai oplyser blandt andet en stigning p\u00e5 Terminal-Bench 3.0 fra 4,6 til 28,3 og p\u00e5 DeepSWE v1.1 fra 46,2 til 66,9 sammenlignet med GLM-5.2. Tallene kommer fra leverand\u00f8ren selv og er ikke en garanti for samme effekt i din kodebase. Men retningen er v\u00e6sentlig: tr\u00e6ningsmilj\u00f8et og verifikationen f\u00e5r st\u00f8rre betydning end den n\u00e6ste \u00e6ndring i modelarkitekturen.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">Et benchmark er ikke en merge-godkendelse<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">GLM-5.3 har allerede en forg\u00e6nger p\u00e5 sitet, <a href=\"https:\/\/vittrup-graversen.dk\/index.php\/2026\/07\/03\/glm-5-2-open-weight-llmer-presser-frontiermodellerne\/\">GLM-5.2<\/a>. Den nye vinkel er ikke, at en kinesisk model igen ser st\u00e6rk ud p\u00e5 en rangliste. Det er, at leverand\u00f8ren selv flytter modeltr\u00e6ningen t\u00e6ttere p\u00e5 agentarbejde med rigtige udviklingsmilj\u00f8er.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Det g\u00f8r ogs\u00e5 benchmarkdisciplinen vigtigere. The New Stack peger p\u00e5, at GLM-5.3 stadig ligger bag lukkede frontiermodeller p\u00e5 ExploitBench, selv om den er blevet v\u00e6sentligt bedre til at finde s\u00e5rbarheder. At identificere et muligt problem i kildekoden er noget andet end at dokumentere reachability i produktion, bygge en sikker rettelse og sikre, at den ikke skaber regressioner.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Det er den samme lektion som ved <a href=\"https:\/\/vittrup-graversen.dk\/index.php\/2026\/07\/13\/programmatic-tool-calling-naar-llm-agenten-skriver-sin-egen-orkestrering\/\">programmatisk tool calling<\/a>: mere autonomi kr\u00e6ver en h\u00e5rdere kontrolflade. En agent m\u00e5 gerne have testmilj\u00f8, branch, begr\u00e6nsede credentials og et defineret budget. Den skal ikke have fri adgang til produktionsdata, deploy-n\u00f8gler og netv\u00e6rket, fordi dens benchmark er flot.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">Cyber-fremgangen er b\u00e5de nytte og alarm<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">Z.ai fremh\u00e6ver ogs\u00e5 cybersikkerhed. P\u00e5 CyberGym angiver virksomheden 84,5 procent mod 77,2 for GLM-5.2. P\u00e5 ExploitBench g\u00e5r tallet fra 24,4 til 54,4. Leverand\u00f8ren skriver, at den derfor udskyder frigivelsen af v\u00e6gtene i cirka to uger, mens sikkerhedsevaluering og hardening f\u00e6rdigg\u00f8res.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Det er fornuftigt, men ikke tilstr\u00e6kkeligt som kontrol. N\u00e5r v\u00e6gtene kan k\u00f8res lokalt, er adgangskontrollen hos API-leverand\u00f8ren v\u00e6k. For danske virksomheder er den praktiske opgave derfor at skille defensive og offensive workflows ad: k\u00f8r scanning mod godkendte kodebaser, log alle agentkald, lad en menneskelig reviewer godkende patches, og brug isolerede sandkasser uden produktionshemmeligheder.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Der er en ekstra faktor ved kinesiske open-weight-modeller. \u00c5bne v\u00e6gte kan give bedre data- og driftskontrol, hvis de k\u00f8res i eget milj\u00f8. Men organisationen skal stadig vurdere leverand\u00f8rens jurisdiktion, tr\u00e6ningsdata, opdateringsk\u00e6de og afh\u00e6ngigheder. &#8220;Lokalt&#8221; er ikke det samme som gennemg\u00e5et. Hentede modeller, containere og agent-skills h\u00f8rer hjemme i den almindelige software supply-chain-kontrol.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">Hvad udviklingsteams b\u00f8r g\u00f8re nu<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">Vent med at konkludere, at GLM-5.3 erstatter Claude eller GPT i jeres udviklingsflow. V\u00e6gtene er endnu ikke frigivet, og de mest opsigtsv\u00e6kkende tal kommer fra Z.ai. Men brug lanceringen som anledning til at forbedre jeres egen evaluering.<\/p>\n\n\n\n<ul class=\"wp-block-list\"><li>V\u00e6lg 10 til 20 reelle opgaver fra jeres backlog med kendte acceptkriterier.<\/li><li>M\u00e5l patch-kvalitet, testresultater, tid, tokenforbrug og hvor ofte en reviewer m\u00e5 rydde op.<\/li><li>Giv agenten mindst mulige privilegier, og hold dens filer, netv\u00e6rk og secrets adskilt fra produktion.<\/li><li>Gem prompts, tool-kald og diffs, s\u00e5 en fejl kan unders\u00f8ges efterf\u00f8lgende.<\/li><\/ul>\n\n\n\n<p class=\"wp-block-paragraph\">Det er kedeligere end at skifte modelnavn i en konfigurationsfil. Det er ogs\u00e5 s\u00e5dan, man finder ud af, om posttr\u00e6ning faktisk har gjort en agent bedre i ens egen drift.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">Kilder<\/h2>\n\n\n\n<ul class=\"wp-block-list\"><li><a href=\"https:\/\/z.ai\/blog\/glm-5.3\">GLM-5.3: Frontier Coding with Emergent Cyber Capabilities<\/a> &#8211; Z.ai, 14. august 2026<\/li><li><a href=\"https:\/\/thenewstack.io\/glm-5-3-post-training-coding\/\" target=\"_blank\" rel=\"noopener\">GLM-5.3 didn\u2019t change the base model &#8211; where did its coding gains come from?<\/a> &#8211; The New Stack, 14. august 2026<\/li><li><a href=\"https:\/\/www.interconnects.ai\/p\/glm-53-how-chinese-labs-keep-stride\" target=\"_blank\" rel=\"noopener\">GLM-5.3: How Chinese labs keep stride with the frontier<\/a> &#8211; Interconnects, 14. august 2026<\/li><\/ul>\n\n\n\n<p class=\"wp-block-paragraph\">Denne artikel er skrevet i samarbejde med AI, og efterf\u00f8lgende redigeret af et rigtigt menneske \ud83d\ude42<\/p>\n\n","protected":false},"excerpt":{"rendered":"<p>GLM-5.3 bygger p\u00e5 samme base som GLM-5.2. Posttr\u00e6ning g\u00f8r forskellen, men kr\u00e6ver h\u00e5rdere kontrol af coding-agenter.<\/p>\n","protected":false},"author":1,"featured_media":1810,"comment_status":"open","ping_status":"open","sticky":false,"template":"","format":"standard","meta":{"_acf_changed":false,"footnotes":""},"categories":[8],"tags":[183,31],"class_list":["post-1811","post","type-post","status-publish","format-standard","has-post-thumbnail","hentry","category-ai","tag-glm","tag-language-models"],"acf":[],"_links":{"self":[{"href":"https:\/\/vittrup-graversen.dk\/index.php\/wp-json\/wp\/v2\/posts\/1811","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/vittrup-graversen.dk\/index.php\/wp-json\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/vittrup-graversen.dk\/index.php\/wp-json\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/vittrup-graversen.dk\/index.php\/wp-json\/wp\/v2\/users\/1"}],"replies":[{"embeddable":true,"href":"https:\/\/vittrup-graversen.dk\/index.php\/wp-json\/wp\/v2\/comments?post=1811"}],"version-history":[{"count":1,"href":"https:\/\/vittrup-graversen.dk\/index.php\/wp-json\/wp\/v2\/posts\/1811\/revisions"}],"predecessor-version":[{"id":1815,"href":"https:\/\/vittrup-graversen.dk\/index.php\/wp-json\/wp\/v2\/posts\/1811\/revisions\/1815"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/vittrup-graversen.dk\/index.php\/wp-json\/wp\/v2\/media\/1810"}],"wp:attachment":[{"href":"https:\/\/vittrup-graversen.dk\/index.php\/wp-json\/wp\/v2\/media?parent=1811"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/vittrup-graversen.dk\/index.php\/wp-json\/wp\/v2\/categories?post=1811"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/vittrup-graversen.dk\/index.php\/wp-json\/wp\/v2\/tags?post=1811"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}