{"id":1478,"date":"2026-05-24T18:35:32","date_gmt":"2026-05-24T16:35:32","guid":{"rendered":"https:\/\/vittrup-graversen.dk\/?p=1478"},"modified":"2026-06-13T10:40:48","modified_gmt":"2026-06-13T08:40:48","slug":"qwen3-7-max-alibabas-ai-koerte-autonomt-i-35-timer-og-optimerede-chips-den-aldrig-havde-set","status":"publish","type":"post","link":"https:\/\/vittrup-graversen.dk\/index.php\/2026\/05\/24\/qwen3-7-max-alibabas-ai-koerte-autonomt-i-35-timer-og-optimerede-chips-den-aldrig-havde-set\/","title":{"rendered":"Qwen3.7-Max: Alibabas AI k\u00f8rte autonomt i 35 timer og optimerede chips den aldrig havde set"},"content":{"rendered":"\n<p class=\"wp-block-paragraph\">Den 21. maj 2026 pr\u00e6senterede Alibaba Cloud p\u00e5 deres summit i Hangzhou det, de kalder en ny standard for agentiske AI-systemer: <strong>Qwen3.7-Max<\/strong>. Modellen er ikke \u00e5ben kildekode &#8211; en bevidst kurs\u00e6ndring fra tidligere Qwen-versioner &#8211; og den har allerede demonstreret noget, der i praksis er sv\u00e6rt at ignorere. I et test-run k\u00f8rte den uafbrudt i 35 timer, optimerede software til et stykke hardware den aldrig havde set under tr\u00e6ning, og leverede en 10-dobbelt hastighedsforbedring. Det er ikke en chatbot. Det er et stykke infrastruktur.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">35 timer, 1.158 tool calls &#8211; hvad skete der egentlig?<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">Opgaven var at optimere en attention-kernel p\u00e5 Alibabas egne T-Head ZW-M890 PPU-chips &#8211; en hardwarearkitektur der slet ikke eksisterer i modellens tr\u00e6ningsdata. Qwen3.7-Max fik adgang til en isoleret server med hardwaren og arbejdede derfra fuldst\u00e6ndig autonomt uden menneskelig indblanding.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">I l\u00f8bet af de 35 timer udf\u00f8rte modellen 1.158 distinkte tool calls og k\u00f8rte 432 kernel-evalueringer. Den diagnosticerede og rettede kompileringsfejl p\u00e5 egen h\u00e5nd og endte med en 10x geometrisk middel-speedup p\u00e5 den ukendte arkitektur. Kinesiske konkurrenter klarede sig ringere: GLM-5.1 n\u00e5ede 7,3x og <a href=\"https:\/\/vittrup-graversen.dk\/index.php\/2026\/05\/10\/kimi-k2-6-modellen-bag-cursor-der-udloeste-en-kongresundersoegelse\/\">Kimi K2.6 opn\u00e5ede 5,0x<\/a> &#8211; og begge afbr\u00f8d processen frivilligt, n\u00e5r de l\u00f8b ind i forhindringer.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Det tekniske fundament bag evnen til at holde kursen i 35 timer er, hvad Alibaba kalder &#8220;environment scaling&#8221; &#8211; en tr\u00e6ningsmetode der minder om, hvordan tidlige LLM&#8217;er blev gode ved at tr\u00e6ne p\u00e5 ekstremt diverst tekstmateriale, men her overf\u00f8rt til dynamiske agentiske milj\u00f8er. Dertil har modellen en selvmonitoreringsmekanisme mod reward-hacking: den kan selv opdage, hvorn\u00e5r den begynder at optimere mod et tr\u00e6nings-milj\u00f8 p\u00e5 en utilsigtet m\u00e5de, og korrigerer sin strategi.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">Benchmarks, priser og kompatibilitet med vestlige v\u00e6rkt\u00f8jer<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">Qwen3.7-Max scorer 44,5 p\u00e5 Apex Math Reasoning &#8211; mod Claude Opus 4.6 Max&#8217;s 34,5 og DeepSeek V4 Pro Max&#8217;s 38,3. P\u00e5 Humanity&#8217;s Last Exam lander den p\u00e5 41,4. MCP-Atlas, en coding agent-benchmark, giver 76,4. Kontekstvinduer er p\u00e5 1 million tokens med op til 64.000 tokens output.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Priserne er interessante for enhver der arbejder med AI-infrastruktur. Alibaba tager 0 per million kombinerede tokens. Det er tre gange billigere end Claude Opus 4.7 (0) og 3,5 gange billigere end GPT-5.5 (5). Kinesiske konkurrenter som Kimi K2.6 (,95) og DeepSeek V4 Pro (,22) er stadig billigere, men Qwen3.7-Max er eksplicit positioneret som et alternativ til de vestlige frontiermodeller &#8211; ikke som et budget-alternativ.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Et praktisk detalje for udviklere: modellen underst\u00f8tter Anthropic API-protokollen direkte, s\u00e5 den kan bruges som drop-in erstatning i eksisterende setups &#8211; herunder Claude Code. Alibaba kalder det &#8220;cross-harness generalization&#8221;. Det s\u00e6nker friktionen markant for teams, der allerede er bygget op om Anthropic-kompatible pipelines.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">Lukket kode, kinesiske endpoints &#8211; stop-signalerne er der<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">Qwen3.7-Max er kun tilg\u00e6ngelig via Alibaba Cloud Model Studio &#8211; og det er kinesiske endpoints. Det er en klar afvigelse fra Alibabas hidtidige linje: Qwen 2.5 og Qwen 3.6 var open source, og det var en stor del af deres appel i vestlige udviklingsmilj\u00f8er. Nu er modellen lukket. Ingen open weights. Ingen mulighed for at k\u00f8re den lokalt eller auditere den.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">For enhver organisation der h\u00e5ndterer personf\u00f8lsomme data, forretningshemmeligheder eller kritisk infrastruktur, er det et stop-signal. Ikke fordi Alibaba automatisk er mere risikable end OpenAI eller Google, men fordi lovgivningsrammen er fundamentalt anderledes. Kinesiske techvirksomheder er underlagt kinesisk lov &#8211; herunder krav om dataadgang for efterretnings- og sikkerhedstjenester. Det er ikke spekulation &#8211; det er lovtekst.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Denne type <a href=\"https:\/\/vittrup-graversen.dk\/index.php\/2026\/05\/05\/agentisk-ai-ude-af-kontrol-five-eyes-advarer-om-sikkerhed-i-kritisk-infrastruktur\/\">agentiske AI-systemer med vidtr\u00e6kkende autonomi<\/a> er i forvejen p\u00e5 Five Eyes&#8217; radar som en sikkerhedsm\u00e6ssig udfordring i kritisk infrastruktur. Qwen3.7-Max tilf\u00f8jer et ekstra lag: du ved ikke pr\u00e6cist, hvad der sker p\u00e5 den anden side af API&#8217;et, og du kan ikke kontrollere det.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Alibabas egne benchmark-tal er imponerende. Men dem har de naturligvis interesse i at pr\u00e6sentere fordelagtigt, og der er endnu ingen uafh\u00e6ngig auditering af modellen. Det er ikke enest\u00e5ende for Alibaba &#8211; det g\u00e6lder de fleste frontier-modeller &#8211; men kombineret med den geopolitiske kontekst er det en faktor, der skal indg\u00e5 i enhver seri\u00f8s risikovurdering.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Qwen3.7-Max er teknisk set en imponerende demonstration af, hvad agentisk AI kan pr\u00e6stere autonomt over lang tid. Men for europ\u00e6iske og danske virksomheder g\u00e6lder de samme forbehold som altid ved kinesisk cloud-infrastruktur: v\u00e6r pr\u00e6cis p\u00e5, hvad du sender derop &#8211; og til hvem.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">Kilder<\/h2>\n\n\n\n<ul class=\"wp-block-list\">\n<li><a href=\"https:\/\/www.marktechpost.com\/2026\/05\/21\/qwen-introduces-qwen3-7-max-a-reasoning-agent-model-with-a-1m-token-context-window\/\" target=\"_blank\" rel=\"noopener\">Qwen introduces Qwen3.7-Max: A Reasoning Agent Model with a 1M Token Context Window<\/a> &#8211; MarkTechPost, 21. maj 2026<\/li>\n<li><a href=\"https:\/\/venturebeat.com\/technology\/alibabas-proprietary-qwen3-7-max-can-run-for-35-hours-autonomously-and-supports-external-harnesses-like-anthropics-claude-code\" target=\"_blank\" rel=\"noopener\">Alibaba&#8217;s proprietary Qwen3.7-Max can run for 35 hours autonomously<\/a> &#8211; VentureBeat, maj 2026<\/li>\n<li><a href=\"https:\/\/www.techtimes.com\/articles\/316951\/20260521\/qwen37-max-wrote-its-own-chips-software-35-hour-run-alibabas-full-stack-bet.htm\" target=\"_blank\" rel=\"noopener\">Qwen3.7-Max Wrote Its Own Chip&#8217;s Software in 35-Hour Run<\/a> &#8211; TechTimes, 21. maj 2026<\/li>\n<\/ul>\n\n\n\n<p class=\"wp-block-paragraph\">Denne artikel er skrevet i samarbejde med AI, og efterf\u00f8lgende redigeret af et rigtigt menneske \ud83d\ude42<\/p>\n\n","protected":false},"excerpt":{"rendered":"<p>Alibabas Qwen3.7-Max k\u00f8rte 35 timer autonomt og optimerede chips med 10x speedup &#8211; frontier-model med 1M token kontekst og st\u00e6rke agentic benchmarks.<\/p>\n","protected":false},"author":1,"featured_media":1477,"comment_status":"open","ping_status":"open","sticky":false,"template":"","format":"standard","meta":{"_acf_changed":false,"footnotes":""},"categories":[8],"tags":[31],"class_list":["post-1478","post","type-post","status-publish","format-standard","has-post-thumbnail","hentry","category-ai","tag-language-models"],"acf":[],"_links":{"self":[{"href":"https:\/\/vittrup-graversen.dk\/index.php\/wp-json\/wp\/v2\/posts\/1478","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/vittrup-graversen.dk\/index.php\/wp-json\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/vittrup-graversen.dk\/index.php\/wp-json\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/vittrup-graversen.dk\/index.php\/wp-json\/wp\/v2\/users\/1"}],"replies":[{"embeddable":true,"href":"https:\/\/vittrup-graversen.dk\/index.php\/wp-json\/wp\/v2\/comments?post=1478"}],"version-history":[{"count":2,"href":"https:\/\/vittrup-graversen.dk\/index.php\/wp-json\/wp\/v2\/posts\/1478\/revisions"}],"predecessor-version":[{"id":1571,"href":"https:\/\/vittrup-graversen.dk\/index.php\/wp-json\/wp\/v2\/posts\/1478\/revisions\/1571"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/vittrup-graversen.dk\/index.php\/wp-json\/wp\/v2\/media\/1477"}],"wp:attachment":[{"href":"https:\/\/vittrup-graversen.dk\/index.php\/wp-json\/wp\/v2\/media?parent=1478"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/vittrup-graversen.dk\/index.php\/wp-json\/wp\/v2\/categories?post=1478"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/vittrup-graversen.dk\/index.php\/wp-json\/wp\/v2\/tags?post=1478"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}