AWS brengt Strands harness uit, een kant-en-klare agent harness onder Apache 2.0-licentie. Volgens AWS draait het geheel met één regel Python of TypeScript en ligt de kostprijs 28 procent lager dan bij vergelijkbare harnesses, zonder verlies aan nauwkeurigheid.
Wie lokaal met Claude Code of Codex werkt, krijgt een omgeving die meteen doet wat het moet doen. Bouw je zelf een agent, dan begint het gepuzzel met prompts, tools en contextbeheer opnieuw. Dat gat wil AWS dichten met Strands harness, dat zich uitdrukkelijk richt op general-purpose agents en niet alleen op codeertaken.
De harness is te installeren via pip install strands-harness of npm install @strands-agents/harness. Hij draait op modellen van Amazon Bedrock, Anthropic, OpenAI en Google en ook op lokale Ollama-modellen of LiteLLM. Deployment kan op elke omgeving met een Linux-container, van Cloudflare Containers en Google Cloud Run tot Amazon ECS.
Minder tokens, gelijke scores
Over zes benchmarks heen kostte Strands harness 28 procent minder bij gebruik van dezelfde Claude- of GPT-modellen. Met Fable 5 lag het kostenverschil met Claude Code zelfs op 77 procent, bij een hogere score op Terminal Bench 2.1. Deepseek Harness bleek het meest token-efficiënt, maar scoorde volgens AWS doorgaans het laagst op nauwkeurigheid. Het testen gebeurde via gedistribueerde benchmarking op EC2 met Harbor.
De winst zit vooral in de defaults. Tool-resultaten boven ongeveer 1500 tokens worden afgekapt, compaction start zodra het contextvenster boven 85 procent komt en bij overflow draait er context recovery binnen de loop. Prompt caching staat standaard aan. Een paper van AWS-onderzoekers over deze benchmarks volgt nog.
Via de Strands CLI kunnen ontwikkelaars een agent in gewone taal prototypen en met /export de code in Python of TypeScript exporteren.
Tip: AWS kan sommige data uit getroffen datacenters niet meer herstellen