Loading blogs...
Posts tagged LLM.
AI agents can book appointments, take payments and support clinical work. Here is how healthcare teams can give them the right access, and no more.
Which teams should use Claude Code, Claude Cowork, or ChatGPT/OpenAI Agents — and the controls Workstation recommends before production.
Operational guide to LangGraph agents, LangSmith evals, and Apache Airflow 3 schedules — with Workstation promotion and edge patterns.
How Workstation maps NVIDIA DGX Spark, DGX Station, and Mac Studio M5 into AI Labs and SME packages — factual positioning, no invented prices.
Workstation over het blootleggen van knelpunten bij LLM-agenten met waarneembaarheid: OpenTelemetry, Prometheus/Grafana/Thanos, Langfuse – met duidelijke voor- en nadelen, kostenvoordelen en gebruiksstatistieken die marges beschermen.
Workstation op turbo-opladende LLMs: PagedAttention-paging voor KV-cache, vLLM-serving, Self-Debugging voor agenten, PowerInfer-tokensnelheden en EG-MLA-geheugenbesparingen - met productie-afwegingen.
KubePilot helpt SRE-, DevOps- en platformteams om van luidruchtige clustersignalen naar een veilige oplossing te gaan: CoPilot, Pilot en AutoPilot. Open source op kubepilot.org.
Meta Muse Glimmer brengt altijd beschikbare lokale agenten naar één GPU via Ollama: 30B, Apache 2.0, 128K context, visie en tools - Workstation zakelijke gids.
Beveilig enterprise AI-agents met MCP OAuth 2.1, VPN-geïsoleerde tools en HashiCorp Vault-leases die automatisch roteren en verlopen — plus Claude-, OpenAI- en Cursor-aanbevelingen.
Technisch Workstation-brief over deep learning: gradient-getrainde deep nets, discriminatieve vs generatieve modellen, taakmetrics, en Bedrock vs Kubernetes-serving.
Kimi K3 duwt open-weight modellen het frontier-agentgebied in. Wat verandert voor developers, vLLM-serving, MCP en Workstation productieadvies.
Workstation-blik op Claude Opus 5 op Amazon Bedrock: agentic coding, long-running agents, 1M context, ZDR standaard, en hoe teams het moeten adopteren.
Implementeer Amazon Bedrock, Bedrock AgentCore, SageMaker en Amazon Q, en lanceer daarna een eerste business agent in Microsoft Teams — met requirements, tooling en time boxes.
Kies het juiste Claude-modeltier: Haiku voor snelle routing, Sonnet voor dagelijks werk, Opus voor complexe agentic coding, en Fable 5 voor lange-horizon autonomie. Inclusief een token-budget router blueprint.
Claude Fable 5 is Anthropic's Mythos-klasse grensmodel voor agenten met een lange horizon. Reacties van de community, YouTube-recensies, wanneer je het moet gebruiken en hoe je tokens kunt opslaan.

Wat zijn grote taalmodellen en hoe werken ze? Een duidelijke, niet-technische uitleg voor managers en technici – tokens, inbedding, transformatoren, training en gevolgtrekking – plus productie-Kubernetes YAML om uw eigen LLM te implementeren met Ollama en vLLM.
Ik heb een Mac Studio M4 Max uitgepakt met 128 GB unified geheugen en 40 GPU cores, Ollama geïnstalleerd, Llama 3.1 8B lokaal uitgevoerd en een privé RAG-pijplijn gebouwd - alles op één stille, inactieve desktopbox van 6,48 W.