Loading blogs...
Posts tagged LLM.
AI agents can book appointments, take payments and support clinical work. Here is how healthcare teams can give them the right access, and no more.
Which teams should use Claude Code, Claude Cowork, or ChatGPT/OpenAI Agents — and the controls Workstation recommends before production.
Operational guide to LangGraph agents, LangSmith evals, and Apache Airflow 3 schedules — with Workstation promotion and edge patterns.
How Workstation maps NVIDIA DGX Spark, DGX Station, and Mac Studio M5 into AI Labs and SME packages — factual positioning, no invented prices.
Workstation 通过可观察性揭示 LLM 代理瓶颈:OpenTelemetry、Prometheus/Grafana/Thanos、Langfuse — 具有明确的优缺点、成本杠杆和保护利润的使用指标。
Workstation 增强 LLMs:用于 KV 缓存的 PagedAttention 分页、vLLM 服务、用于代理的 Self-Debugging、PowerInfer 令牌率和 EG-MLA 内存削减 — 以及生产权衡。
KubePilot 帮助 SRE、DevOps 和平台团队从嘈杂的集群信号转向安全修复 - CoPilot、Pilot 和 AutoPilot。在 kubepilot.org 上开源。
Meta Muse Glimmer 通过 Ollama 将始终在线的本地代理带到单个 GPU:30B、Apache 2.0、128K 上下文、愿景和工具 - Workstation 业务指南。
用 MCP OAuth 2.1、VPN 隔离工具以及自动轮换并过期的 HashiCorp Vault 租约保护企业 AI 智能体 — 并附 Claude、OpenAI 与 Cursor 建议。
Workstation 深度学习技术简报:梯度训练的深度网络、判别式与生成式模型、任务指标,以及 Bedrock 与 Kubernetes serving 的选择。
Kimi K3 将开源权重模型推入前沿智能体领地。对开发者、vLLM serving、MCP 的变化,以及 Workstation 生产建议。
Workstation 对 Amazon Bedrock 上 Claude Opus 5 的观点:智能体编程、长时运行智能体、1M 上下文、默认 ZDR,以及团队应如何采用。
落地 Amazon Bedrock、Bedrock AgentCore、SageMaker 与 Amazon Q,再在 Microsoft Teams 中启动首个业务智能体——含需求、工具与时间盒。
选择合适的 Claude 模型档位:Haiku 用于快速路由,Sonnet 用于日常工作,Opus 用于复杂智能体编码,Fable 5 用于长周期自主。含 token 预算路由器蓝图。
Claude Fable 5 是 Anthropic 针对长视野智能体的 Mythos 级前沿模型。社区反应、YouTube 评论、何时使用以及如何保存代币。

什么是大型语言模型以及它们如何工作?为经理和工程师提供清晰的非技术性解释器 - 令牌、嵌入、变压器、训练和推理 - 加上生产 Kubernetes YAML,以使用 Ollama 和 vLLM 部署您自己的 LLM。
我打开了带有 128 个 GB 统一内存和 40 个 GPU 核心的 Mac Studio M4 Max,安装了 Ollama,在本地运行 Llama 3.1 8B,并构建了一个专用 RAG 管道 - 所有这些都在一个安静的 6.48 W 空闲桌边盒子上进行。