人性化的克劳德
- Claude Opus 4.7 旗舰推理、长背景、架构和策略工作。
- Claude Opus 4.6 上一代 Opus 可实现稳定、高质量的分析。
- Claude Sonnet 4.6 日常驱动程序——编码、编写和多步骤代理循环。
- Claude Sonnet 4.5 / 4 快速 Sonnet 层,可对支持的工作负载进行即时缓存。
- Claude Haiku 4.5 低延迟草稿、分类和大容量子任务。
为每个代理分配默认模型或为每个任务覆盖。使用量以您的计划余额中的 Digio 代币计量——无论代理呼叫 Sonnet、GPT-4o 还是 Gemini Flash,都是同一个钱包。
Model list and token economics evolve with provider releases. Your workspace shows live options when you assign a model to an agent; Digio Tokens debit from the same balance as in pricing.
协调员可以根据任务类型推荐 Sonnet、Opus 和更便宜的闪存模型。高级用户为每个代理角色设置默认值 - Sonnet 的研究、Opus 的最终审查、Haiku 或 Gemini Flash 的批量标记。
Per agent — default model in agent settings; override in To do or chat when needed.
Metered fairly — input, output, and cached tokens map to Digio Token charges (see usage in your wallet).
Skills stay the same — tools and integrations work across models; only latency and cost profile change.
Plan limits — more agents and monthly Digio Tokens on higher tiers; top up anytime on the pricing page.
需要微调、气隙检查点或可预测的推理定价?向您的 Digio 工作区添加专用 GPU 容量,安装您喜欢的服务堆栈,并在您的专用端点处指定代理。
按小时或按月计算的 GPU 节点(A100、H100、L40S 级)连接到您的租户 — 与其他客户隔离。
上传安全张量、GGUF,或从您的注册表中提取;运行 Llama、Mistral、Qwen 和自定义微调。
vLLM、TGI、Ollama 或您维护的容器映像 - Digio 代理调用与 OpenAI 兼容的基本 URL。
要做的事情、团队聊天、技能和协作不变——只有推理后端是你的。
将敏感步骤发送到专用 GPU,并在一个工作流程中使用 Claude 或 GPT 进行公共研究。
受监管团队的 VPC 对等、静态出口、审核日志和模型许可名单。
从零到代理呼叫您的端点的典型设置:
选择 VRAM、区域和正常运行时间(突发与始终开启)。重量存储随实例一起提供或安装在您的存储桶上。
启动服务映像或 SSH,安装 CUDA 驱动程序并加载检查点。健康检查确认模型已准备就绪。
在工作区设置中添加基本 URL、API 密钥和模型 ID。 Digio 在上线前会验证延迟和令牌格式。
选择您的私人模特作为所选代理商的默认模特;托管的 Claude/GPT 模型仍然可以并排使用。
GPU 租赁费用与 Digio 计划订阅分开计费。请联系我们了解容量规划、SLA 以及从现有推理集群的迁移。
选择托管 API 与 Digio 上的自托管推理。
您的 Digio 订阅涵盖基础设施、代理和包含的 Digio 代币。托管模型使用量按实际输入/输出令牌借记令牌余额。 GPU 租赁是您控制的机器的附加组件。
是的,每个代理都可以有自己的默认值。任务和聊天可以覆盖单次运行,而不更改全局默认值。
Opus 已针对更难的推理和更长的连贯计划进行了调整;对于日常代理循环来说,Sonnet 更快、更便宜。 Haiku 和 flash 级模型最适合批量子任务。
企业工作区可以限制出站模型提供程序并将所有代理流量路由到您的 GPU 端点。混合模式是大多数团队的默认模式。
产品取决于地区和需求,通常为 7B-70B 级型号提供 24-80 GB VRAM 层,为更大的堆栈提供多 GPU 节点。我们根据参数计数和量化来帮助您确定 VRAM 的大小。
编排(代理、任务、存储)保留在您的计划中。 GPU 上的推理按 GPU 时间计费;您可以选择计量令牌形式的使用情况以进行内部退款。
代理、任务和技能——围绕您选择的模型的工作区。