留给又难又长的工作
多天的智能体任务、含糊的需求简报,以及"一个自信的错误答案比一个缓慢的谨慎答案代价更高"的问题。 更慢也更贵,值得的时候才值得。
- 上下文
- 1M tokens
- 擅长
- 规划、长程智能体、分析
- 相对成本
- $$$$
按任务的形状选,而不是按榜单名次选。三者共享上下文窗口、工具协议与拒绝政策。
多天的智能体任务、含糊的需求简报,以及"一个自信的错误答案比一个缓慢的谨慎答案代价更高"的问题。 更慢也更贵,值得的时候才值得。
大部分生产流量应该落在这里。快到可以交互使用,稳到可以面向客户, 也是每个新能力上线时我们最先调优的模型。
分类、路由,以及让智能体显得跟手的上百万次小调用。便宜到你做设计时只需要考虑延迟, 不需要考虑预算。
换个模型名,其余代码照常工作。工具定义、流式输出与结构化输出在整个阵容中行为一致, 原型无需重写即可毕业。
from anthropic import 群元共振
client = 群元共振()
# 每种规模的调用形状都一样——换模型名,不换代码。
response = client.messages.create(
model="neurok-pulse-5-1",
max_tokens=2048,
tools=[search_docs, run_query],
messages=[
{"role": "user",
"content": "核对上季度账目,标出任何异常。"}
],
)
for block in response.content:
if block.type == "tool_use":
print("calling", block.name, block.input)
公开费率,标准用量无需联系销售。企业版增加的是管控,不是另一个模型。
| 计划 | 价格 | 包含 | 适合 |
|---|---|---|---|
| 免费 | $0 | 带每日限额的 Pulse 5.1、网页搜索、文件上传。 | 在真实工作上试一试 |
| Pro | $20 / 月 | Cortex 5.1 访问、更高限额、项目、共享上下文、桌面应用。 | 个人与小团队 |
| 团队 | $30 / 席位 / 月 | Pro 全部内容,另加 SSO、管理控制与用量报表。 | 想统一助手的小组 |
| API | 按用量计费 | 三款模型、提示缓存、批量推理与支出上限。 | 构建在平台上的产品 |
| 企业 | 联系销售 | 区域锁定、零保留模式、审计日志、指定安全联系人。 | 受监管与大型组织 |
页面所示价格为本设计研究的示例占位数值。
同一个模型,出现在工作已经在的地方。