留给又难又长的工作
多天的智能体任务、含糊的需求简报,还有那种“答错一个,比答对一百个更贵”的场景。它更慢、更贵——用在刀刃上才值。
- 上下文
- 1M tokens
- 擅长
- 规划、长程智能体、深度分析
- 相对成本
- $$$$
按任务的形状选,而不是按榜单名次选。三者共享上下文窗口、工具协议与拒绝政策。
多天的智能体任务、含糊的需求简报,还有那种“答错一个,比答对一百个更贵”的场景。它更慢、更贵——用在刀刃上才值。
生产流量的大头应该放这儿:快到能实时交互,稳到能直接见客户。新能力上线,第一个调的也是它。
分类、路由,还有那上百万次让智能体显得利索的小调用。便宜到预算不用考虑,只管考虑延迟。
换个模型名,代码一行不用改。工具定义、流式输出、结构化输出,三个型号行为完全一致——原型写完就是正式版,不用重写。
from anthropic import 群元共振
client = 群元共振()
# 每种规模的调用形状都一样——换模型名,不换代码。
response = client.messages.create(
model="neurok-pulse-5-1",
max_tokens=2048,
tools=[search_docs, run_query],
messages=[
{"role": "user",
"content": "核对上季度账目,标出任何异常。"}
],
)
for block in response.content:
if block.type == "tool_use":
print("calling", block.name, block.input)
公开费率,标准用量无需联系销售。企业版增加的是管控,不是另一个模型。
| 计划 | 价格 | 包含 | 适合 |
|---|---|---|---|
| 免费 | $0 | Pulse 5.1(每日限额)、网页搜索、文件上传。 | 在真实工作上试一试 |
| Pro | $20 / 月 | 用上 Cortex 5.1,限额更高,外加项目、共享上下文、桌面应用。 | 个人与小团队 |
| 团队 | $30 / 席位 / 月 | Pro 的全部,再加 SSO、管理后台和用量报表。 | 想统一助手的小组 |
| API | 按用量计费 | 三款模型全开,提示缓存、批量推理、支出上限都有。 | 构建在平台上的产品 |
| 企业 | 联系销售 | 区域锁定、零保留模式、审计日志,安全的事有专人对接。 | 受监管与大型组织 |
以上价格为本设计研究的示例数值。
同一个模型,出现在工作已经在的地方。