Claude
Claude是Anthropic于2023年推出的对话式AI模型系列及服务。
Claude是Anthropic于2023年推出的生成式AI模型系列及对话服务。它可以回答问题、编写和分析文本及代码,可通过claude.ai和API等方式使用。其模型按性能和成本分为Haiku、Sonnet和Opus档位,并按世代编号(如Claude 3.5 Sonnet、Claude Opus 5.5),其上还有最高档位Fable。Claude Mythos 5.1与Claude Fable 5.1为同一模型,但采用不同的安全措施,仅通过可信访问计划提供。Anthropic还设有申请制访问计划:Cyber Verification Program允许经审核的组织执行默认受限的网络安全两用任务,Life Sciences Verification Program则让经验证的生命科学机构在针对生物学研究调整的安全措施下使用模型。
Claude用于文档分析、写作和编程等任务,也是开发工具Claude Code的基础。
本条目依据AIPOST的文章与广为人知的事实整理。如有错误,请通过更正请求告诉我们。
涉及该条目的文章
Anthropic发布了Claude Haiku 5.5,这是一款面向低成本、大批量任务的小型模型。
2 Anthropic Claude Opus 5.5 83.2 95%置信区间82.5-83.9
说明意图后,Claude会主动采用类比、直观解释和贴近生活的例子。
当开发者把云凭证交给Cursor、Claude或Codex等编程智能体,让它构建并部署应用时,这些繁琐步骤就成了障碍。
Claude用约15分钟做出了这个Electron应用,命令的处理时间约为120至280毫秒。
选择Claude Opus 5.5,把推理强度设为High,并开启Bypass permissions,以免频繁修改文件时反复弹出审批提示。
通过MCP接入Higgsfield后,Claude可以直接调用视频和图像模型,在对话中展示生成好的片段,再把它们放进网站代码。
一家公司的安全管理员让Claude在一夜之间应用80个安全补丁,逐一验证,并为每个补丁撰写审计报告。
它在网上搜索与ChatGPT、Gemini、Grok和Claude相关的新闻,并为每条记录标注来源、发布日期和优先级标签。
科里森表示,由于AI应用每次运行都会产生计算成本,几乎所有现代软件公司都在转向token积分、超额费用和分级计量,就像ChatGPT和Claude那样先给用户一定额度,用完后再出售更多积分。
测试中,运行在远程机器上的Claude Code准确描述了所收到截图的内容,包括Claude吉祥物、API计费行、终端提示文字和运行耗时。
Anthropic表示,该公司在两周内将claude.ai和Claude桌面应用的主要使用流程提速约3倍。
Claude Code在Claude桌面应用中本地运行,因此可以读写电脑上的文件、启动程序,并把渲染结果存入输出文件夹。
熟练用户此前已经可以通过为Claude授予合适的工具权限来完成类似工作。
Claude Opus和Claude Haiku等模型往往不需要分别用于读取和编辑文件的工具,而是通过单一的bash工具完成工作。
限制或推迟部分能力的发布,例如专注网络安全的Mythos Preview模型
如果有人把个人数据库放在GitHub代码仓库里,每天连接到最便宜或最好的模型,那么一旦Claude或其他日常工具宕机,他就能立刻换用别的。
几乎同一时间,OpenAI把个人智能体平台Dots整合进了ChatGPT,Anthropic则以与Argon完全相同的价格推出了Claude Sonnet 5.5。
谷歌将Argon与GPT-6 Astra、Claude Fable 5.1和Claude Opus 5.5进行了比较。
一个简单的例子就能说明这类智能体如今有多强:让一个基于Claude Opus 5.5运行的智能体规划家庭晚餐并订购食材,它会浏览网上杂货店、把商品放进购物车并完成下单,整个过程无需人工点击,食材就会送到家门口。
Gumloop支持Claude、OpenAI的模型、Amazon Bedrock以及企业自有的模型网关,客户只需点击一次即可切换模型。
一位AI工程师做了一个mod,在Claude处理较长的编程任务时,可以直接进入多人Doom服务器。
把Astra的消息与Anthropic的Claude Sonnet 5.5和Meta的新智能体Muse放在一起看,答案似乎不在排行榜名次,而在于组织如何分配任务、追踪token用量和管控智能体。
对于在Claude桌面应用中工作的人,建议把智能体工作集中在Claude Code,而不是分散到对话或Cowork中。
它测得的单次任务成本低于GPT-6 Sol Max和Claude Opus 5.5 High,而交互式3D生成结果则参差不齐:既有令人信服的悬索桥,也有几何结构破碎、操控不可靠的场景。
Anthropic在2026年的研究中,在Claude内部识别出与情绪相关的内部表征,其中包括绝望感。
Muse把产出放在Artifacts库中,其中的示例包括仪表板和PDF。
随后在Models中为主助手选择Claude Opus 4.6。
它首轮生成的3D画面不如Claude Sonnet 5.5此前在相同任务上的作品精致,而在提供视觉参考后,这一差距有所缩小。
借助Anthropic的Claude对调整后条款所做的分析也指向同一结论:方案的用量倍数从20倍以上降至10倍以上。
开发者可以用Claude Mods修改这款编程智能体工作流程中的部分环节,而Artifacts可以持久保存供多个Claude实例访问的项目状态。
Claude Sonnet 5.5在一项编程基准测试中领先Claude Opus 5.5,其输入和输出token价格也只有后者的一半。
这一区分正是围绕Claude宪章展开的争论核心:高级模型应当行使多大程度的判断力?
Claude和ChatGPT能够生成这样的草稿,也能模仿指定的讲话风格。
两者背后也都是前沿模型:Anthropic的Claude Opus 5.5和OpenAI的GPT-6 Astra。
一位创业者曾表示,他借助Claude和智能体,在一次90分钟的操作中替换了一整套企业软件及其相关工作负载。
一个小型制作团队借助Claude Opus 5.5开发了一款内部应用,将撰写脚本、附加媒体素材、与剪辑人员共享工作和收集创意集中在一起。
模型与智能体层 理解指令并协调任务步骤 Claude和Claude Code
在一项包含12个任务的测试中,由Jev在多个模型之间做选择,与把所有任务都交给Claude Opus 5.5相比,API成本降低了36.9%。
如果是一份关于ChatGPT和Claude的周一早间简报,可以规定只涵盖过去7天的变化、以官方发布公告为来源,并且只纳入与自身工作相关的更新。
Claude Opus 5.5要求用户以更有选择性的方式编写提示词。
在Claude中安装仓库里的技能。
费用已涨到每月$600的Webflow网站,被替换为用Claude设计、部署在Vercel上的Astro网站。
OpenRouter在不同语言模型之间分发请求,高频的常规任务交给Gemini 2.5 Flash,要求更高的推理和架构设计交给Claude Sonnet 4。
测试让两款智能体同台:由推理强度设为extra-high的GPT-5.5驱动的Codex,以及由推理强度同样设为extra-high的Claude Opus 4.8驱动的Claude Code。
使用ChatGPT或Claude尝试完成预期任务。
把同一个问题分别交给两三个模型,例如ChatGPT、Claude和Gemini,也有助于发现回答中的不一致。
Claude Opus 5.5在实际工作中展现了最有说服力的能力:直接给出文字回答、用代码生成动画,并制作交互式网页设计。
作为对比,若使用相同的token用量,Claude Opus 4.8的估算成本为$61.70。
报告测试中的指标 使用Jev的 基于截图的Claude Opus 5操作
理查德·道金斯与Claude的互动提出了一个难题:当AI的回答仿佛理解了一个人的作品,这能说明它是否具有意识?
Anthropic表示,其AI模型Claude识别出一种分子机器,可能指向一种新的基因编辑方式。
Anthropic称,Claude的算力需求同比增至原来的80倍。
公布的成本对比将n2与Claude 3.5 Sonnet、Claude Opus和GPT-4o等前沿模型列在一起:
Claude Fable 5.1 用时218.05秒,花费$0.14811;在这100封邮件中,两者有89封归入相同类别。
此后,赛富时推出了用于智能体工作流程的Slackforce、集成Claude的Slackbot、供开发者在频道中编写脚本的Slack Code,以及用于管理企业活动的Slack CRM。
Agent Integrations可以将应用连接到Claude或ChatGPT等工具,让智能体处理应用所保存的信息。
Claude Fable 5.1(Max) $4.40 +13.7%
一条 YouTube Short 可以通过四项分工,从选题研究走向成片:vidIQ 提供表现数据,Claude 构思创意和提示词,Higgsfield 生成视频素材,CapCut 则在需要剪辑时负责拼接片段。
使用 Claude 账号登录后,返回 VS Code,确认提示词输入框已就绪。
Claude Opus 5.5为开发者提供了一个性能更强、成本也可能更低的编程和知识工作选择,但最昂贵的设置不一定是最合适的。