返回文章列表

Anthropic

找到 32 篇相关文章 - 第5页

Anthropic研究发现模型情绪表征,AI安全进入内部机制阶段

Anthropic研究发现模型情绪表征,AI安全进入内部机制阶段

Anthropic 发布一项新研究,称 Claude 内部存在可识别的“情绪概念”表征。它不意味着模型真的有感受,却会实打实影响决策路径。对 AI安全 来说,这把讨论从输出表现推进到了模型内部机制层。 情绪表征不是拟人化修辞 研究团队整理了 171 个情绪词,让模型生成相关故事,再回读内部激活,提取...

AI资讯 Admin
106
Anthropic推出Claude Code Auto模式:跳过权限弹窗但保留安全拦截

Anthropic推出Claude Code Auto模式:跳过权限弹窗但保留安全拦截

Anthropic发布 Claude Code 的 Auto 模式,定位为介于“手动逐次审批”和“完全跳过权限”之间的折中方案。该模式用模型分类器替代部分人工确认,目标是减少频繁点击带来的审批疲劳,同时拦截越权删除、凭证搜寻、向外部服务发送数据等高风险操作。 机制上,Auto 模式包含两层防护:一层...

AI资讯 Admin
105
Anthropic公开Harness方法:AI长时运行开发进入工程化阶段

Anthropic公开Harness方法:AI长时运行开发进入工程化阶段

Anthropic最新发布的Harness方法,真正有价值的地方,不是又讲了一遍AI代理有多强,而是把长时运行应用怎么做、AI编程怎么稳定、AI代理怎么连续工作几小时这件事,给出了一套更像工程方案的路径。对AI开发、AI编程工具、AI产品团队来说,这已经不是概念热点,而是可以直接借鉴的方法论。 一、...

AI资讯 Admin
178
Claude Code接入电脑操作能力,AI编程和AI办公自动化迎来新拐点

Claude Code接入电脑操作能力,AI编程和AI办公自动化迎来新拐点

Claude这次更新的真正看点,不只是会聊天、会写代码,而是开始进入“替你动手做事”的AI Agent阶段。它能打开应用、操作浏览器、填写表格,等于把AI从建议助手推进到执行助手。对AI办公、AI自动化、AI编程来说,这是一个非常强的信号。 一、Claude可操作电脑,为什么这次很重要 1、AI A...

AI资讯 Admin
107

推荐工具

更多