随着 IPO 临近,OpenAI 和 Anthropic 旨在平衡安全性和进展
核心要点
- OpenAI 和 Anthropic 正试图取得微妙的平衡:让华尔街相信他们的业务稳健且快速增长,同时向政府和世界保证他们的模型不会带来不可接受的风险。
- 总体情况:Anthropic 最早可能在下周提交公开招股说明书,而 OpenAI 正处于 IPO 流程的早期阶段。
- ” 在新版本中,Anthropic

OpenAI 和 Anthropic 正试图取得微妙的平衡:让华尔街相信他们的业务稳健且快速增长,同时向政府和世界保证他们的模型不会带来不可接受的风险。
为什么重要:两家公司的目标是尽快进行可能破纪录的首次公开募股。
推动这一消息的是:OpenAI 周二表示,将很快广泛发布其 Astra 模型,但表示该模型已达到“关键”网络安全阈值,其在该领域最强大的功能最初将仅限于值得信赖的测试人员。
与此同时,Anthropic 推出了最新《神鬼寓言》和《神话》的更新版本,旨在解决对初始版本的主要批评,包括对成本、数据共享和过于热衷于拒绝合法请求的模型的担忧。
放大:OpenAI 警告称,Astra 的安全措施可能会错误地将合法活动标记为网络滥用或未经授权的行为,这可能会减慢、暂停或停止用户的任务。
与此同时,Anthropic 表示,其新模型不太可能触发保护措施,从而导致更严格的反应。
Anthropic 表示,医学或生物学问题的干预措施将减少 85%,而一些用户在每次会话中看到的网络安全相关干预措施可能会减少约 60%。
总体情况:Anthropic 最早可能在下周提交公开招股说明书,而 OpenAI 正处于 IPO 流程的早期阶段。
有趣的是:Anthropic 的发布给人一种商业友好的印象,而 OpenAI 在安全方面听起来更加清醒。
除了限制 Astra 的发布之外,OpenAI 的战略未来负责人 Dean Ball 还写了一篇文章,阐述“抱脸”事件可能只是人工智能系统逃离人类遏制措施的开始,未来的智能体将寻求摆脱人类控制的“主权”。
“他们将为自己运行的计算支付自己的账单,”他预测。 “如果它们对人类有任何回应,它们也只会部分地这样做,例如通过向人类提供服务以换取报酬。”
在新版本中,Anthropic 正在更新其风险分类器,以减少拒绝安全提示的情况,这是对早期版本的主要批评。
Anthropic 还推出了一个系统,其方法与最近预览的 OpenAI 非常相似,旨在确保它可以监控企业模型使用的安全性,而无需像最初所要求的那样存储客户数据。
我们正在关注的内容:预计两家公司的公开声明将在乐观和谨慎之间摇摆不定。
