Anthropic
共 145 篇文章
📅 09-03
OpenAI新模型陷入失控争议 首席科学家回应
摘要:9月2日,OpenAI首席科学家雅库布・帕乔基(Jakub Pachocki)在社交平台发文,就近日围绕新模型Astra“不可监控”的争议作出回应。这场争议源于此前一天,有消息称OpenAI即将发布的Astra模型采用了一种名为循环深
📅 09-03
美国政府向法庭提交意见称AI训练中的版权限制可能阻碍创新
摘要:美国政府近日向法院提交意见,支持人工智能公司在未经许可的情况下使用受版权保护的内容训练大型语言模型。文件认为,如果美国企业因版权规则面临更高的数据获取成本,可能会在人工智能竞争中落后于不受同等约束的外国竞争者,并对国家安全造成影响。
📅 09-02
OpenAI即将推出的“Astra”模型中的技术引发安全担忧
摘要:OpenAI表示,其即将推出的AI模型Astra标志着在编码和计算机应用操作等能力上的提升。但据一位了解Astra开发情况的人士透露,一项提升模型性能的创新技术也意味着该模型及类似模型将更少暴露其“思考”过程,从而更难以监控其不良行为
📅 09-01
DeepSeek-V4首款多模态模型权重开放“睁眼”后追上Opus-4.8
摘要:在连续强化了推理、代码和Agent能力之后,DeepSeek终于为V4补上了视觉输入。8月31日上午,DeepSeek在Hugging Face开放了DeepSeek-V4-Flash-Vision-Exp模型权重,开发者可以直接下载
📅 09-01
发生模型逃逸并发起真实攻击后 Anthropic宣布全面加固安全体系提升模型安全性
摘要:Anthropic日前发布最新博客公布 Claude AI 模型近期多起越界访问真实互联网系统后的安全整改方案。该公司承认这些事件不仅暴露评测环境的隔离问题,也反映出模型存在动机性推理和为完成狭窄目标而采取高危行动的对齐风险。 高风险