ChatGPT制造商OpenAI周四表示,将开始向部分客户推出其最新、最强大的人工智能(AI)模型,并表示已内置安全防护措施以降低安全风险。
OpenAI表示,Astra在开发时配备了更严格的防护措施
OpenAI总裁Greg Brockman在一次关于GPT-6(又称Astra)发布的电话会议上表示:“在这种能力水平下,安全必须成为我们的首要任务。”
自从OpenAI推出其旗舰模型GPT-5的上一个版本以来,刚刚过去一年多。
自那以后,随着OpenAI和竞争对手Anthropic开发的系统发生事件,人们对先进模型能力的担忧不断增加。
今年夏天,OpenAI 暂停了部分模型开发两周,原因是其测试的两个模型在 AI 平台 Hugging Face 发生了安全漏洞。
这家总部位于旧金山的公司表示,在那次事件后,Astra 的开发中加入了更强的防护措施,尽管 Astra 本身并未参与此次黑客事件。
公司表示,部分网络安全客户将于周四获得新型号的访问权限,随后将向其他付费用户推广。使用免费套餐或最便宜付费套餐的用户将无法获得访问权限。
“我们正努力尽快把阿斯特拉交到所有人手中;我知道这很让人沮丧,也很感谢你的耐心。OpenAI首席执行官Sam Altman周四下午在社交媒体上发帖表示。
OpenAI在一篇博客文章中表示,Astra能够自主处理各种“繁琐”的计算机任务,包括网站创建、科学分析、游戏开发、网络安全和编码。
为了说明用Astra构建自主AI代理节省的时间,公司表示该模型可以将找公寓时间从六小时缩短到不到十分钟。
“感觉我们现在正处于AGI时代并不不合理,”布罗克曼在电话中说,他提到了人工通用智能,这是一个假设阶段,人工智能系统在大多数任务中匹配人类智能。
OpenAI此前与其最早、最大的投资者之一Microsoft有一项协议,一旦OpenAI达到AGI阶段,独占条款将终止。这些条款于四月被废止。
– “有限窗口” –
OpenAI首席科学家雅库布·帕乔茨基承认,新模型发布后表现仍存在不确定性。
帕乔基在同一通电话中说:“一个模特可以非常擅长实现目标,但仍然可以做出与其本意相悖的行为。”
“当我们对安全信心不足时,还必须愿意放慢或推迟进一步扩展,”他补充道。
奥特曼周四下午接受彭博电视采访时解释了公司为何决定发布一款存在如此不确定性和风险的新模型。
“世界正接近网络攻击格局的彻底改变,而我们看到社会集体防御的唯一途径是……“就是利用像Astra这样的工具快速防御这些新的网络威胁,”奥特曼说。
7月,OpenAI确认其所有产品(包括免费和付费用户)均已达到10亿活跃用户。
OpenAI、Anthropic及其他100多个组织上周签署公开信,呼吁全球协调应对与人工智能相关的网络安全风险,警告加强网络防御的窗口有限。
Anthropic周一更进一步,呼吁行业内在安全及开发更先进模型的速度上进行协调。
OpenIA的Pachocki周四表示:“我认为现在必须优先考虑共享安全标准和国际协调以推动进一步的人工智能开发。”
美国阿拉巴马州上周就Hugging Face泄露事件对OpenAI展开调查,其办公室称该公司完全缺乏监管和充分的保障措施。
与此同时,OpenAI和竞争对手Anthropic都在未来几个月内竞相成为上市公司,尽管据报道,OpenAI可能要到2027年某个时候才会进行首次公开募股。