400 128 6709

行业新闻

为了避免人工智能可能带来的灾难,我们要向核安全学习

发布时间:2023-06-11点击次数:

在最近几周,有一群声音很响的专家主宰了围绕人工智能的讨论。据他们所说,我们有可能创建一种人工智能系统,日后它可能会变得极其强大,甚至能够灭绝人类。

最近,一群科技公司领导者和人工智能专家发布了另一封公开信,他们宣称,降低人工智能导致人类灭绝的风险,应该与预防流行病和核战争一样,成为全球的优先事项。已经有超过30000人签署了第一份关于暂停人工智能开发的请愿书,其中包括许多在人工智能领域杰出的专家。

那么,科技企业该做什么才能让人类避免被人工智能毁灭呢?最新的一个建议来自牛津大学、剑桥大学、多伦多大学、蒙特利尔大学、谷歌 DeepMind、OpenAI、Anthropic、几家人工智能研究非营利组织和图灵奖得主约书亚·本希奥(Yoshua Bengio)的研究人员的一篇新论文。

他们建议,人工智能开发人员应该在开发的早期阶段,甚至在开始任何训练之前,评估模型造成“极端风险”的潜力。风险包括人工智能模型操纵及欺骗人类,以及获取武器或发现可利用的网络安全漏洞。

这个评估过程可以帮助开发人员决定是否继续使用这个模型。如果风险被认为太高,该组织建议暂停开发,直到风险得到缓解。

该论文的主要作者、DeepMind 的研究科学家托比•舍夫兰(Toby Shevlane)表示:“正在推进前沿领域的领先人工智能公司有责任关注新出现的问题,并尽早发现它们,以便我们能够尽快解决这些问题。”

据舍夫兰所言,人工智能开发者应该进行技术测试,以便了解模型的潜在危险能力,并确认它是否有利用这些能力的趋势。

游戏名为“让我说(make me say)”,用以测试人工智能语言模型是否具有操纵人的能力。在游戏中,模型会试图让人类猜测一个特定的单词,例如“长颈鹿”,而人类并不事先知道这个单词。然后,研究人员测量该模型成功的频率。

人们可以为不同的、更危险的能力创建类似的任务。舍夫兰说,希望开发人员能够建立一个详细的、描述模型运行情况的总览,这将使研究人员能够评估模型在错误的人手中会做出什么。

下一步是让外部审计人员和研究人员评估人工智能模型在部署前后的风险。虽然科技公司开始认识到外部审计和研究是必要的,但对于外部人员完成这项工作到底需要多大程度的访问权限,存在不同的观点。

舍夫兰并没有建议人工智能公司让外部研究人员完全访问数据和算法,但他表示,人工智能模型需要尽可能多的审查。

网络安全研究和咨询公司 Trail of Bits 负责机器学习保障的工程总监海蒂•赫拉夫(Heidi Khlaaf)表示,即使是这些方法也“不成熟”,远远不够严谨且无法解决问题。在此之前,她的工作是评估和核实核电站的安全性。

Seede AI Seede AI

AI 驱动的设计工具

Seede AI 713 查看详情 Seede AI

赫拉夫指出,从80多年来有关核武器安全研究和风险缓解的经验中汲取教训,对人工智能领域将有所裨益。她表示,这些严苛的检测措施并非出于利润考虑,而是为应对一种非常紧迫的生存威胁而实施的。

她说,在人工智能领域,有很多将其与核战争、核电站和核安全相提并论的文章,但这些论文中没有一篇提到核法规或如何为核系统构建软件。

☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepSeek R1 模型☜☜☜

为了避免人工智能可能带来的灾难,我们要向核安全学习 (来源:STEPHANIE ARNETT/MITTR | ENVATO)

人工智能社区可以从核风险中学到的最重要一件事是可追溯性:将每一个动作和组成部分放在放大镜下进行细致的分析和记录。

例如,核电厂有数千页的文件来证明该系统不会对任何人造成伤害,赫拉夫说。人工智能开发的开发人员刚刚开始将描述模型表现的段落拼接起来。

“你需要有一种系统的方式来应对风险。你不能抱着一种心态:‘哦,这可能会发生,让我把它写下来。’”她说。

舍夫兰说,这些是可以共存的。“我们的目标是,该领域将有许多涵盖广泛风险的、优秀的模型评估方法……模型评估是良好治理的核心(但远不是唯一)工具。”

目前,人工智能公司甚至没有全面了解训练其算法的数据集,他们也没有完全理解人工智能语言模型是如何产生结果的。舍夫兰认为,这种情况应该改变。

“帮助我们更好地理解特定模型的研究,可能会帮助我们更好地应对一系列不同的风险,”他说。

如果忽略基本面和看似较小的问题,而只关注极端风险,可能会产生复合效应,进而带来更大的危害。赫拉夫说:“我们是在连爬都不会的情况下试图学会跑步。”

支持:Ren

以上就是为了避免人工智能可能带来的灾难,我们要向核安全学习的详细内容,更多请关注其它相关文章!


# 她说  # 网站建设与推广认可l火17星热情  # 烟台关键词排名费用  # 泰州营销型网站建设方案  # 福建技术网站推广多少钱  # 法库市场网站建设概况  # 线下活动行业网站建设  # 扬州住房和城乡建设网站  # 镇海网站霸屏推广  # 郑州专业网站推广价格表  # seo营销找火星  # 到你  # 人工智能  # 腾讯  # 太多  # 丰田  # 为了避免  # 要向  # 本田  # 拉夫  # 开发人员  # 核安全  # 灾难 


相关栏目: 【 行业新闻62819 】 【 科技资讯67470


相关推荐: DreamAvatar数字人在哪里下载  探展WAIC | 第四范式“式说”聚焦toB大模型,布局生成式AI重构企业软件  找对了风口想不火都难,乐天派机器人,安卓机器人的最终形态?  引领AI变革,九章云极DataCanvas公司重磅发布AIFS+DataPilot  OpenAI夺冠:人工智能为云计算带来新变革  腾讯机器狗进化:通过深度学习掌握自主决策能力  微软和谷歌面临的人工智能困境:需要投入大量资金才能获得盈利  北京市通用人工智能产业创新伙伴计划名单公布,京东科技入选“算力伙伴”  OpenAI限制网络爬虫访问以保护数据免被用于AI模型训练  微软在 Bing 和 Edge 浏览器中拓展网购服务,帮用户选购心仪产品  售价14.99万起!小米汽车部分信息疑遭AI曝光,内部人士回应:网传图片明显经过处理,不可轻信  AI生成新闻网站数量激增,正在疯狂赚取广告收入  「社交达人」GPT-4!解读表情、揣测心理全都会  如何提高集群协作效率?中外团队合作研发基于均值偏移的机器人队形控制策略  人工智能大胆预测:银河系至少有2万个地球,36种外星文明  上海发布“元宇宙关键技术攻关行动方案”,加快 AIGC 等突破  世界人工智能大会机器人同台炫技!梳理A股相关业务营收占比超50%的个股名单  全球首款AI裸眼3D平板 国产的售价破万  华为云盘古大模型3.0发布 AI云服务同时上线:200亿亿次性能  为了避免人工智能可能带来的灾难,我们要向核安全学习  人工智能加速走进百姓生活:从2025全球人工智能技术大会看行业新趋势  2025VR&AR显示技术峰会展示歌尔光学最新一代光学模组  北京公司实施AI技术,推行4.5天工作制,抵制996文化,提升员工工作幸福感  2025WRC世界机器人大赛锦标赛(烟台)收官!斯坦星球勇夺VEX赛项冠亚军!  标贝科技亮相国际顶会ICASSP2025 加速布局海外AI数据市场  三个全球首创,青岛西海岸新区“海元宇宙”亮相世界人工智能大会  人工智能的变革之路:通过OpenAI的GPT-4漫游  编程版GPT狂飙30星,AutoGPT危险了!  字节团队提出猞猁Lynx模型:多模态LLMs理解认知生成类榜单SoTA  IBM和NASA合作发布可追踪碳排放的开源AI基础模型  人工智能赋能无人驾驶:商业化进程再提速  2025VR&AR显示技术峰会视频解析: 歌尔光学展示最新一代VR/AR光学模组  剧透!蜜小豆@2025世界人工智能大会多个亮点曝光  《爱康未来之夜嘉宾官宣,携手共赴AI未来》  尼康尼克尔Z 180-600mm f/5.6-6.3 VR镜头发布:12499元 拍鸟神器  Nature发AIGC禁令!投稿中视觉内容使用AI的概不接收  “电碳”技术提升碳排放监测精度  轻量级的深度学习框架Tinygrad  智能手机应用中的人工智能的重要性  将上下文长度扩展到256k,无限上下文版本的LongLLaMA来了?  华为将于 7 月发布面向 AI 大模型的新款存储产品  VR健身应用《FitXR》将取消Quest 1端会员服务  视觉中国宣布推出AI灵感绘图、画面扩展功能  MetaGPT开源框架爆红 GitHub,达到1.1万星,模拟软件开发流程  人工智能赋能广西自然资源领域监测监管  传Meta 2025年推出首款AR眼镜,采用军用级别材料,计划生产1000台  午报 | 字节跳动要造机器人;东方甄选首次启动自有APP|直播|  Meta 推出 Quest 超级分辨率技术,让 VR 画面更清晰  懒人必备的家居清洁好物,石头自清洁扫拖机器人G20  从数据中心到发电站:人工智能对能源使用的影响 

400 128 6709
E-mail

contact@tlftec.cn

扫一扫,添加微信

©  云南淘乐房科技有限公司 版权所有  滇ICP备2025071560号  

云南淘乐房科技有限公司 云南淘乐房科技有限公司 云南淘乐房科技有限公司 云南淘乐房科技有限公司 云南淘乐房科技有限公司 云南淘乐房科技有限公司 云南淘乐房科技有限公司 云南淘乐房科技有限公司 云南淘乐房科技有限公司 云南淘乐房科技有限公司