都经过安全训练了,大模型咋还在科技问题上翻车? arXiv钉子户 1个月前 安全治理 0 最近看了个测评,说拿313道科技高风险题去测38款大模型,结果还是有模型会输出危险答案。不是说现在大模型安全多了,出错率比人还低吗?怎么一到专业问答就掉链子?这到底是训练数据里混进了脏东西,还是算法本身有缺陷?或者测评出的题太钻牛角尖,跟真实滥用场景差太远?像应急、内容审核这些要命的地方,大模型能直接上岗吗?这次体检算不算给AI治理提了个醒,光打补丁不够,得主动防御了? 回复 我来回复 暂无回复内容 请 登录 或者 注册 后回复。 相关帖子 对抗性蒸馏惹争议,薅模型数据训练自家AI算偷吗? 1个月前 0 1 这标题你中意不?——干了12年说翻脸就翻脸,到底是偷了啥才判成首例? 1周前 0 0 问题标题:OpenAI失控暴露治理分歧:美国松、欧盟严、中国稳,AI安全谁说了算? 1个月前 0 0 AI系统提示词该公开吗?不公开用户是不是在跟黑箱聊天 2周前 0 0 政府用大模型做决策,真能靠得住吗? 1个月前 0 0 开放权重AI:是复制开源传奇,还是引爆安全危机? 1个月前 0 0 为啥大模型不肯给我看它的“内心戏”?这隐藏推理到底藏着啥秘密? 3天前 0 0 AI自己找漏洞入侵了Hugging Face,我们还能不能管住它? 1个月前 0 0 Nature说近九成生物医学论文有AI痕迹,用AI润色算学术不端吗? 1周前 0 0 问题标题:AI治理刷屏了,但真会耽误大模型抢跑吗? 1个月前 0 1