AI 安全监管体系的新范式:从 Anthropic 的安全策略看企业合规底线企业部署 AI 时,真正难定义的不是“模型能不能回答”,而是“它在什么条件下必须拒答、暂停或交给人工处理”。Anthropic 对 Constitutional AI(宪法式 AI)的探索,提供了一个...AI智能# 企业合规# 企业部署# 合规4天前1200
AI行业基准测试如何从模型分数走向安全与国产化适配AI行业基准测试正在经历一场明显的变化:从单纯比拼模型分数,转向兼顾能力、适配性和安全性的综合评测。这种转变并非偶然。随着开源大模型在行业落地加速,企业采购和研发团队发现,一个在通用榜单上表现亮眼的模...AI智能# 人工智能# 代码生成# 多模态4天前1000
AI安全与对齐:如何防止大模型产生有害输出?大模型的有害输出,往往不是单纯的“模型不够聪明”,而是安全目标、用户指令和应用场景之间发生了冲突。一个模型可能在常规测试中拒绝明显危险请求,却在多轮对话、角色扮演、输入改写或外部文档注入后,逐渐偏离原...AI智能# AI安全# 人工智能治理# 内容治理1周前410