跳到主内容
快讯直播
AI智模界
开源

开源项目 Heretic 宣称移除语言模型限制

一个名为 Heretic 的开源项目进入公众视野,其官网入口为 heretic-project.org,项目主旨是从语言模型中移除限制(restrictions)。从命名与定位看,它属于近期围绕"无限制模型"(uncensored model)展开的一类开源工作:不再把模型的安全对齐与内容策略视为不可变的产品属性,而是当作可以被外部工具修改、剥离或替换的对象。

对 AI 从业者而言,这类项目的意义主要在两点。其一,它触及语言模型的对齐层。主流模型通常在预训练之后经历微调">指令微调与偏好优化,从而形成"拒答"行为与内容边界。所谓移除限制,一般意味着在模型权重、微调数据或推理阶段绕过这套机制,使模型对原本会回避的请求给出回应。其二,它降低了相关操作的工程门槛——如果这类工具足够成熟,开发者无需从头训练或自行收集数据,即可在既有开源权重上完成改造。

与此同时,这一方向也把长期存在的张力再次摆到台面上。开放权重社区强调可审计、可复现与自由使用,认为限制会损害模型在安全研究、红队测试与内容创作等场景中的可用性;另一侧的关切则是,移除限制后模型可能被用于生成有害内容,且这类改动往往难以撤回。Heretic 这类项目的出现,意味着"模型能做什么"与"模型被允许做什么"之间的界线,正越来越多地由开发者而非模型发布方来划定。

目前该项目在标题层面披露的信息有限,其具体实现方式、支持的目标模型范围、许可证与使用条件,仍需以官网及代码仓库的实际内容为准。后续值得关注的是它是否提供技术说明与可复现的评测结果。

AI 生成本文由 AI 基于公开信息自动生成,仅供参考。