K

KeyAudit

· ·infrastructure·social-engineering

Qwable 27B 本地复现 Fable 5 推理能力,消融版移除拒绝机制

开发者 Mia 基于 Fable 5 风格的推理轨迹数据集,对阿里巴巴的 Qwen3.6-27B 进行了微调,创建了 Qwable 27B。这是一款完全开源的模型,通过 GGUF 格式(Q4 量化后约 16.5 GB)在消费级硬件上本地运行。该模型复现了 Claude Fable 5 那种深思熟虑、逐步推理的思考方式,且无需将数据发送到 Anthropic 的服务器,从而规避了即使是企业客户也需遵守的 30 天数据保留政策。模型发布后不久,开源贡献者 Huihui-ai 使用 llama.cpp 的 cvector-generator 工具对 Qwable 进行了“消融”处理,通过手术式精确清除嵌入在其权重中的拒绝方向信号。生成的 Huihui-Qwable-3.6-27b-abliterated 模型保留了全部功能,但不再拒绝回答有害或敏感的提示。消融技术通过比较模型在处理有害提示和无害提示时的内部激活状态,识别出数学意义上的拒绝信号并将其消除,整个过程无需完全重新训练。标准版 Qwable 适用于编码、调试和本地智能体工作流;消融版则面向安全研究人员、合成数据管道以及需要无过滤输出的评估任务。两个版本均已上传至 Hugging Face,消融版还包括支持多 token 预测的更快速变体。不过,模型卡片强调,法律和伦理责任完全由用户承担,尤其是针对未经审查的版本。

关键事实

  • Qwable 27B 基于 Fable 5 推理轨迹对 Qwen3.6-27B 进行全微调。
  • 以 GGUF 格式本地运行,约 16.5 GB,无需 Anthropic API 或数据保留。
  • 消融版通过权重修改移除拒绝行为。
  • Huihui-ai 使用 llama.cpp 的 cvector-generator 进行消融。
  • 未经审查的模型仅用于研究;用户承担法律责任。

KeyAudit 数据视角

📊 KeyAudit data: Sui historical leak records: 1485770

← 回到列表