MiaAI-Lab GitHub avatar

DeepSeek-v4-Flash-DSpark-Abliterated-Uncensored

MiaAI-Lab

在两个 NVIDIA DGX Spark 节点上部署经过“去审查”(abliterated)的 DeepSeek-V4-Flash-DSpark 模型,使用 vLLM 配合推测解码和 nvFP4 KV 缓存。

Stars

21

7 天增长

暂无数据

Fork 数

3

开放 Issue

0

开源协议

NOASSERTION

最近更新

2026-07-10

AI 仓库情报摘要
FR-AI / ANALYSIS

为什么值得关注

在双 DGX Spark 硬件上实现了 57 tok/s 的平均解码速度及 100 万 token 上下文窗口,并提供完全可定制的去审查流程来移除安全拒绝响应。

适合谁使用

  • 在多节点集群上部署大语言模型的开发者
  • 研究模型去审查与拒绝行为消除的研究人员
  • 使用 NVIDIA DGX Spark 和 InfiniBand 网络的工程师
  • 需要高性能本地推理的 AI 应用构建者

典型使用场景

  • 运行无审查的大语言模型以生成不受限制的内容
  • 部署多节点高吞吐推理并启用推测解码
  • 通过调整层范围和投影强度自定义拒绝行为
  • 集成 pi agent 等智能体框架进行代码生成

项目优势

  • 在 1M 上下文下实现 57 tok/s 平均解码速度(双 DGX Spark 实测)
  • 32 个 prompt 测试中 100% 绕过拒绝响应
  • 提供完整的去审查流程,支持混合层范围处理
  • 通过单一脚本完成多节点集群的启动与关闭

使用前须知

  • 需要两台昂贵的 DGX Spark 节点并通过 InfiniBand/RoCE 连接
  • 无审查模型可能输出有害内容,且项目未包含安全层
  • 客户端温度参数强制设为 0.0、思考功能强制关闭
  • 性能仅在所描述的特定硬件和网络配置下得到验证

README 快速开始

Quick start

项目描述

DeepSeek V4 Flash DSpark Abliterated (Uncensored) — 2× DGX Spark serving

相关仓库与替代方案

根据分类、Topic 和编程语言匹配的相似项目。

lopopolo
精选
lopopolo GitHub avatar

harness-engineering

Harness Engineering is a methodology for improving coding agent outputs by carefully crafting the environment around them—providing curated context, tools, and executable constraints that encode an organization’s nonfunctional requirements and cumulative lessons.

AI 与机器学习AI 智能体
2,390
slvDev
精选
slvDev GitHub avatar

esp32-ai

A 28.9 million parameter language model runs on an $8 ESP32-S3 microcontroller entirely on-device, generating simple stories at about 9.5 tokens per second.

AI 与机器学习大语言模型
1,960
littledivy
精选
littledivy GitHub avatar

mimic

mimic captures traffic from any iOS or web app and automatically generates a Python client library that lets you call the app's API like a regular library.

AI 与机器学习
1,482