tags: - llama - llama3 - deepseek - deepseek-r1 - text-generation - gguf - abliterated - uncensored - reasoning
DeepSeek-R1-Distill-Llama-70B-abliterated - GGUF
Esta es la colecci贸n integral y completa de cuantizaciones en formato GGUF del modelo DeepSeek-R1-Distill-Llama-70B-abliterated, preparadas localmente para su uso con llama.cpp, Ollama, LM Studio o Text-Generation-WebUI.
Este modelo combina la destilaci贸n de razonamiento avanzado (capacidad de pensamiento l贸gico profundo mediante tags <think>) basada en el modelo Llama-70B de Meta, pero procesada con t茅cnicas de abliteration para remover de ra铆z los bloqueos y filtros de censura artificiales del sistema, respondiendo sin restricciones.
馃搵 Archivos Disponibles (Colecci贸n Completa sin Splits)
| Archivo | Tama帽o Est. | BPW (Bits por Peso) | Perfil de Uso Recomendado |
|---|---|---|---|
DeepSeek-R1-Distill-Llama-70B-abliterated-F16.gguf |
~141.0 GB | 16.00 | Molde Base Completo. Fidelidad absoluta de los pesos en coma flotante. |
DeepSeek-R1-Distill-Llama-70B-abliterated-Q8_0.gguf |
~75.0 GB | 8.50 | Calidad id茅ntica al original, ideal para exprimir en tarjetas masivas locales como la GPU NVIDIA A100. |
DeepSeek-R1-Distill-Llama-70B-abliterated-Q6_K.gguf |
~60.0 GB | 6.59 | Alt铆sima retenci贸n del 谩rbol de razonamiento l贸gico con un peso optimizado. Ideal para exprimir en tarjetas masivas locales como la GPU NVIDIA CMP-170HX. |
DeepSeek-R1-Distill-Llama-70B-abliterated-Q5_K_M.gguf |
~52.0 GB | 5.69 | Punto Dulce Recomendado. Mantiene intacta la coherencia del pensamiento profundo reduciendo el peso de forma cr铆tica. |
DeepSeek-R1-Distill-Llama-70B-abliterated-Q5_K_S.gguf |
~50.0 GB | 5.54 | Variante de 5 bits compacta. |
DeepSeek-R1-Distill-Llama-70B-abliterated-Q4_K_M.gguf |
~44.0 GB | 4.85 | El m谩s buscado. Balance 贸ptimo para correr inferencias de 70B en setups hogare帽os avanzados. |
DeepSeek-R1-Distill-Llama-70B-abliterated-Q4_K_S.gguf |
~41.0 GB | 4.58 | Variante compacta de 4 bits para acelerar la velocidad de tokens por segundo. |
DeepSeek-R1-Distill-Llama-70B-abliterated-Q3_K_L.gguf |
~37.0 GB | 4.01 | Compresi贸n media alta de 3 bits. Conserva el razonamiento b谩sico. |
DeepSeek-R1-Distill-Llama-70B-abliterated-Q3_K_M.gguf |
~34.0 GB | 3.66 | Variante de 3 bits intermedia. |
DeepSeek-R1-Distill-Llama-70B-abliterated-Q3_K_S.gguf |
~31.0 GB | 3.44 | Variante de 3 bits ligera. |
DeepSeek-R1-Distill-Llama-70B-abliterated-Q2_K.gguf |
~28.0 GB | 2.90 | Compresi贸n Extrema. Puede experimentar problemas menores en la estructura de las etiquetas internas. Solo para desarrollo experimental. |
Nota: Los tama帽os son estimaciones iniciales de referencia basadas en el peso nativo del modelo en safetensors; se recomienda verificar el tama帽o final en disco tras la compilaci贸n local.
馃挕 Modo de Uso Destacado
Al ser un modelo de razonamiento, se recomienda utilizar un formato de prompt limpio que respete la generaci贸n nativa de la cadena de pensamiento:
./llama-cli -m DeepSeek-R1-Distill-Llama-70B-abliterated-Q4_K_M.gguf -n 1024 -p "驴C贸mo funciona un reactor de fusi贸n nuclear?"
鈿栵笍 Descargo de Responsabilidad
Model tree for Thaurock/DeepSeek-R1-Distill-Llama-70B-abliterated-GGUF
Base model
deepseek-ai/DeepSeek-R1-Distill-Llama-70B