Deduplicación SHA-256

Aplica hash SHA-256 antes de subir para reutilizar IDs de transacción, reducir gasto duplicado en AR y conservar el historial de envíos.

Antes de cada subida se comprueba un hash SHA-256 del contenido frente al índice de hashes en PostgreSQL. Los payloads idénticos devuelven la TX Arweave existente al instante: cero AR gastados.

Deja de pagar almacenamiento permanente por contenido que ya tienes.

La deduplicación es uno de los ROI más claros de la plataforma. Evita escrituras innecesarias, reduce gasto repetido y acelera comprobaciones previas.

Valor

Reduce el gasto por subidas repetidas

Las comprobaciones por hash evitan que payloads duplicados consuman AR, tiempo de confirmación y procesamiento downstream.

Mejora la economía de migraciones

Backfills grandes e importaciones de archivo se benefician cuando el duplicado aparece entre lotes o sistemas.

Haz defendible la estrategia de almacenamiento

Finanzas ve que el almacenamiento permanente se usa de forma deliberada y no como sumidero ciego.

Casos de uso

Repositorios documentales

Los repositorios legales y de cumplimiento reciben a menudo duplicados. Dedup elimina gasto AR redundante manteniendo el historial de subidas.

Pipelines de medios

La ingesta CDN recibe el mismo activo desde varias fuentes. Dedup SHA-256 colapsa duplicados en un único TX permanente.

Copias de seguridad enterprise

Las estrategias incrementales generan mucha duplicación entre snapshots. Dedup por contenido asegura que solo lo netamente nuevo consuma saldo AR.

Para operadores

  • Ejecuta dedup por archivo o en lote antes de rutas de subida con coste relevante.
  • Invalida caché a propósito cuando necesites conciliar estado o forzar recomputación.
  • Combínalo con operaciones por lotes para reducir desperdicio en importaciones y publicaciones masivas.

Para compradores

  • Encaja con clientes con archivos reemitidos, réplicas de archivo o exportaciones operativas pesadas.
  • Útil en demos: el ahorro es inmediato y fácil de explicar.
  • Refuerza conversaciones sobre gobernanza de costes, no solo volumen bruto.

¿Y si dos archivos tienen el mismo contenido pero distintos metadatos?

La deduplicación es por contenido: solo el hash SHA-256 de los bytes en bruto. Mismos bytes con distinto nombre o etiquetas = duplicado. El txId devuelto apunta a la subida original.

¿Puedo desactivar la deduplicación?

Sí. Pasa dedup: false en el cuerpo de la petición. El archivo se sube como nueva transacción aunque exista el mismo hash.

¿Funciona entre claves API de la misma cuenta?

Por defecto el alcance es por cuenta. Los planes enterprise pueden configurar dedup entre cuentas para entornos multi-equipo.