Deduplicación SHA-256
Aplica hash SHA-256 antes de subir para reutilizar IDs de transacción, reducir gasto duplicado en AR y conservar el historial de envíos.
Antes de cada subida se comprueba un hash SHA-256 del contenido frente al índice de hashes en PostgreSQL. Los payloads idénticos devuelven la TX Arweave existente al instante: cero AR gastados.
Deja de pagar almacenamiento permanente por contenido que ya tienes.
La deduplicación es uno de los ROI más claros de la plataforma. Evita escrituras innecesarias, reduce gasto repetido y acelera comprobaciones previas.
Valor
Reduce el gasto por subidas repetidas
Las comprobaciones por hash evitan que payloads duplicados consuman AR, tiempo de confirmación y procesamiento downstream.
Mejora la economía de migraciones
Backfills grandes e importaciones de archivo se benefician cuando el duplicado aparece entre lotes o sistemas.
Haz defendible la estrategia de almacenamiento
Finanzas ve que el almacenamiento permanente se usa de forma deliberada y no como sumidero ciego.
Casos de uso
Repositorios documentales
Los repositorios legales y de cumplimiento reciben a menudo duplicados. Dedup elimina gasto AR redundante manteniendo el historial de subidas.
Pipelines de medios
La ingesta CDN recibe el mismo activo desde varias fuentes. Dedup SHA-256 colapsa duplicados en un único TX permanente.
Copias de seguridad enterprise
Las estrategias incrementales generan mucha duplicación entre snapshots. Dedup por contenido asegura que solo lo netamente nuevo consuma saldo AR.
Para operadores
- Ejecuta dedup por archivo o en lote antes de rutas de subida con coste relevante.
- Invalida caché a propósito cuando necesites conciliar estado o forzar recomputación.
- Combínalo con operaciones por lotes para reducir desperdicio en importaciones y publicaciones masivas.
Para compradores
- Encaja con clientes con archivos reemitidos, réplicas de archivo o exportaciones operativas pesadas.
- Útil en demos: el ahorro es inmediato y fácil de explicar.
- Refuerza conversaciones sobre gobernanza de costes, no solo volumen bruto.
¿Y si dos archivos tienen el mismo contenido pero distintos metadatos?
La deduplicación es por contenido: solo el hash SHA-256 de los bytes en bruto. Mismos bytes con distinto nombre o etiquetas = duplicado. El txId devuelto apunta a la subida original.
¿Puedo desactivar la deduplicación?
Sí. Pasa dedup: false en el cuerpo de la petición. El archivo se sube como nueva transacción aunque exista el mismo hash.
¿Funciona entre claves API de la misma cuenta?
Por defecto el alcance es por cuenta. Los planes enterprise pueden configurar dedup entre cuentas para entornos multi-equipo.