Python wrapper for the Hadoop WebHDFS REST API
Project description
webhdfspy
Descripción 📄
El webhdfspy es una biblioteca que proporciona una interfaz conveniente para interactuar con WebHDFS, el servicio de sistema de archivos distribuido de Hadoop a través de HTTP. Este wrapper simplifica el proceso de realizar operaciones como crear archivos, leer y escribir datos, crear directorios y administrar permisos en el clúster Hadoop utilizando la API de WebHDFS.
Características principales:
- Conexión y autenticación sencillas con clústeres Hadoop a través de HTTP.
- Métodos simples y intuitivos para realizar operaciones básicas de sistema de archivos, como crear, leer y escribir archivos, así como también crear y administrar directorios.
- Compatibilidad con las operaciones más comunes de WebHDFS, como agregar datos a un archivo existente, obtener información sobre archivos y directorios, cambiar permisos y propietarios, y más.
- Manejo de errores y excepciones para una experiencia de uso robusta y segura.
El webhdfspy es una herramienta útil para desarrolladores que deseen interactuar con clústeres Hadoop y realizar operaciones en HDFS de forma sencilla y eficiente.
Example
Agregar el siguiente codigo para ejecutar web app con ejemplo de uso
from webhdfs_py import example
if __name__ == "__main__":
example.run()
TODO
- Generarlizar el proyecto.
In Progress
- Implementar para instalar con PIP
Done ✓
- Generar el primer desarrollo
- Implementar
Tabla de Métodos y Descripciones 📑
| Método | Descripción |
|---|---|
| create_file | Crea un nuevo archivo en HDFS en la ruta especificada |
| append_file | Realiza un append de datos en un archivo dentro de HDFS |
| read_file | Abre el archivo completo (permite guardar en destino), tener en cuenta el peso del archivo |
| stream_file | Genera un iterable del archivo permitiendo guardar los datos del archivo en bloques |
| make_dir | Crea un nuevo directorio |
| rename_file_dir | Renombra un archivo o un directorio |
| delete_file_dir | Elimina un archivo o directorio |
| get_file_dir_status | Retorna en JSON el estado de un archivo o directorio (Permisos, replicaciones, etc.) |
| get_content_summary | Retorna en JSON un resumen de un directorio en específico (Cantidad de archivos, peso, cantidad de archivos) |
| get_file_checksum | Retorna en JSON el checksum y el algoritmo |
| list_dir | Retorna en JSON el estado de los archivos o directorios de la ruta en HDFS |
| exists_file_dir | Retorna BOOL si existe el directorio o archivo |
| set_permission | Setea los permisos de un archivo o directorio |
| set_owner | Setea el owner y/o el grupo |
La documentacion se puede revisar en:
Developer
Erik Alejandro Abdala
Project details
Release history Release notifications | RSS feed
Download files
Download the file for your platform. If you're not sure which to choose, learn more about installing packages.
Source Distributions
Built Distribution
Filter files by name, interpreter, ABI, and platform.
If you're not sure about the file name format, learn more about wheel file names.
Copy a direct link to the current filters
File details
Details for the file webhdfs_py_client-0.2-py2.py3-none-any.whl.
File metadata
- Download URL: webhdfs_py_client-0.2-py2.py3-none-any.whl
- Upload date:
- Size: 12.8 kB
- Tags: Python 2, Python 3
- Uploaded using Trusted Publishing? No
- Uploaded via: twine/4.0.2 CPython/3.9.13
File hashes
| Algorithm | Hash digest | |
|---|---|---|
| SHA256 |
3ce15be37e1a9aa644de689ba1b815f24ce3cda3e1e8d774e0153363b7c3e003
|
|
| MD5 |
dbda65b93f89d1bffed62f981fa253d5
|
|
| BLAKE2b-256 |
52d2a8d5f7846e6a846f28b5fff76dbdff3e540343cb3e472c245353777eb5ea
|