[R] Demande d'orientation
Posté : ven. 15 août 2014 20:22
Bonsoir à tous,
Je viens requérir les conseils de quelques experts. Je ne suis pas un grand habitué d'AutoIt ; je ne m'en sers que très ponctuellement pour des usages bien précis. Pour ce que j'ai à réaliser, j'ai essayé diverses choses, mais je crains de ne trop m'égarer et de perdre trop de temps que je n'ai pas. Alors je vous sollicite pour obtenir une orientation pour voir comment m'y prendre.
Finalité : il s'agit de traiter du fichier CSV.
Commentaires sur les fichiers CSV sources :
1- sans interactions particulières et sans nécessité d'affichage des données :
Une fois tout cela exposé, c'est là que je sollicite une 'grande orientation' : me recommanderiez-vous de partir sur du traitement avec une UDF dédiée au CSV (j'en ai croisé plusieurs, de différentes versions, avec parfois quelques fonctionnalités qui me seraient utiles, d'autres pas du tout), ne traiter les choses qu'en jonglant avec les _Array, envisager peut-être du sqlite, ou encore autre chose que je n'aurais pas du tout évoqué ?
Merci d'avoir jeté un coup d’œil.
Je viens requérir les conseils de quelques experts. Je ne suis pas un grand habitué d'AutoIt ; je ne m'en sers que très ponctuellement pour des usages bien précis. Pour ce que j'ai à réaliser, j'ai essayé diverses choses, mais je crains de ne trop m'égarer et de perdre trop de temps que je n'ai pas. Alors je vous sollicite pour obtenir une orientation pour voir comment m'y prendre.
Finalité : il s'agit de traiter du fichier CSV.
Commentaires sur les fichiers CSV sources :
- Ils proviennent probablement de Excel, et leur délimiteur sera toujours ;
- Ils contiennent un nombre aléatoires de lignes (de ce que j'ai constaté, d'une dizaine à quelques centaines)
- Ils contiennent toujours le même nombre de colonnes, chacune étant toujours formaté de la même façon, mais bémol pas toujours dans le même ordre (même si 99% le sont).
- La première ligne contient le nom des colonnes. Les noms de ces colonnes sont toujours les mêmes (mais leur agencement peut varier comme dit juste avant)
- Un fichier joint est donné à titre d'exemple de fichiers sources.
1- sans interactions particulières et sans nécessité d'affichage des données :
- Identifier l'ordre des colonnes via des recherches de texte pour insérer leur numéros en variables ? (dans l'idée de pouvoir traiter indiféremment les fichiers qui ne sont pas ordonnés de la même façon.)
- Des colonnes ne seront jamais exploitées, il faudrait pouvoir les supprimer automatiquement sans interactions.
- Il faudrait pouvoir supprimer des lignes complètes en fonction du contenu de certains champs : dans le fichier d'exemple CSV, vous noterez que du titre 24 au titre 48, il y a des 'Oui' et des 'Non'. Ainsi, certaines lignes comportant certains champs à 'Nom' seraient supprimées sans plus de traitement.
- insérer une nouvelle colonne avec, pour chacune des lignes, un identifiant 'maison' sous forme de texte en fonction de la valeur d'un autre champ (chiffre) de la ligne
- une exportation du fichier réordonné dans un ordre de colonnes donné, sans toutes les insérer toutes fois, dans un nouveau fichier CSV propre.
- un affichage écran de certains champs de certaines lignes, avec possiblité de faire défiler ces mêmes champs d'une ligne à l'autre (dans une optique d'aide visuelle à la saisie sur un outil tiers).
Une fois tout cela exposé, c'est là que je sollicite une 'grande orientation' : me recommanderiez-vous de partir sur du traitement avec une UDF dédiée au CSV (j'en ai croisé plusieurs, de différentes versions, avec parfois quelques fonctionnalités qui me seraient utiles, d'autres pas du tout), ne traiter les choses qu'en jonglant avec les _Array, envisager peut-être du sqlite, ou encore autre chose que je n'aurais pas du tout évoqué ?
Merci d'avoir jeté un coup d’œil.