2010-10-04 4 views
0

J'ai un fichier texte (sortie d'un ancien programme) que je voudrais nettoyer. Voici un exemple du contenu du fichier.analyser le texte avec Matlab

*|V|0|0|0|t|0|1|1|4|11|T4|H01|||||||||||||||||||||| 


P|40|0.01|10|1|1|0|40|1|1|1||1|*||0|0|0|||||||||||||||| 
*|A1|A1|A7|A16|F|F|F|F|F|F|F||||||||||||||||||||||| 
*|||||kV|kV|kV|MW|MVAR|S|S|||||||||||||||||||||||| 
N|I|01|H01N01|H01N01|132|125.4|138.6|0|0||||||||||||||||||||| 
N|I|01|H01N02|H01N02|20|19|21|0|0||||||||||||||||||||||| 
N|I|01|H01N03|H01N03|20|19|21|0.42318823|0.204959433||||||||||||||||||||| 
||||||||||||||||| 
||||||||||||||||| 
L|I|H010203|H01N02|H01N03|1.884|360|0.41071|0.207886957||3.19E-08|3.19E-08||||||||||| 
L|I|H010304|H01N03|H01N04|1.62|360|0.35316|0.1787563||3.19E-08||3.19E-08|||||||||||| 
L|I|H010405|H01N04|H01N05|0.532|360|0.11598|0.058702686||3.19E-08||3.19E-08||||||||||| 
L|I|H010506|H01N05|H01N06|1.284|360|0.27991|0.14168092||3.19E-08||3.19E-08|||||||||||| 
S|SH01|SEZIONE01|1|-3|+3|-100|+100||||||||||||||||||| 
S|SH02|SEZIONE02|1|-3|+3|-100|+100||||||||||||||||||| 
S|SH03|SEZIONE03|1|-3|+3|-100|+100||||||||||||||||||| 
||||||||||||asasasas 
S|SH04|SEZIONE04|1|-3|+3|-100|+100||||||||||||||||||| 
*|comment 
S|SH05|SEZIONE05|1|-3|+3|-100|+100||||||||||||||||||| 

Je voudrais que ça ressemble à:

*|V|0|0|0|t|0|1|1|4|11|T4|H01|||||||||||||||||||||| 
*|comment 
*|comment 
P|40|0.01|10|1|1|0|40|1|1|1||1|*||0|0|0|||||||||||||||| 
*|A1|A1|A7|A16|F|F|F|F|F|F|F||||||||||||||||||||||| 
*|||||kV|kV|kV|MW|MVAR|S|S|||||||||||||||||||||||| 
N|I|01|H01N01|H01N01|132|125.4|138.6|0|0||||||||||||||||||||| 
N|I|01|H01N02|H01N02|20|19|21|0|0||||||||||||||||||||||| 
N|I|01|H01N03|H01N03|20|19|21|0.42318823|0.204959433||||||||||||||||||||| 
*|comment|||||||||||||||| 
*|comment||||||||||||||||| 
L|I|H010203|H01N02|H01N03|1.884|360|0.41071|0.207886957||3.19E-08||3.19E-08||||||||||| 
L|I|H010304|H01N03|H01N04|1.62|360|0.35316|0.1787563||3.19E-08||3.19E-08|||||||||||||| 
L|I|H010405|H01N04|H01N05|0.532|360|0.11598|0.058702686||3.19E-08||3.19E-08||||||||||| 
L|I|H010506|H01N05|H01N06|1.284|360|0.27991|0.14168092||3.19E-08||3.19E-08|||||||||||| 
*|comment 
*|comment 
S|SH01|SEZIONE01|1|-3|+3|-100|+100||||||||||||||||||| 
S|SH02|SEZIONE02|1|-3|+3|-100|+100||||||||||||||||||| 
S|SH03|SEZIONE03|1|-3|+3|-100|+100||||||||||||||||||| 
S|SH04|SEZIONE04|1|-3|+3|-100|+100||||||||||||||||||| 
S|SH05|SEZIONE05|1|-3|+3|-100|+100||||||||||||||||||| 

Les données sont divisées en 'paquets' distincte de la première lettre (PNLS). Chaque paquet doit avoir au moins deux lignes dédiées (* |) qui sont ensuite lues comme un commentaire. Les lignes blanches entre les différentes lettres sont remplies de caractères * |. Les lignes entre les différentes lettres qui ne commencent pas par * | être ajouté. Les lignes blanches et les caractères «aléatoires» entre des lettres identiques sont supprimés.

Peut-être que cela est plus clair dans les fichiers d'exemple.

Comment manipuler le texte? Merci d'avance pour votre aide.

+0

Quelle est votre question? –

Répondre

0

Utilisez fileread pour obtenir votre fichier dans MATLAB.

text = fileread('my file to clean.txt'); 

Divisez la chaîne de caractères résultante en la divisant sur les nouvelles lignes. (Les caractères de nouvelles lignes dépendent de votre système d'exploitation.)

lines = regexp(text, '\r\n', 'split'); 

Il est pas tout à fait clair exactement comment vous voulez que le fichier nettoyé, mais ces choses peut vous aider à démarrer.

% Replace blank lines with comment string 
blanks = cellfun(@isempty, lines); 
comment = '*|comment'; 
lines(blanks) = cellstr(repmat(comment, sum(blanks), 1)) 

% Prepend comment string to lines that start with a pipe 
lines = regexprep(lines, '^\|', '\*\|comment\|') 

Vous aurez besoin de vous familiariser avec les expressions régulières. Il y a un bon guide pour eux au regular-expressions.info.

+0

merci pour l'aide. J'ai vu le lien est très utile. – Marietto85

Questions connexes