/[webpac]/trunk/all2xml.pl
This is repository of my old source code which isn't updated any more. Go to git.rot13.org for current projects!
ViewVC logotype

Diff of /trunk/all2xml.pl

Parent Directory Parent Directory | Revision Log Revision Log | View Patch Patch

revision 21 by dpavlin, Sun Feb 23 00:00:51 2003 UTC revision 108 by dpavlin, Mon Jul 14 18:20:27 2003 UTC
# Line 8  use XML::Simple; Line 8  use XML::Simple;
8  use Text::Unaccent 1.02;        # 1.01 won't compile on my platform,  use Text::Unaccent 1.02;        # 1.01 won't compile on my platform,
9  use Text::Iconv;  use Text::Iconv;
10  use Config::IniFiles;  use Config::IniFiles;
11    use Encode;
12    
13  $|=1;  $|=1;
14    
# Line 17  die "FATAL: can't find configuration fil Line 18  die "FATAL: can't find configuration fil
18    
19  my $config;  my $config;
20    
21  use index_DBI;  # there is no other, right now ;-)  #use index_DBI;         # default DBI module for index
22    use index_DBI_cache;    # faster DBI module using memory cache
23  my $index = new index_DBI();    # open index  my $index;
24    
25  my %opts;  my %opts;
26    
# Line 31  my %opts; Line 32  my %opts;
32    
33  getopts('d:m:qs', \%opts);  getopts('d:m:qs', \%opts);
34    
35  my $db_dir;  my $path;       # this is name of database
36    
37    Text::Iconv->raise_error(0);     # Conversion errors don't raise exceptions
38    
39  #die "usage: $0 -d [database_dir] -m [database1,database2] " if (! %opts);  # this is encoding of all files on disk, including import_xml/*.xml file and
40    # filter/*.pm files! It will be used to store strings in perl internally!
41    my $codepage = 'ISO-8859-2';
42    
43    my $utf2cp = Text::Iconv->new('UTF-8',$codepage);
44    # this function will convert data from XML files to local encoding
45    sub x {
46            return $utf2cp->convert($_[0]);
47    }
48    
49  #print Dumper($config->{indexer});  # decode isis/excel or other import codepage
50  #print "-" x 70,"\n";  my $import2cp;
51    
52  Text::Iconv->raise_error(1);     # Conversion errors raise exceptions  # outgoing xml must be in UTF-8
53    my $cp2utf = Text::Iconv->new($codepage,'UTF-8');
54    
55  #my $isis_codepage = Text::Iconv->new($config->{isis_codepage},'UTF8');  # mapping between data type and tag which specify
56  #my $index_codepage = Text::Iconv->new($config->{isis_codepage},$config->{index_codepage});  # format in XML file
57  my $isis_codepage;  my %type2tag = (
58  my $index_codepage;          'isis' => 'isis',
59  my $cludge_codepage = Text::Iconv->new('UTF8','ISO8859-1');          'excel' => 'column',
60  my $xml_codepage;          'marc' => 'marc',
61            'feed' => 'feed'
62    );
63    
64  sub isis2xml {  sub data2xml {
65    
66          use xmlify;          use xmlify;
67    
68            my $type = shift @_;
69          my $row = shift @_;          my $row = shift @_;
70          my $add_xml = shift @_;          my $add_xml = shift @_;
71            # needed to read values from configuration file
72            my $cfg = shift @_;
73            my $database = shift @_;
74    
75          my $xml;          my $xml;
76    
# Line 62  sub isis2xml { Line 80  sub isis2xml {
80    
81          my %field_usage;        # counter for usage of each field          my %field_usage;        # counter for usage of each field
82    
83          foreach my $field (keys %{$config->{indexer}}) {          # sort subrouting using order="" attribute
84            sub by_order {
85                    my $va = $config->{indexer}->{$a}->{order} ||
86                            $config->{indexer}->{$a};
87                    my $vb = $config->{indexer}->{$b}->{order} ||
88                            $config->{indexer}->{$b};
89    
90                    return $va <=> $vb;
91            }
92    
93            foreach my $field (sort by_order keys %{$config->{indexer}}) {
94    
95                    $field=x($field);
96                  $field_usage{$field}++;                  $field_usage{$field}++;
97    
98                  my $swish_data = "";                  my $swish_data = "";
99                  my $display_data = "";                  my $display_data = "";
100                    my $line_delimiter;
101    
102                    my ($swish,$display);
103    
104                  foreach my $x (@{$config->{indexer}->{$field}->{isis}}) {                  my $tag = $type2tag{$type} || die "can't find which tag to use for type $type";
105                    foreach my $x (@{$config->{indexer}->{$field}->{$tag}}) {
106    
107                            my $format = x($x->{content});
108                            my $delimiter = x($x->{delimiter}) || ' ';
109    
110                            my $repeat_off = 0;             # repeatable offset
111    
                         my $format = $x->{content};  
112                          my ($s,$d,$i) = (1,1,0);        # swish, display default                          my ($s,$d,$i) = (1,1,0);        # swish, display default
113                          $s = 0 if (lc($x->{type}) eq "display");                          $s = 0 if (lc($x->{type}) eq "display");
114                          $d = 0 if (lc($x->{type}) eq "swish");                          $d = 0 if (lc($x->{type}) eq "swish");
115                          ($s,$d,$i) = (0,0,1) if (lc($x->{type}) eq "index");                          ($s,$d,$i) = (0,0,1) if (lc($x->{type}) eq "index");
 #print STDERR "## s: $s d: $d i: $i ## $format ##\n";    
116    
117                          # FIX: this is ugly, UGLY, cludge string is returned                          # what will separate last line from this one?
118                          # in UTF8 encoding , but as if source charset                          if ($display_data && $x->{append} && $x->{append} eq "1") {
119                          # is ISO8859-1 and not some other. This break other                                  $line_delimiter = ' ';
120                          # character encodings, so we convert it first                          } elsif ($display_data) {
121                          # back to ISO8859-1                                  $line_delimiter = '<br/>';
                         $format = $cludge_codepage->convert($format);  
   
                         my ($swish,$display) = parse_format($format,$row);  
 #print STDERR "s: $swish\nd: $display\n" if ($swish);  
   
 #print STDERR "swish: $swish<-- display: $display<--\n";  
   
                         # filter="name" ; filter this field through  
                         # filter/[name].pm  
                         my $filter;  
                         if ($x->{filter}) {  
                                 $filter = "filter/".$x->{filter}.".pm";  
                                 require $filter;  
122                          }                          }
123                          # type="swish" ; field for swish  
124                          if ($s && $swish) {                          # init vars so that we go into while...
125                            ($swish,$display) = (1,1);
126    
127                            # placeholder for all repeatable entries for index
128                            my @index_data;
129                            my $index_filter;
130    
131                            # while because of repeatable fields
132                            while ($swish || $display) {
133                                    ($swish,$display) = parse_format($type, $format,$row,$repeat_off++,$import2cp);
134                                    if ($repeat_off > 1000) {
135                                            print STDERR "loop (more than 1000 repeatable fields) deteced in $row, $format\n";
136                                            last;
137                                    }
138                                    
139                                    # filter="name" ; filter this field through
140                                    # filter/[name].pm
141                                    my $filter = $x->{filter};
142                                  if ($filter) {                                  if ($filter) {
143                                          $swish_data .= join(" ",&filter($swish));                                          require "filter/".$filter.".pm";
144                                  } else {                                  }
145                                          $swish_data .= $swish if ($s && $swish);                                  # type="swish" ; field for swish
146                                    if ($s && $swish) {
147                                            if ($filter) {
148                                                    no strict 'refs';
149                                                    $swish_data .= join(" ",&$filter($swish));
150                                            } else {
151                                                    $swish_data .= $swish;
152                                            }
153                                  }                                  }
                         }  
154    
155                          # type="display" ; field for display                                  # type="display" ; field for display
156                          if ($d && $display) {                                  if ($d && $display) {
157                                  if ($filter) {                                          if ($line_delimiter && $display_data) {
158                                          $display_data .= join(" ",&filter($display));                                                  $display_data .= $line_delimiter;
159                                  } else {                                                  undef $line_delimiter;
160                                          $display_data .= $display;                                          }
161                                            if ($filter) {
162                                                    no strict 'refs';
163                                                    $display_data .= join($delimiter,&$filter($display));
164                                            } else {
165                                                    if ($display_data) {
166                                                            $display_data .= $delimiter.$display;
167                                                    } else {
168                                                            $display_data .= $display;
169                                                    }
170                                            }
171                                    }
172                                                    
173                                    # type="index" ; insert into index
174                                    if ($i && $display) {
175                                            push @index_data, $display;
176                                            $index_filter = $filter if ($filter);
177                                  }                                  }
178                          }                          }
179                                            
180                          # type="index" ; insert into index                          # fill data in index
181                          if ($i && $display) {                          if (@index_data) {
182                                  my $index_data = $index_codepage->convert($display) || $display;                                  if ($index_filter) {
183                                  if ($filter) {                                          no strict 'refs';
184                                          foreach my $d (&filter($index_data)) {                                          foreach my $d (&$index_filter(@index_data)) {
185                                                  $index->insert($field, $d, $db_dir);                                                  $index->insert($field, $d, $path);
186                                          }                                          }
187                                  } else {                                  } else {
188                                          $index->insert($field, $index_data, $db_dir);                                          foreach my $d (@index_data) {
189                                                    $index->insert($field, $d, $path);
190                                            }
191                                  }                                  }
192                          }                          }
193                  }                  }
194    
195                    # now try to parse variables from configuration file
196                    foreach my $x (@{$config->{indexer}->{$field}->{'config'}}) {
197    
198                            my $delimiter = x($x->{delimiter}) || ' ';
199                            my $val = $cfg->val($database, x($x->{content}));
200    
201                            my ($s,$d,$i) = (1,1,0);        # swish, display default
202                            $s = 0 if (lc($x->{type}) eq "display");
203                            $d = 0 if (lc($x->{type}) eq "swish");
204                            ($s,$d,$i) = (0,0,1) if (lc($x->{type}) eq "index");
205    
206                            if ($val) {
207                                    $display_data .= $delimiter.$val if ($d);
208                                    $swish_data .= $val if ($s);
209                                    $index->insert($field, $val, $path) if ($i);
210                            }
211    
212                    }
213    
214    
 #print STDERR "s_d: $swish_data\nd_d: $display_data\n" if ($swish_data);  
215                  if ($display_data) {                  if ($display_data) {
                         $display_data = $isis_codepage->convert($display_data) || die "Can't convert '$display_data' !";  
                         # FIX: this is removed and replaced by html tag.  
                         #$xml .= xmlify($field."_display", $display_data);  
216    
217                          if ($field eq "headline") {                          if ($field eq "headline") {
218                                  $xml .= xmlify("headline", $display_data);                                  $xml .= xmlify("headline", $display_data);
# Line 151  sub isis2xml { Line 230  sub isis2xml {
230                                          print STDERR "WARNING: field '$field' doesn't have 'name' attribute!";                                          print STDERR "WARNING: field '$field' doesn't have 'name' attribute!";
231                                  }                                  }
232                                  if ($field_name) {                                  if ($field_name) {
233                                          $html .= $xml_codepage->convert($field_name);                                          $html .= x($field_name);
234                                  }                                  }
235                                  $html .= $display_data."###\n";                                  $html .= $display_data."###\n";
236                          }                          }
237                  }                  }
238                  if ($swish_data) {                  if ($swish_data) {
                         my $i = Text::Iconv->new($config->{isis_codepage},'ISO8859-2');  
239                          # remove extra spaces                          # remove extra spaces
240                          $swish_data =~ s/ +/ /g;                          $swish_data =~ s/ +/ /g;
241                          $swish_data =~ s/ +$//g;                          $swish_data =~ s/ +$//g;
242    
243                          $swish_data = $i->convert($swish_data);                          $xml .= xmlify($field."_swish", unac_string($codepage,$swish_data));
                         $xml .= xmlify($field."_swish",unac_string('ISO8859-2',$swish_data));  
                         #$swish_data = $isis_codepage->convert($swish_data)."##" || $swish_data;  
                         #$xml .= xmlify($field."_swish",unac_string($config->{isis_codepage},$swish_data));  
244                  }                  }
245    
246    
# Line 173  sub isis2xml { Line 248  sub isis2xml {
248    
249          # dump formatted output in <html>          # dump formatted output in <html>
250          if ($html) {          if ($html) {
251                  $xml .= xmlify("html",$html);                  #$xml .= xmlify("html",$html);
252                    $xml .= "<html><![CDATA[ $html ]]></html>";
253          }          }
254                    
255          if ($xml) {          if ($xml) {
 #print STDERR "x: $xml\n";  
256                  $xml .= $add_xml if ($add_xml);                  $xml .= $add_xml if ($add_xml);
257                  return "<xml>\n$xml</xml>\n";                  return "<xml>\n$xml</xml>\n";
258          } else {          } else {
# Line 187  sub isis2xml { Line 262  sub isis2xml {
262    
263  ##########################################################################  ##########################################################################
264    
265    # read configuration for this script
266  my $cfg = new Config::IniFiles( -file => $config_file );  my $cfg = new Config::IniFiles( -file => $config_file );
267    
268    # read global.conf configuration
269    my $cfg_global = new Config::IniFiles( -file => 'global.conf' );
270    
271    # open index
272    $index = new index_DBI(
273                    $cfg_global->val('global', 'dbi_dbd'),
274                    $cfg_global->val('global', 'dbi_dsn'),
275                    $cfg_global->val('global', 'dbi_user'),
276                    $cfg_global->val('global', 'dbi_passwd') || '',
277            );
278    
279    my $show_progress = $cfg_global->val('global', 'show_progress');
280    
281  foreach my $database ($cfg->Sections) {  foreach my $database ($cfg->Sections) {
282    
283          my $isis_db = $cfg -> val($database, 'isis_db');          my $type = lc($cfg -> val($database, 'type')) || die "$database doesn't have 'type' defined";
284          my $type = $cfg -> val($database, 'type');          my $add_xml = $cfg -> val($database, 'xml');    # optional
         my $add_xml = $cfg -> val($database, 'xml');  
   
         # read configuration for this type  
         $config=XMLin("./import_xml/$type.xml", forcearray => [ 'isis' ], forcecontent => 1);  
         $isis_codepage = Text::Iconv->new($config->{isis_codepage},'UTF8');  
         $index_codepage = Text::Iconv->new($config->{isis_codepage},$config->{index_codepage});  
         $xml_codepage = Text::Iconv->new($cfg->val($database,'xml_codepage'),'UTF8');  
   
         my $db = OpenIsis::open( $isis_db );  
         if (0) {  
 #       # FIX  
 #       if (! $db ) {  
                 print STDERR "WARNING: can't open '$isis_db'\n";  
                 next ;  
         }  
285    
286          my $max_rowid = OpenIsis::maxRowid( $db );  print STDERR "reading ./import_xml/$type.xml\n";
287    
288          print STDERR "Reading database: $isis_db [$max_rowid rows]\n";          # extract just type basic
289            my $type_base = $type;
290            $type_base =~ s/_.+$//g;
291    
292          my $path = $database;                   # was $isis_db          $config=XMLin("./import_xml/$type.xml", forcearray => [ $type2tag{$type_base}, 'config' ], forcecontent => 1);
293    
294            # output current progress indicator
295          my $last_p = 0;          my $last_p = 0;
296            sub progress {
297                    return if (! $show_progress);
298                    my $current = shift;
299                    my $total = shift || 1;
300                    my $p = int($current * 100 / $total);
301                    if ($p != $last_p) {
302                            printf STDERR ("%5d / %5d [%-51s] %-2d %% \r",$current,$total,"=" x ($p/2).">", $p );
303                            $last_p = $p;
304                    }
305            }
306    
307            my $fake_dir = 1;
308            sub fakeprogress {
309                    return if (! $show_progress);
310                    my $current = shift @_;
311    
312                    my @ind = ('-','\\','|','/','-','\\','|','/', '-');
313    
314                    $last_p += $fake_dir;
315                    $fake_dir = -$fake_dir if ($last_p > 1000 || $last_p < 0);
316                    if ($last_p % 10 == 0) {
317                            printf STDERR ("%5d / %5s [%-51s]\r",$current,"?"," " x ($last_p/20).$ind[($last_p/20) % $#ind]);
318                    }
319            }
320    
321            # now read database
322    print STDERR "using: $type...\n";
323    
324  #       { my $row_id = 4514;          if ($type_base eq "isis") {
325  # FIX  
326          for (my $row_id = 1; $row_id <= $max_rowid; $row_id++ ) {                  my $isis_db = $cfg -> val($database, 'isis_db') || die "$database doesn't have 'isis_db' defined!";
327                  my $row = OpenIsis::read( $db, $row_id );  
328                  if ($row && $row->{mfn}) {                  $import2cp = Text::Iconv->new($config->{isis_codepage},$codepage);
329  #print STDERR "mfn: ",$row->{mfn},"\n";                  my $db = OpenIsis::open( $isis_db );
330                          # output current process indicator  
331                          my $p = int($row->{mfn} * 100 / $max_rowid);                  # check if .txt database for OpenIsis is zero length,
332                          if ($p != $last_p) {                  # if so, erase it and re-open database
333                                  printf STDERR ("%5d / %5d [%-51s] %-2d %% \r",$row->{mfn},$max_rowid,"=" x ($p/2).">", $p ) if (! $opts{q});                  sub check_txt_db {
334                                  $last_p = $p;                          my $isis_db = shift || die "need isis database name";
335                          }                          if (-e $isis_db.".TXT") {
336                                    print STDERR "WARNING: removing .txt OpenIsis database...\n";
337                          if (my $xml = isis2xml($row,$add_xml)) {                                  unlink $isis_db.".TXT" || warn "FATAL: unlink error on '$isis_db.TXT': $!";
338  #print STDERR "--ret-->$xml\n";                                  my $db = OpenIsis::open( $isis_db );
339                                  print "Path-Name: $path#".int($row->{mfn})."\n";                                  return $db;
340                            }
341                    }
342    
343                    # EOF error
344                    if ($db == -1) {
345                            $db = check_txt_db($isis_db);
346                            if ($db == -1) {
347                                    print STDERR "FATAL: OpenIsis can't open zero size file $isis_db\n";
348                                    next;
349                            }
350                    }
351    
352                    # OpenIsis::ERR_BADF
353                    if ($db == -4) {
354                            print STDERR "FATAL: OpenIsis can't find file $isis_db\n";
355                            next;
356                    # OpenIsis::ERR_IO
357                    } elsif ($db == -5) {
358                            print STDERR "FATAL: OpenIsis can't access file $isis_db\n";
359                            next;
360                    } elsif ($db < 0) {
361                            print STDERR "FATAL: OpenIsis unknown error $db with file $isis_db\n";
362                            next;
363                    }
364    
365                    my $max_rowid = OpenIsis::maxRowid( $db );
366    
367                    # if 0 records, try to rease isis .txt database
368                    if ($max_rowid == 0) {
369                            # force removal of database
370                            $db = check_txt_db($isis_db);
371                            $max_rowid = OpenIsis::maxRowid( $db );
372                    }
373    
374                    print STDERR "Reading database: $isis_db [$max_rowid rows]\n";
375    
376                    my $path = $database;
377    
378                    for (my $row_id = 1; $row_id <= $max_rowid; $row_id++ ) {
379                            my $row = OpenIsis::read( $db, $row_id );
380                            if ($row && $row->{mfn}) {
381            
382                                    progress($row->{mfn}, $max_rowid);
383    
384                                    my $swishpath = $path."#".int($row->{mfn});
385    
386                                    if (my $xml = data2xml($type_base,$row,$add_xml,$cfg,$database)) {
387                                            $xml = $cp2utf->convert($xml);
388                                            use bytes;      # as opposed to chars
389                                            print "Path-Name: $swishpath\n";
390                                            print "Content-Length: ".(length($xml)+1)."\n";
391                                            print "Document-Type: XML\n\n$xml\n";
392                                    }
393                            }
394                    }
395                    # for this to work with current version of OpenIsis (0.9.0)
396                    # you might need my patch from
397                    # http://www.rot13.org/~dpavlin/projects/openisis-0.9.0-perl_close.diff
398                    OpenIsis::close($db);
399                    print STDERR "\n";
400    
401            } elsif ($type_base eq "excel") {
402                    use Spreadsheet::ParseExcel;
403                    use Spreadsheet::ParseExcel::Utility qw(int2col);
404                    
405                    $import2cp = Text::Iconv->new($config->{excel_codepage},$codepage);
406                    my $excel_file = $cfg -> val($database, 'excel_file') || die "$database doesn't have 'excel_file' defined!";
407    
408                    my $sheet = x($config->{sheet}) || die "no sheet in $type.xml";
409                    my $start_row = x($config->{start_row}) - 1 || die "no start_row in $type.xml";
410    
411                    my $oBook = Spreadsheet::ParseExcel::Workbook->Parse($excel_file) || die "can't open Excel file '$excel_file'";
412    
413                    my $sheet_nr = 0;
414                    foreach my $oWks (@{$oBook->{Worksheet}}) {
415                            #print STDERR "-- SHEET $sheet_nr:", $oWks->{Name}, "\n";
416                            last if ($oWks->{Name} eq $sheet);
417                            $sheet_nr++;
418                    }
419    
420                    my $oWorksheet = $oBook->{Worksheet}[$sheet_nr];
421            
422                    print STDERR "using sheet: ",$oWorksheet->{Name},"\n";
423                    defined ($oWorksheet) || die "can't find sheet '$sheet' in $excel_file";
424                    my $end_row = x($config->{end_row}) || $oWorksheet->{MaxRow};
425    
426                    for(my $iR = $start_row ; defined $end_row && $iR <= $end_row ; $iR++) {
427                            my $row;
428                            for(my $iC = $oWorksheet->{MinCol} ; defined $oWorksheet->{MaxCol} && $iC <= $oWorksheet->{MaxCol} ; $iC++) {
429                                    my $cell = $oWorksheet->{Cells}[$iR][$iC];
430                                    if ($cell) {
431                                            $row->{int2col($iC)} = $cell->Value;
432                                    }
433                            }
434    
435                            progress($iR, $end_row);
436    
437    #                       print "row[$iR/$end_row] ";
438    #                       foreach (keys %{$row}) {
439    #                               print "$_: ",$row->{$_},"\t";
440    #                       }
441    #                       print "\n";
442    
443                            my $swishpath = $database."#".$iR;
444    
445                            next if (! $row);
446    
447                            if (my $xml = data2xml($type_base,$row,$add_xml,$cfg,$database)) {
448                                    $xml = $cp2utf->convert($xml);
449                                    use bytes;      # as opposed to chars
450                                    print "Path-Name: $swishpath\n";
451                                    print "Content-Length: ".(length($xml)+1)."\n";
452                                    print "Document-Type: XML\n\n$xml\n";
453                            }
454                    }
455            } elsif ($type_base eq "marc") {
456    
457                    use MARC;
458                    
459                    $import2cp = Text::Iconv->new($config->{marc_codepage},$codepage);
460                    my $marc_file = $cfg -> val($database, 'marc_file') || die "$database doesn't have 'marc_file' defined!";
461    
462                    # optional argument is format
463                    my $format = x($config->{format}) || 'usmarc';
464    
465                    print STDERR "Reading MARC file '$marc_file'\n";
466    
467                    my $marc = new MARC;
468                    my $nr = $marc->openmarc({
469                                    file=>$marc_file, format=>$format
470                            }) || die "Can't open MARC file '$marc_file'";
471    
472                    my $i=0;        # record nr.
473    
474                    my $rec;
475    
476                    while ($marc->nextmarc(1)) {
477    
478                            # XXX
479                            fakeprogress($i++);
480    
481                            my $swishpath = $database."#".$i;
482    
483                            if (my $xml = data2xml($type_base,$marc,$add_xml,$cfg,$database)) {
484                                    $xml = $cp2utf->convert($xml);
485                                    use bytes;      # as opposed to chars
486                                    print "Path-Name: $swishpath\n";
487                                  print "Content-Length: ".(length($xml)+1)."\n";                                  print "Content-Length: ".(length($xml)+1)."\n";
488                                  print "Document-Type: XML\n\n$xml\n";                                  print "Document-Type: XML\n\n$xml\n";
489                          }                          }
490                  }                  }
491            } elsif ($type_base eq "feed") {
492    
493                    $import2cp = Text::Iconv->new($config->{feed_codepage},$codepage);
494                    my $prog = x($config->{prog}) || die "$database doesn't have 'prog' defined!";
495    
496                    print STDERR "Reading feed from program '$prog'\n";
497    
498                    open(FEED,"feeds/$prog |") || die "can't start $prog: $!";
499    
500                    my $i=1;        # record nr.
501    
502                    my $data;
503                    my $line=1;
504    
505                    while (<FEED>) {
506                            chomp;
507    
508                            if (/^$/) {
509                                    my $swishpath = $database."#".$i++;
510    
511                                    if (my $xml = data2xml($type_base,$data,$add_xml,$cfg,$database)) {
512                                            $xml = $cp2utf->convert($xml);
513                                            use bytes;      # as opposed to chars
514                                            print "Path-Name: $swishpath\n";
515                                            print "Content-Length: ".(length($xml)+1)."\n";
516                                            print "Document-Type: XML\n\n$xml\n";
517                                    }
518                                    $line = 1;
519                                    $data = {};
520                                    next;
521                            }
522    
523                            $line = $1 if (s/^(\d+):\s*//);
524                            $data->{$line++} = $_;
525    
526                            fakeprogress($i);
527    
528                    }
529          }          }
         print STDERR "\n";  
530  }  }
531    
532  # call this to commit index  # call this to commit index
# Line 250  __END__ Line 538  __END__
538    
539  =head1 NAME  =head1 NAME
540    
541  isis2xml.pl - read isis file and dump XML  all2xml.pl - read various file formats and dump XML for SWISH-E
542    
543  =head1 DESCRIPTION  =head1 DESCRIPTION
544    
545  This command will read ISIS data file using OpenIsis perl module and  This command will read ISIS data file using OpenIsis perl module, MARC
546  create XML file for usage with I<SWISH-E>  records using MARC module and optionally Micro$oft Excel files to
547  indexer. Dispite it's name, this script B<isn't general xml generator>  create one XML file for usage with I<SWISH-E> indexer. Dispite it's name,
548  from isis files (isis allready has something like that). Output of this  this script B<isn't general xml generator> from isis files (isis allready
549  script is tailor-made for SWISH-E.  has something like that). Output of this script is tailor-made for SWISH-E.
550    
551    =head1 BUGS
552    
553    Documentation is really lacking. However, in true Open Source spirit, source
554    is best documentation. I even made considerable effort to comment parts
555    which are not intuitively clear, so...
556    
557  =head1 AUTHOR  =head1 AUTHOR
558    

Legend:
Removed from v.21  
changed lines
  Added in v.108

  ViewVC Help
Powered by ViewVC 1.1.26