/[webpac]/trunk2/all2all.pl
This is repository of my old source code which isn't updated any more. Go to git.rot13.org for current projects!
ViewVC logotype

Diff of /trunk2/all2all.pl

Parent Directory Parent Directory | Revision Log Revision Log | View Patch Patch

revision 9 by dpavlin, Sat Jan 11 19:55:30 2003 UTC revision 102 by dpavlin, Mon Jul 14 10:54:34 2003 UTC
# Line 6  use Getopt::Std; Line 6  use Getopt::Std;
6  use Data::Dumper;  use Data::Dumper;
7  use XML::Simple;  use XML::Simple;
8  use Text::Unaccent 1.02;        # 1.01 won't compile on my platform,  use Text::Unaccent 1.02;        # 1.01 won't compile on my platform,
9  require Unicode::Map8;  use Text::Iconv;
10  use DBI;  use Config::IniFiles;
11    use Encode;
12    
13  my $config=XMLin(undef, forcearray => [ 'isis' ], forcecontent => 1);  $|=1;
 my $dbh = DBI->connect("DBI:Pg:dbname=webpac","","") || die $DBI::errstr; # FIX  
 # FIX; select relname from pg_class where relname like 'index_%' ;  
 $dbh->begin_work || die $dbh->errstr();  
14    
15  $dbh->do("delete from index_author") || die $dbh->errstr();  my $config_file = $0;
16  $dbh->do("delete from index_title") || die $dbh->errstr();  $config_file =~ s/\.pl$/.conf/;
17    die "FATAL: can't find configuration file '$config_file'" if (! -e $config_file);
18    
19    my $config;
20    
21    #use index_DBI;         # default DBI module for index
22    use index_DBI_cache;    # faster DBI module using memory cache
23    my $index;
24    
25  my %opts;  my %opts;
26    
# Line 27  my %opts; Line 32  my %opts;
32    
33  getopts('d:m:qs', \%opts);  getopts('d:m:qs', \%opts);
34    
35  my $db_dir = $opts{d} || "ps";  # FIX  my $path;       # this is name of database
36    
37  #die "usage: $0 -d [database_dir] -m [database1,database2] " if (! %opts);  Text::Iconv->raise_error(0);     # Conversion errors don't raise exceptions
38    
39    # this is encoding of all files on disk, including import_xml/*.xml file and
40    # filter/*.pm files! It will be used to store strings in perl internally!
41    my $codepage = 'ISO-8859-2';
42    
43    my $utf2cp = Text::Iconv->new('UTF-8',$codepage);
44    # this function will convert data from XML files to local encoding
45    sub x {
46            return $utf2cp->convert($_[0]);
47    }
48    
49  #print Dumper($config->{indexer});  # decode isis/excel or other import codepage
50  #print "-" x 70,"\n";  my $import2cp;
51    
52  # how to convert isis code page to UTF8?  # outgoing xml must be in UTF-8
53  my $isis_map = Unicode::Map8->new($config->{isis_codepage}) || die;  my $cp2utf = Text::Iconv->new($codepage,'UTF-8');
54    
55  sub isis2xml {  # mapping between data type and tag which specify
56    # format in XML file
57    my %type2tag = (
58            'isis' => 'isis',
59            'excel' => 'column',
60            'marc' => 'marc',
61            'feed' => 'feed'
62    );
63    
64    sub data2xml {
65    
66            use xmlify;
67    
68            my $type = shift @_;
69          my $row = shift @_;          my $row = shift @_;
70            my $add_xml = shift @_;
71            # needed to read values from configuration file
72            my $cfg = shift @_;
73            my $database = shift @_;
74    
75          my $xml;          my $xml;
         $xml->{db_dir} = [ $db_dir ];   # FIX remove?  
76    
77          sub isis_sf {          use parse_format;
78                  my $row = shift @_;  
79                  my $isis_id = shift @_;          my $html = "";          # html formatted display output
80                  my $subfield = shift @_;  
81                  if ($row->{$isis_id}->[0]) {          my %field_usage;        # counter for usage of each field
82                          my $sf = OpenIsis::subfields($row->{$isis_id}->[0]);  
83                          if (! defined $subfield || length($subfield) == 0) {          # sort subrouting using order="" attribute
84                                  # subfield list undef, empty or no defined subfields for this record          sub by_order {
85                                  my $all_sf = $row->{$isis_id}->[0];                  my $va = $config->{indexer}->{$a}->{order} ||
86                                  $all_sf =~ s/\^./ /g;   nuke definirions                          $config->{indexer}->{$a};
87                                  return $all_sf;                  my $vb = $config->{indexer}->{$b}->{order} ||
88                          } elsif ($sf->{$subfield}) {                          $config->{indexer}->{$b};
89                                  return $sf->{$subfield};  
90                          }                  return $va <=> $vb;
                 }  
91          }          }
92    
93          foreach my $field (keys %{$config->{indexer}}) {          foreach my $field (sort by_order keys %{$config->{indexer}}) {
94    
95                    $field=x($field);
96                    $field_usage{$field}++;
97    
                 my $display_data = "";  
98                  my $swish_data = "";                  my $swish_data = "";
99                  my $index_data = "";                  my $display_data = "";
100                    my $line_delimiter;
101    
102                    my ($swish,$display);
103    
104                  foreach my $x (@{$config->{indexer}->{$field}->{isis}}) {                  my $tag = $type2tag{$type} || die "can't find which tag to use for type $type";
105                    foreach my $x (@{$config->{indexer}->{$field}->{$tag}}) {
106    
107                          my $display_tmp = "";                          my $format = x($x->{content});
108                          my $swish_tmp = "";                          my $delimiter = x($x->{delimiter}) || ' ';
109                          my $index_tmp = "";  
110                            my $repeat_off = 0;             # repeatable offset
111                          my $format = $x->{content};  
112                          my $s = 1;      # swish only                          my ($s,$d,$i) = (1,1,0);        # swish, display default
                         my $d = 1;      # display only  
                         my $i = 0;      # index only  
113                          $s = 0 if (lc($x->{type}) eq "display");                          $s = 0 if (lc($x->{type}) eq "display");
114                          $d = 0 if (lc($x->{type}) eq "swish");                          $d = 0 if (lc($x->{type}) eq "swish");
115                          ($s,$d,$i) = (0,0,1) if (lc($x->{type}) eq "index");                          ($s,$d,$i) = (0,0,1) if (lc($x->{type}) eq "index");
116  #print STDERR "## s: $s d: $d i: $i ## $format ##\n";    
117                          # parse format                          # what will separate last line from this one?
118                          my $prefix = "";                          if ($display_data && $x->{append} && $x->{append} eq "1") {
119                          if ($format =~ s/^([^\d]+)//) {                                  $line_delimiter = ' ';
120                                  $prefix = $1;                          } elsif ($display_data) {
121                          }                                  $line_delimiter = '<br/>';
122                          while ($format) {                          }
123                                  if ($format =~ s/^(\d\d\d)(\w?)//) {  
124                                          my $isis_tmp = isis_sf($row,$1,$2);                          # init vars so that we go into while...
125                                          if ($isis_tmp) {                          ($swish,$display) = (1,1);
126  #                                               $display_tmp .= $prefix . "/$1/$2/".$isis_tmp if ($d);  
127                                                  $display_tmp .= $prefix . $isis_tmp if ($d);                          # placeholder for all repeatable entries for index
128                                                  $swish_tmp .= $isis_tmp." " if ($s);                          my @index_data;
129                                                  $index_tmp .= $prefix . $isis_tmp if ($i);                          my $index_filter;
130  #print STDERR " $isis_tmp <--\n";  
131                            # while because of repeatable fields
132                            while ($swish || $display) {
133                                    ($swish,$display) = parse_format($type, $format,$row,$repeat_off++,$import2cp);
134                                    if ($repeat_off > 1000) {
135                                            print STDERR "loop (more than 1000 repeatable fields) deteced in $row, $format\n";
136                                            last;
137                                    }
138                                    
139                                    # filter="name" ; filter this field through
140                                    # filter/[name].pm
141                                    my $filter = $x->{filter};
142                                    if ($filter) {
143                                            require "filter/".$filter.".pm";
144                                    }
145                                    # type="swish" ; field for swish
146                                    if ($s && $swish) {
147                                            if ($filter) {
148                                                    no strict 'refs';
149                                                    $swish_data .= join(" ",&$filter($swish));
150                                            } else {
151                                                    $swish_data .= $swish;
152                                            }
153                                    }
154    
155                                    # type="display" ; field for display
156                                    if ($d && $display) {
157                                            if ($line_delimiter && $display_data) {
158                                                    $display_data .= $line_delimiter;
159                                                    undef $line_delimiter;
160                                            }
161                                            if ($filter) {
162                                                    no strict 'refs';
163                                                    $display_data .= join($delimiter,&$filter($display));
164                                            } else {
165                                                    if ($display_data) {
166                                                            $display_data .= $delimiter.$display;
167                                                    } else {
168                                                            $display_data .= $display;
169                                                    }
170                                            }
171                                    }
172                                                    
173                                    # type="index" ; insert into index
174                                    if ($i && $display) {
175                                            push @index_data, $display;
176                                            $index_filter = $filter if ($filter);
177                                    }
178                            }
179    
180                            # fill data in index
181                            if (@index_data) {
182                                    if ($index_filter) {
183                                            no strict 'refs';
184                                            foreach my $d (&$index_filter(@index_data)) {
185                                                    $index->insert($field, $d, $path);
186                                          }                                          }
                                         $prefix = "";  
                                 } elsif ($format =~ s/^([^\d]+)//) {  
                                         $prefix = $1;  
187                                  } else {                                  } else {
188                                          print STDERR "WARNING: unparsed format '$format'\n";                                          foreach my $d (@index_data) {
189                                          last;                                                  $index->insert($field, $d, $path);
190                                  };                                          }
191                                    }
192                          }                          }
193                          # add suffix                  }
194                          $display_tmp .= $prefix if ($display_tmp);  
195                          $index_tmp .= $prefix if ($index_tmp);                  # now try to parse variables from configuration file
196                    foreach my $x (@{$config->{indexer}->{$field}->{'config'}}) {
197  #                       $display_data .= $display_tmp if ($display_tmp ne "");  
198  #                       $swish_data .= $swish_tmp if ($swish_tmp ne "");                          my $delimiter = x($x->{delimiter}) || ' ';
199                          $display_data .= $display_tmp;                          my $val = $cfg->val($database, x($x->{content}));
200                          $swish_data .= $swish_tmp;  
201                          $index_data .= $index_tmp;                          my ($s,$d,$i) = (1,1,0);        # swish, display default
202                            $s = 0 if (lc($x->{type}) eq "display");
203                  }                          $d = 0 if (lc($x->{type}) eq "swish");
204  #print "--display:$display_data\n--swish:$swish_data\n";                          ($s,$d,$i) = (0,0,1) if (lc($x->{type}) eq "index");
205                  #$xml->{$field."_display"} = $isis_map->tou($display_data)->utf8 if ($display_data);  
206                  #$xml->{$field."_swish"} = unac_string($config->{isis_codepage},$swish_data) if ($swish_data);                          if ($val) {
207                  $xml->{$field."_display" } = [ $isis_map->tou($display_data)->utf8 ] if ($display_data);                                  $display_data .= $delimiter.$val if ($d);
208                  $xml->{$field."_swish"} = [ unac_string($config->{isis_codepage},$swish_data) ] if ($swish_data);                                  $swish_data .= $val if ($s);
209                                    $index->insert($field, $val, $path) if ($i);
210                  # index                          }
211                  if ($index_data && $index_data ne "") {  
212                          my $sql = "select $field from index_$field where upper($field)=upper(?)";                  }
213                          my $sth = $dbh->prepare($sql) || die $dbh->errstr();  
214                          $sth->execute($index_data) || die "SQL: $sql; ".$dbh->errstr();  
215  #print STDERR "--->$index_data<---\n";                  if ($display_data) {
216                          if (! $sth->fetchrow_hashref) {  
217                                  my $sql = "insert into index_$field values (?)";                          if ($field eq "headline") {
218                                  my $sth = $dbh->prepare($sql) || die $dbh->errstr();                                  $xml .= xmlify("headline", $display_data);
219  #print STDERR "$sql: $index_data<!----\n";                          } else {
220                                  $sth->execute($index_data) || die "SQL: $sql; ".$dbh->errstr();  
221                                    # find field name (signular, plural)
222                                    my $field_name = "";
223                                    if ($config->{indexer}->{$field}->{name_singular} && $field_usage{$field} == 1) {
224                                            $field_name = $config->{indexer}->{$field}->{name_singular}."#-#";
225                                    } elsif ($config->{indexer}->{$field}->{name_plural}) {
226                                            $field_name = $config->{indexer}->{$field}->{name_plural}."#-#";
227                                    } elsif ($config->{indexer}->{$field}->{name}) {
228                                            $field_name = $config->{indexer}->{$field}->{name}."#-#";
229                                    } else {
230                                            print STDERR "WARNING: field '$field' doesn't have 'name' attribute!";
231                                    }
232                                    if ($field_name) {
233                                            $html .= x($field_name);
234                                    }
235                                    $html .= $display_data."###\n";
236                          }                          }
237                  }                  }
238                    if ($swish_data) {
239                            # remove extra spaces
240                            $swish_data =~ s/ +/ /g;
241                            $swish_data =~ s/ +$//g;
242    
243                            $xml .= xmlify($field."_swish", unac_string($codepage,$swish_data));
244                    }
245    
246    
247          }          }
248    
249            # dump formatted output in <html>
250            if ($html) {
251                    #$xml .= xmlify("html",$html);
252                    $xml .= "<html><![CDATA[ $html ]]></html>";
253            }
254            
255          if ($xml) {          if ($xml) {
256                  return XMLout($xml, rootname => 'xml', keeproot => 0, noattr => 0 );                  $xml .= $add_xml if ($add_xml);
257                    return "<xml>\n$xml</xml>\n";
258          } else {          } else {
259                  return;                  return;
260          }          }
# Line 145  sub isis2xml { Line 262  sub isis2xml {
262    
263  ##########################################################################  ##########################################################################
264    
265  my $last_tell=0;  # read configuration for this script
266    my $cfg = new Config::IniFiles( -file => $config_file );
267    
268  my @isis_dirs = ( '.' );        # use dirname as database name  # read global.conf configuration
269    my $cfg_global = new Config::IniFiles( -file => 'global.conf' );
270    
271  if ($opts{m}) {  # open index
272          @isis_dirs = split(/,/,$opts{m});  $index = new index_DBI(
273  }                  $cfg_global->val('global', 'dbi_dbd'),
274                    $cfg_global->val('global', 'dbi_dsn'),
275                    $cfg_global->val('global', 'dbi_user'),
276                    $cfg_global->val('global', 'dbi_passwd') || '',
277            );
278    
279  my @isis_dbs;  my $show_progress = $cfg_global->val('global', 'show_progress');
280    
281  foreach (@isis_dirs) {  foreach my $database ($cfg->Sections) {
282          if (-e $config->{isis_data}."/$db_dir/$_/LIBRI") {  
283                  push @isis_dbs,$config->{isis_data}."/$db_dir/$_/LIBRI/LIBRI";          my $type = lc($cfg -> val($database, 'type')) || die "$database doesn't have 'type' defined";
284          }          my $add_xml = $cfg -> val($database, 'xml');    # optional
285          if (-e $config->{isis_data}."/$db_dir/$_/PERI") {  
286                  push @isis_dbs,$config->{isis_data}."/$db_dir/$_/PERI/PERI";  print STDERR "reading ./import_xml/$type.xml\n";
287          }  
288          if (-e $config->{isis_data}."/$db_dir/$_/AMS") {          # extract just type basic
289                  push @isis_dbs,$config->{isis_data}."/$db_dir/$_/AMS/AMS";          my $type_base = $type;
290            $type_base =~ s/_.+$//g;
291    
292            $config=XMLin("./import_xml/$type.xml", forcearray => [ $type2tag{$type_base}, 'config' ], forcecontent => 1);
293    
294            # output current progress indicator
295            my $last_p = 0;
296            sub progress {
297                    return if (! $show_progress);
298                    my $current = shift;
299                    my $total = shift || 1;
300                    my $p = int($current * 100 / $total);
301                    if ($p != $last_p) {
302                            printf STDERR ("%5d / %5d [%-51s] %-2d %% \r",$current,$total,"=" x ($p/2).">", $p );
303                            $last_p = $p;
304                    }
305          }          }
306          if (-e $config->{isis_data}."/$db_dir/$_/ARTI") {  
307  #               push @isis_dbs,$config->{isis_data}."/$db_dir/$_/ARTI/ARTI";          my $fake_dir = 1;
308            sub fakeprogress {
309                    my $current = shift @_;
310    
311                    my @ind = ('-','\\','|','/','-','\\','|','/', '-');
312    
313                    $last_p += $fake_dir;
314                    $fake_dir = -$fake_dir if ($last_p > 1000 || $last_p < 0);
315                    if ($last_p % 10 == 0) {
316                            printf STDERR ("%5d / %5s [%-51s]\r",$current,"?"," " x ($last_p/20).$ind[($last_p/20) % $#ind]);
317                    }
318          }          }
 }  
319    
320  print STDERR "FATAL: Can't find isis database.\nPerhaps isis_data (".$config->{isis_data}.") has wrong value?\n" if (! @isis_dbs);          # now read database
321    print STDERR "using: $type...\n";
322    
323  my $db;          if ($type_base eq "isis") {
324    
325  foreach my $isis_db (@isis_dbs) {                  my $isis_db = $cfg -> val($database, 'isis_db') || die "$database doesn't have 'isis_db' defined!";
326    
327                    $import2cp = Text::Iconv->new($config->{isis_codepage},$codepage);
328                    my $db = OpenIsis::open( $isis_db );
329    
330                    # OpenIsis::ERR_BADF
331                    if ($db == -4) {
332                            print STDERR "FATAL: OpenIsis can't find file $isis_db\n";
333                            next;
334                    # OpenIsis::ERR_IO
335                    } elsif ($db == -5) {
336                            print STDERR "FATAL: OpenIsis can't access file $isis_db\n";
337                            next;
338                    } elsif ($db < 0) {
339                            print STDERR "FATAL: OpenIsis unknown error $db with file $isis_db\n";
340                            next;
341                    }
342    
343          my $db = OpenIsis::open( $isis_db );                  my $max_rowid = OpenIsis::maxRowid( $db );
         if (0) {  
 #       # FIX  
 #       if (! $db ) {  
                 print STDERR "WARNING: can't open '$isis_db'\n";  
                 next ;  
         }  
344    
345          my $max_rowid = OpenIsis::maxRowid( $db );                  print STDERR "Reading database: $isis_db [$max_rowid rows]\n";
346    
347          print STDERR "Reading database: $isis_db [$max_rowid rows]\n";                  my $path = $database;
348    
349          my $last_p = 0;                  for (my $row_id = 1; $row_id <= $max_rowid; $row_id++ ) {
350                            my $row = OpenIsis::read( $db, $row_id );
351                            if ($row && $row->{mfn}) {
352            
353                                    progress($row->{mfn}, $max_rowid);
354    
355                                    my $swishpath = $path."#".int($row->{mfn});
356    
357                                    if (my $xml = data2xml($type_base,$row,$add_xml,$cfg,$database)) {
358                                            $xml = $cp2utf->convert($xml);
359                                            use bytes;      # as opposed to chars
360                                            print "Path-Name: $swishpath\n";
361                                            print "Content-Length: ".(length($xml)+1)."\n";
362                                            print "Document-Type: XML\n\n$xml\n";
363                                    }
364                            }
365                    }
366                    print STDERR "\n";
367    
368  #       { my $row_id = 1;          } elsif ($type_base eq "excel") {
369  # FIX                  use Spreadsheet::ParseExcel;
370          for (my $row_id = 1; $row_id <= $max_rowid; $row_id++ ) {                  use Spreadsheet::ParseExcel::Utility qw(int2col);
371                  my $row = OpenIsis::read( $db, $row_id );                  
372                  if ($row && $row->{mfn}) {                  $import2cp = Text::Iconv->new($config->{excel_codepage},$codepage);
373                    my $excel_file = $cfg -> val($database, 'excel_file') || die "$database doesn't have 'excel_file' defined!";
374                          # output current process indicator  
375                          my $p = int($row->{mfn} * 100 / $max_rowid);                  my $sheet = x($config->{sheet}) || die "no sheet in $type.xml";
376                          if ($p != $last_p) {                  my $start_row = x($config->{start_row}) - 1 || die "no start_row in $type.xml";
377                                  printf STDERR ("%5d / %5d [%-51s] %-2d %% \r",$row->{mfn},$max_rowid,"=" x ($p/2).">", $p ) if (! $opts{q});  
378                                  $last_p = $p;                  my $oBook = Spreadsheet::ParseExcel::Workbook->Parse($excel_file) || die "can't open Excel file '$excel_file'";
379                          }  
380                    my $sheet_nr = 0;
381                          if (my $xml = isis2xml($row)) {                  foreach my $oWks (@{$oBook->{Worksheet}}) {
382                                  my $path = $isis_db;                          #print STDERR "-- SHEET $sheet_nr:", $oWks->{Name}, "\n";
383                                  $path =~ s#$config->{isis_data}/*##g;                          last if ($oWks->{Name} eq $sheet);
384                                  my $out = "Path-Name: $path#".$row->{mfn}."\n";                          $sheet_nr++;
385                                  $out .= "Content-Length: ".(length($xml)+1)."\n";                  }
386                                  $out .= "Document-Type: XML\n\n$xml\n";  
387                                  print $out;                  my $oWorksheet = $oBook->{Worksheet}[$sheet_nr];
388            
389                    print STDERR "using sheet: ",$oWorksheet->{Name},"\n";
390                    defined ($oWorksheet) || die "can't find sheet '$sheet' in $excel_file";
391                    my $end_row = x($config->{end_row}) || $oWorksheet->{MaxRow};
392    
393                    for(my $iR = $start_row ; defined $end_row && $iR <= $end_row ; $iR++) {
394                            my $row;
395                            for(my $iC = $oWorksheet->{MinCol} ; defined $oWorksheet->{MaxCol} && $iC <= $oWorksheet->{MaxCol} ; $iC++) {
396                                    my $cell = $oWorksheet->{Cells}[$iR][$iC];
397                                    if ($cell) {
398                                            $row->{int2col($iC)} = $cell->Value;
399                                    }
400                            }
401    
402                            progress($iR, $end_row);
403    
404    #                       print "row[$iR/$end_row] ";
405    #                       foreach (keys %{$row}) {
406    #                               print "$_: ",$row->{$_},"\t";
407    #                       }
408    #                       print "\n";
409    
410                            my $swishpath = $database."#".$iR;
411    
412                            next if (! $row);
413    
414                            if (my $xml = data2xml($type_base,$row,$add_xml,$cfg,$database)) {
415                                    $xml = $cp2utf->convert($xml);
416                                    use bytes;      # as opposed to chars
417                                    print "Path-Name: $swishpath\n";
418                                    print "Content-Length: ".(length($xml)+1)."\n";
419                                    print "Document-Type: XML\n\n$xml\n";
420                          }                          }
421                  }                  }
422            } elsif ($type_base eq "marc") {
423    
424                    use MARC;
425                    
426                    $import2cp = Text::Iconv->new($config->{marc_codepage},$codepage);
427                    my $marc_file = $cfg -> val($database, 'marc_file') || die "$database doesn't have 'marc_file' defined!";
428    
429                    # optional argument is format
430                    my $format = x($config->{format}) || 'usmarc';
431    
432                    print STDERR "Reading MARC file '$marc_file'\n";
433    
434                    my $marc = new MARC;
435                    my $nr = $marc->openmarc({
436                                    file=>$marc_file, format=>$format
437                            }) || die "Can't open MARC file '$marc_file'";
438    
439                    my $i=0;        # record nr.
440    
441                    my $rec;
442    
443                    while ($marc->nextmarc(1)) {
444    
445                            # XXX
446                            fakeprogress($i++);
447    
448                            my $swishpath = $database."#".$i;
449    
450                            if (my $xml = data2xml($type_base,$marc,$add_xml,$cfg,$database)) {
451                                    $xml = $cp2utf->convert($xml);
452                                    use bytes;      # as opposed to chars
453                                    print "Path-Name: $swishpath\n";
454                                    print "Content-Length: ".(length($xml)+1)."\n";
455                                    print "Document-Type: XML\n\n$xml\n";
456                            }
457                    }
458            } elsif ($type_base eq "feed") {
459    
460                    $import2cp = Text::Iconv->new($config->{feed_codepage},$codepage);
461                    my $prog = x($config->{prog}) || die "$database doesn't have 'prog' defined!";
462    
463                    print STDERR "Reading feed from program '$prog'\n";
464    
465                    open(FEED,"feeds/$prog |") || die "can't start $prog: $!";
466    
467                    my $i=1;        # record nr.
468    
469                    my $data;
470                    my $line=1;
471    
472                    while (<FEED>) {
473                            chomp;
474    
475                            if (/^$/) {
476                                    my $swishpath = $database."#".$i++;
477    
478                                    if (my $xml = data2xml($type_base,$data,$add_xml,$cfg,$database)) {
479                                            $xml = $cp2utf->convert($xml);
480                                            use bytes;      # as opposed to chars
481                                            print "Path-Name: $swishpath\n";
482                                            print "Content-Length: ".(length($xml)+1)."\n";
483                                            print "Document-Type: XML\n\n$xml\n";
484                                    }
485                                    $line = 1;
486                                    $data = {};
487                                    next;
488                            }
489    
490                            $line = $1 if (s/^(\d+):\s*//);
491                            $data->{$line++} = $_;
492    
493                            fakeprogress($i);
494    
495                    }
496          }          }
         print STDERR "\n";  
497  }  }
498    
499  $dbh->commit || die $dbh->errstr();  # call this to commit index
500    $index->close;
501    
502  1;  1;
503  __END__  __END__
# Line 225  __END__ Line 505  __END__
505    
506  =head1 NAME  =head1 NAME
507    
508  isis2xml.pl - read isis file and dump XML  all2xml.pl - read various file formats and dump XML for SWISH-E
509    
510  =head1 DESCRIPTION  =head1 DESCRIPTION
511    
512  This command will read ISIS data file using OpenIsis perl module and  This command will read ISIS data file using OpenIsis perl module, MARC
513  create XML file for usage with I<SWISH-E>  records using MARC module and optionally Micro$oft Excel files to
514  indexer. Dispite it's name, this script B<isn't general xml generator>  create one XML file for usage with I<SWISH-E> indexer. Dispite it's name,
515  from isis files (isis allready has something like that). Output of this  this script B<isn't general xml generator> from isis files (isis allready
516  script is tailor-made for SWISH-E.  has something like that). Output of this script is tailor-made for SWISH-E.
517    
518    =head1 BUGS
519    
520    Documentation is really lacking. However, in true Open Source spirit, source
521    is best documentation. I even made considerable effort to comment parts
522    which are not intuitively clear, so...
523    
524  =head1 AUTHOR  =head1 AUTHOR
525    

Legend:
Removed from v.9  
changed lines
  Added in v.102

  ViewVC Help
Powered by ViewVC 1.1.26