/[escript]/trunk/paso/src/Solver_AMG.c
ViewVC logotype

Diff of /trunk/paso/src/Solver_AMG.c

Parent Directory Parent Directory | Revision Log Revision Log | View Patch Patch

revision 2759 by artak, Wed Oct 21 23:50:05 2009 UTC revision 2760 by artak, Thu Nov 19 05:22:45 2009 UTC
# Line 52  void Paso_Solver_AMG_System_free(Paso_So Line 52  void Paso_Solver_AMG_System_free(Paso_So
52  void Paso_Solver_AMG_free(Paso_Solver_AMG * in) {  void Paso_Solver_AMG_free(Paso_Solver_AMG * in) {
53       if (in!=NULL) {       if (in!=NULL) {
54          Paso_Solver_Jacobi_free(in->GS);          Paso_Solver_Jacobi_free(in->GS);
         MEMFREE(in->inv_A_FF);  
         MEMFREE(in->A_FF_pivot);  
55          Paso_SparseMatrix_free(in->A_FC);          Paso_SparseMatrix_free(in->A_FC);
56            Paso_SparseMatrix_free(in->A_FF);
57            Paso_SparseMatrix_free(in->W_FC);
58          Paso_SparseMatrix_free(in->A_CF);          Paso_SparseMatrix_free(in->A_CF);
59            Paso_SparseMatrix_free(in->P);
60            Paso_SparseMatrix_free(in->R);
61            
62          Paso_SparseMatrix_free(in->A);          Paso_SparseMatrix_free(in->A);
63          if(in->coarsest_level==TRUE) {          if(in->coarsest_level==TRUE) {
64          #ifdef MKL          #ifdef MKL
# Line 76  void Paso_Solver_AMG_free(Paso_Solver_AM Line 79  void Paso_Solver_AMG_free(Paso_Solver_AM
79          MEMFREE(in->x_C);          MEMFREE(in->x_C);
80          MEMFREE(in->b_C);          MEMFREE(in->b_C);
81          in->solver=NULL;          in->solver=NULL;
82          Paso_Solver_AMG_free(in->AMG_of_Schur);          Paso_Solver_AMG_free(in->AMG_of_Coarse);
83          MEMFREE(in->b_C);          MEMFREE(in->b_C);
84          MEMFREE(in);          MEMFREE(in);
85       }       }
# Line 103  to Line 106  to
106  */  */
107  Paso_Solver_AMG* Paso_Solver_getAMG(Paso_SparseMatrix *A_p,dim_t level,Paso_Options* options) {  Paso_Solver_AMG* Paso_Solver_getAMG(Paso_SparseMatrix *A_p,dim_t level,Paso_Options* options) {
108    Paso_Solver_AMG* out=NULL;    Paso_Solver_AMG* out=NULL;
109    Paso_Pattern* temp1=NULL;    /*
110       Paso_Pattern* temp1=NULL;
111    Paso_Pattern* temp2=NULL;    Paso_Pattern* temp2=NULL;
112      */
113    bool_t verbose=options->verbose;    bool_t verbose=options->verbose;
114    dim_t n=A_p->numRows;    dim_t n=A_p->numRows;
115    dim_t n_block=A_p->row_block_size;    dim_t n_block=A_p->row_block_size;
116    index_t* mis_marker=NULL;      index_t* mis_marker=NULL;  
117    index_t* counter=NULL;    index_t* counter=NULL;
118    index_t iPtr,*index, *where_p, iPtr_s;    /*index_t iPtr,*index, *where_p;*/
119    dim_t i,j;    dim_t i;
120    Paso_SparseMatrix * schur=NULL;    Paso_SparseMatrix * A_c=NULL;
   Paso_SparseMatrix * schur_withFillIn=NULL;  
   double S=0;  
121        
122      /*
123      double *temp,*temp_1;
124      double S;
125      index_t iptr;
126      */
127        
128   /* char filename[8];    /*char filename[8];*/
129    sprintf(filename,"AMGLevel%d",level);    /*sprintf(filename,"AMGLevel%d",level);
130        
131   Paso_SparseMatrix_saveMM(A_p,filename);    Paso_SparseMatrix_saveMM(A_p,filename);
132    */    */
133        
134    /*Make sure we have block sizes 1*/    /*Make sure we have block sizes 1*/
# Line 137  Paso_Solver_AMG* Paso_Solver_getAMG(Paso Line 145  Paso_Solver_AMG* Paso_Solver_getAMG(Paso
145    mis_marker=TMPMEMALLOC(n,index_t);    mis_marker=TMPMEMALLOC(n,index_t);
146    counter=TMPMEMALLOC(n,index_t);    counter=TMPMEMALLOC(n,index_t);
147    if ( !( Paso_checkPtr(mis_marker) || Paso_checkPtr(counter) || Paso_checkPtr(out)) ) {    if ( !( Paso_checkPtr(mis_marker) || Paso_checkPtr(counter) || Paso_checkPtr(out)) ) {
148       out->AMG_of_Schur=NULL;       out->AMG_of_Coarse=NULL;
149       out->inv_A_FF=NULL;       out->A_FF=NULL;
      out->A_FF_pivot=NULL;  
150       out->A_FC=NULL;       out->A_FC=NULL;
151       out->A_CF=NULL;       out->A_CF=NULL;
152         out->W_FC=NULL;
153         out->P=NULL;
154         out->R=NULL;
155       out->rows_in_F=NULL;       out->rows_in_F=NULL;
156       out->rows_in_C=NULL;       out->rows_in_C=NULL;
157       out->mask_F=NULL;       out->mask_F=NULL;
# Line 193  Paso_Solver_AMG* Paso_Solver_getAMG(Paso Line 203  Paso_Solver_AMG* Paso_Solver_getAMG(Paso
203          }          }
204          else {          else {
205             /*Default coarseneing*/             /*Default coarseneing*/
206              Paso_Pattern_RS(A_p,mis_marker,options->coarsening_threshold);              Paso_Pattern_RS_MI(A_p,mis_marker,options->coarsening_threshold);
207              /*Paso_Pattern_YS(A_p,mis_marker,options->coarsening_threshold);*/              /*Paso_Pattern_YS(A_p,mis_marker,options->coarsening_threshold);*/
208              /*Paso_Pattern_greedy_diag(A_p,mis_marker,options->coarsening_threshold);*/              /*Paso_Pattern_RS(A_p,mis_marker,options->coarsening_threshold);*/
209              /*Paso_Pattern_Aggregiation(A_p,mis_marker,options->coarsening_threshold);*/              /*Paso_Pattern_Aggregiation(A_p,mis_marker,options->coarsening_threshold);*/
210                
211          }          }
212            
213          #pragma omp parallel for private(i) schedule(static)          #pragma omp parallel for private(i) schedule(static)
214          for (i = 0; i < n; ++i) counter[i]=mis_marker[i];          for (i = 0; i < n; ++i) counter[i]=mis_marker[i];
215                    
# Line 228  Paso_Solver_AMG* Paso_Solver_getAMG(Paso Line 239  Paso_Solver_AMG* Paso_Solver_getAMG(Paso
239                   for (i = 0; i < n; ++i) counter[i]=mis_marker[i];                   for (i = 0; i < n; ++i) counter[i]=mis_marker[i];
240                   out->n_F=Paso_Util_cumsum(n,counter);                   out->n_F=Paso_Util_cumsum(n,counter);
241                   */                   */
242                    
243                   out->mask_F=MEMALLOC(n,index_t);                   out->mask_F=MEMALLOC(n,index_t);
244                   out->rows_in_F=MEMALLOC(out->n_F,index_t);                   out->rows_in_F=MEMALLOC(out->n_F,index_t);
245                   out->inv_A_FF=MEMALLOC(n_block*n_block*out->n_F,double);                   if (! (Paso_checkPtr(out->mask_F) || Paso_checkPtr(out->rows_in_F) ) ) {
                  out->A_FF_pivot=NULL; /* later use for block size>3 */  
                  if (! (Paso_checkPtr(out->mask_F) || Paso_checkPtr(out->inv_A_FF) || Paso_checkPtr(out->rows_in_F) ) ) {  
246                      /* creates an index for F from mask */                      /* creates an index for F from mask */
247                      #pragma omp parallel for private(i) schedule(static)                      #pragma omp parallel for private(i) schedule(static)
248                      for (i = 0; i < out->n_F; ++i) out->rows_in_F[i]=-1;                      for (i = 0; i < out->n_F; ++i) out->rows_in_F[i]=-1;
# Line 246  Paso_Solver_AMG* Paso_Solver_getAMG(Paso Line 256  Paso_Solver_AMG* Paso_Solver_getAMG(Paso
256                         }                         }
257                      }                      }
258                                            
                     /* Compute row-sum for getting rs(A_FF)^-1*/  
                     #pragma omp parallel for private(i,iPtr,j,S) schedule(static)  
                     for (i = 0; i < out->n_F; ++i) {  
                       S=0;  
       /*printf("[%d ]: [%d] -> ",i, out->rows_in_F[i]);*/  
                       for (iPtr=A_p->pattern->ptr[out->rows_in_F[i]];iPtr<A_p->pattern->ptr[out->rows_in_F[i] + 1]; ++iPtr) {  
                        j=A_p->pattern->index[iPtr];  
       /*if (j==out->rows_in_F[i]) printf("diagonal %e",A_p->val[iPtr]);*/  
                        if (mis_marker[j])  
                            S+=A_p->val[iPtr];  
                       }  
       /*printf("-> %e \n",S);*/  
                       out->inv_A_FF[i]=1./S;  
                     }  
259                   }                   }
260                }                }
261                
# Line 295  Paso_Solver_AMG* Paso_Solver_getAMG(Paso Line 291  Paso_Solver_AMG* Paso_Solver_getAMG(Paso
291                      }                      }
292                }                }
293                if ( Paso_noError()) {                if ( Paso_noError()) {
294                        /* get A_CF block: */                        /* get A_FF block: */
295                          /*
296                           out->A_FF=Paso_SparseMatrix_getSubmatrix(A_p,out->n_F,out->n_F,out->rows_in_F,out->mask_F);
297                        out->A_CF=Paso_SparseMatrix_getSubmatrix(A_p,out->n_C,out->n_F,out->rows_in_C,out->mask_F);                        out->A_CF=Paso_SparseMatrix_getSubmatrix(A_p,out->n_C,out->n_F,out->rows_in_C,out->mask_F);
                       /* get A_FC block: */  
298                        out->A_FC=Paso_SparseMatrix_getSubmatrix(A_p,out->n_F,out->n_C,out->rows_in_F,out->mask_C);                        out->A_FC=Paso_SparseMatrix_getSubmatrix(A_p,out->n_F,out->n_C,out->rows_in_F,out->mask_C);
299                        /* get A_CC block: */                        */
300                        schur=Paso_SparseMatrix_getSubmatrix(A_p,out->n_C,out->n_C,out->rows_in_C,out->mask_C);                        
301                                /*Compute W_FC*/
302                          /*initialy W_FC=A_FC*/
303                          out->W_FC=Paso_SparseMatrix_getSubmatrix(A_p,out->n_F,out->n_C,out->rows_in_F,out->mask_C);
304                          
305                          /*sprintf(filename,"W_FCbefore_%d",level);
306                          Paso_SparseMatrix_saveMM(out->W_FC,filename);
307                          */
308                          Paso_SparseMatrix_updateWeights(A_p,out->W_FC,mis_marker);
309                          
310                          /*
311                           printf("GOT W_FC, but n=%d,n_F=%d,n_C=%d\n",out->n,out->n_F,out->n_C);
312                          sprintf(filename,"W_FCafter_%d",level);
313                          Paso_SparseMatrix_saveMM(out->W_FC,filename);
314                          */
315                          /* get Prolongation and Restriction */
316                          out->P=Paso_SparseMatrix_getProlongation(out->W_FC,mis_marker);
317                          
318                          /*
319                           printf("GOT Prolongation P->nxc %dx%d\n",out->P->numRows,out->P->numCols);
320                          sprintf(filename,"P_%d",level);
321                          Paso_SparseMatrix_saveMM(out->P,filename);
322                          */
323                          
324                          out->R=Paso_SparseMatrix_getRestriction(out->P);
325                          /*
326                          printf("GOT Restriction->cxn %dx%d\n",out->R->numRows,out->R->numCols);
327                          sprintf(filename,"R_%d",level);
328                          Paso_SparseMatrix_saveMM(out->R,filename);
329                          */
330                        
331                }                }
332                if ( Paso_noError()) {                if ( Paso_noError()) {
333                       /*find the pattern of the schur complement with fill in*/                      A_c=Paso_Solver_getCoarseMatrix(A_p,out->R,out->P);
334                      temp1=Paso_Pattern_multiply(PATTERN_FORMAT_DEFAULT,out->A_CF->pattern,out->A_FC->pattern);                      /*Paso_Solver_getCoarseMatrix(A_c, A_p,out->R,out->P);*/
335                      temp2=Paso_Pattern_binop(PATTERN_FORMAT_DEFAULT, schur->pattern, temp1);                      /*
336                      schur_withFillIn=Paso_SparseMatrix_alloc(A_p->type,temp2,1,1, TRUE);                       sprintf(filename,"A_C_%d",level);
337                      Paso_Pattern_free(temp1);                      Paso_SparseMatrix_saveMM(A_c,filename);
338                      Paso_Pattern_free(temp2);                      */
339                }                      out->AMG_of_Coarse=Paso_Solver_getAMG(A_c,level-1,options);
               if ( Paso_noError()) {  
                     /* copy values over*/  
                     #pragma omp parallel for private(i,iPtr,j,iPtr_s,index,where_p) schedule(static)  
                     for (i = 0; i < schur_withFillIn->numRows; ++i) {  
                       for (iPtr=schur_withFillIn->pattern->ptr[i];iPtr<schur_withFillIn->pattern->ptr[i + 1]; ++iPtr) {  
                          j=schur_withFillIn->pattern->index[iPtr];  
                          iPtr_s=schur->pattern->ptr[i];  
                          index=&(schur->pattern->index[iPtr_s]);  
                          where_p=(index_t*)bsearch(&j,  
                                               index,  
                                               schur->pattern->ptr[i + 1]-schur->pattern->ptr[i],  
                                               sizeof(index_t),  
                                               Paso_comparIndex);  
                          if (where_p!=NULL) {  
                                 schur_withFillIn->val[iPtr]=schur->val[iPtr_s+(index_t)(where_p-index)];  
                          }  
                        }  
                     }  
                     Paso_Solver_updateIncompleteSchurComplement(schur_withFillIn,out->A_CF,out->inv_A_FF,out->A_FF_pivot,out->A_FC);  
                     out->AMG_of_Schur=Paso_Solver_getAMG(schur_withFillIn,level-1,options);  
340                }                }
341    
342                /* allocate work arrays for AMG application */                /* allocate work arrays for AMG application */
343                if (Paso_noError()) {                if (Paso_noError()) {
344                           out->x_F=MEMALLOC(n_block*out->n_F,double);                           out->x_F=MEMALLOC(n_block*out->n_F,double);
# Line 352  Paso_Solver_AMG* Paso_Solver_getAMG(Paso Line 359  Paso_Solver_AMG* Paso_Solver_getAMG(Paso
359                                }                                }
360                           }                           }
361                }                }
362              Paso_SparseMatrix_free(schur);              Paso_SparseMatrix_free(A_c);
             Paso_SparseMatrix_free(schur_withFillIn);  
363           }           }
364       }       }
365    }    }
# Line 403  void Paso_Solver_solveAMG(Paso_Solver_AM Line 409  void Paso_Solver_solveAMG(Paso_Solver_AM
409       #ifdef UMFPACK       #ifdef UMFPACK
410            Paso_UMFPACK_Handler * ptr=NULL;            Paso_UMFPACK_Handler * ptr=NULL;
411       #endif       #endif
412        
413       r=MEMALLOC(amg->n,double);       r=MEMALLOC(amg->n,double);
414       x0=MEMALLOC(amg->n,double);       x0=MEMALLOC(amg->n,double);
415            
# Line 444  void Paso_Solver_solveAMG(Paso_Solver_AM Line 451  void Paso_Solver_solveAMG(Paso_Solver_AM
451                    
452           /*r=b-Ax*/           /*r=b-Ax*/
453           Paso_SparseMatrix_MatrixVector_CSR_OFFSET0(-1.,amg->A,x,1.,r);           Paso_SparseMatrix_MatrixVector_CSR_OFFSET0(-1.,amg->A,x,1.,r);
454                  
455          /* r->[b_F,b_C]     */          
456          #pragma omp parallel for private(i) schedule(static)          /* b_c <- R*r  */
457          for (i=0;i<amg->n_F;++i) amg->b_F[i]=r[amg->rows_in_F[i]];           Paso_SparseMatrix_MatrixVector_CSR_OFFSET0(1.,amg->R,r,0.,amg->b_C);
           
         #pragma omp parallel for private(i) schedule(static)  
         for (i=0;i<amg->n_C;++i) amg->b_C[i]=r[amg->rows_in_C[i]];  
   
         /* x_F=invA_FF*b_F  */  
         Paso_Solver_applyBlockDiagonalMatrix(1,amg->n_F,amg->inv_A_FF,amg->A_FF_pivot,amg->x_F,amg->b_F);  
           
         /* b_C=b_C-A_CF*x_F */  
         Paso_SparseMatrix_MatrixVector_CSR_OFFSET0(-1.,amg->A_CF,amg->x_F,1.,amg->b_C);  
458                    
459          time0=Paso_timer()-time0;          time0=Paso_timer()-time0;
460          if (verbose) fprintf(stderr,"timing: Before next level: %e\n",time0);          if (verbose) fprintf(stderr,"timing: Before next level: %e\n",time0);
461                    
462          /* x_C=AMG(b_C)     */          /* x_C=AMG(b_C)     */
463          Paso_Solver_solveAMG(amg->AMG_of_Schur,amg->x_C,amg->b_C);          Paso_Solver_solveAMG(amg->AMG_of_Coarse,amg->x_C,amg->b_C);
464                    
465          time0=Paso_timer();          time0=Paso_timer();
         /* b_F=b_F-A_FC*x_C */  
         Paso_SparseMatrix_MatrixVector_CSR_OFFSET0(-1.,amg->A_FC,amg->x_C,1.,amg->b_F);  
         /* x_F=invA_FF*b_F  */  
         Paso_Solver_applyBlockDiagonalMatrix(1,amg->n_F,amg->inv_A_FF,amg->A_FF_pivot,amg->x_F,amg->b_F);  
466                    
467          /* x<-[x_F,x_C]     */          /* x_0 <- P*x_c */
468            Paso_SparseMatrix_MatrixVector_CSR_OFFSET0(1.,amg->P,amg->x_C,0.,x0);
469            
470            /* x=x+x0 */
471          #pragma omp parallel for private(i) schedule(static)          #pragma omp parallel for private(i) schedule(static)
472          for (i=0;i<amg->n;++i) {          for (i=0;i<amg->n;++i) x[i]+=x0[i];
             if (amg->mask_C[i]>-1) {  
                  x[i]=amg->x_C[amg->mask_C[i]];  
             } else {  
                  x[i]=amg->x_F[amg->mask_F[i]];  
             }  
         }  
473                    
         time0=Paso_timer()-time0;  
         if (verbose) fprintf(stderr,"timing: After next level: %e\n",time0);  
   
474       /*postsmoothing*/       /*postsmoothing*/
475       time0=Paso_timer();       time0=Paso_timer();
476       #pragma omp parallel for private(i) schedule(static)       #pragma omp parallel for private(i) schedule(static)
# Line 492  void Paso_Solver_solveAMG(Paso_Solver_AM Line 480  void Paso_Solver_solveAMG(Paso_Solver_AM
480       Paso_SparseMatrix_MatrixVector_CSR_OFFSET0(-1.,amg->A,x,1.,r);       Paso_SparseMatrix_MatrixVector_CSR_OFFSET0(-1.,amg->A,x,1.,r);
481       Paso_Solver_solveJacobi(amg->GS,x0,r);       Paso_Solver_solveJacobi(amg->GS,x0,r);
482            
483        
484       #pragma omp parallel for private(i) schedule(static)       #pragma omp parallel for private(i) schedule(static)
485       for (i=0;i<amg->n;++i) x[i]+=x0[i];       for (i=0;i<amg->n;++i)  {
486          x[i]+=x0[i];
487          /*printf("x[%d]=%e \n",i,x[i]);*/
488         }
489            
490       time0=Paso_timer()-time0;       time0=Paso_timer()-time0;
491       if (verbose) fprintf(stderr,"timing: Postsmoothing: %e\n",time0);       if (verbose) fprintf(stderr,"timing: Postsmoothing: %e\n",time0);
# Line 503  void Paso_Solver_solveAMG(Paso_Solver_AM Line 495  void Paso_Solver_solveAMG(Paso_Solver_AM
495       }       }
496       MEMFREE(r);       MEMFREE(r);
497       MEMFREE(x0);       MEMFREE(x0);
498    
499       return;       return;
500  }  }

Legend:
Removed from v.2759  
changed lines
  Added in v.2760

  ViewVC Help
Powered by ViewVC 1.1.26