Uses of Class
org.apache.nutch.scoring.ScoringFilterException
Packages that use ScoringFilterException
Package
Description
The
ScoringFilter interface.Scoring filter to stop crawling at a configurable depth
(number of "hops" from seed URLs).
Scoring filter used in conjunction with
WebGraph.Metadata Scoring Plugin
Scoring filter implementing a variant of the Online Page Importance Computation
(OPIC) algorithm.
Scoring filter to modify score or status of orphaned pages (no inlinks found
for a configurable amount of time).
URL Meta Tag Scoring Plugin
-
Uses of ScoringFilterException in org.apache.nutch.scoring
Methods in org.apache.nutch.scoring that throw ScoringFilterExceptionModifier and TypeMethodDescriptionAbstractScoringFilter.distributeScoreToOutlinks(Text fromUrl, ParseData parseData, Collection<Map.Entry<Text, CrawlDatum>> targets, CrawlDatum adjust, int allCount) ScoringFilter.distributeScoreToOutlinks(Text fromUrl, ParseData parseData, Collection<Map.Entry<Text, CrawlDatum>> targets, CrawlDatum adjust, int allCount) Distribute score value from the current page to all its outlinked pages.ScoringFilters.distributeScoreToOutlinks(Text fromUrl, ParseData parseData, Collection<Map.Entry<Text, CrawlDatum>> targets, CrawlDatum adjust, int allCount) floatAbstractScoringFilter.generatorSortValue(Text url, CrawlDatum datum, float initSort) floatScoringFilter.generatorSortValue(Text url, CrawlDatum datum, float initSort) This method prepares a sort value for the purpose of sorting and selecting top N scoring pages during fetchlist generation.floatScoringFilters.generatorSortValue(Text url, CrawlDatum datum, float initSort) Calculate a sort value for Generate.floatAbstractScoringFilter.indexerScore(Text url, NutchDocument doc, CrawlDatum dbDatum, CrawlDatum fetchDatum, Parse parse, Inlinks inlinks, float initScore) floatScoringFilter.indexerScore(Text url, NutchDocument doc, CrawlDatum dbDatum, CrawlDatum fetchDatum, Parse parse, Inlinks inlinks, float initScore) This method calculates a indexed document score/boost.floatScoringFilters.indexerScore(Text url, NutchDocument doc, CrawlDatum dbDatum, CrawlDatum fetchDatum, Parse parse, Inlinks inlinks, float initScore) voidAbstractScoringFilter.initialScore(Text url, CrawlDatum datum) voidScoringFilter.initialScore(Text url, CrawlDatum datum) Set an initial score for newly discovered pages.voidScoringFilters.initialScore(Text url, CrawlDatum datum) Calculate a new initial score, used when adding newly discovered pages.voidAbstractScoringFilter.injectedScore(Text url, CrawlDatum datum) voidScoringFilter.injectedScore(Text url, CrawlDatum datum) Set an initial score for newly injected pages.voidScoringFilters.injectedScore(Text url, CrawlDatum datum) Calculate a new initial score, used when injecting new pages.default voidScoringFilter.orphanedScore(Text url, CrawlDatum datum) This method may change the score or status of CrawlDatum during CrawlDb update, when the URL is neither fetched nor has any inlinks.voidScoringFilters.orphanedScore(Text url, CrawlDatum datum) Calculate orphaned page score during CrawlDb.update().voidAbstractScoringFilter.passScoreAfterParsing(Text url, Content content, Parse parse) voidScoringFilter.passScoreAfterParsing(Text url, Content content, Parse parse) Currently a part of score distribution is performed using only data coming from the parsing process.voidScoringFilters.passScoreAfterParsing(Text url, Content content, Parse parse) voidAbstractScoringFilter.passScoreBeforeParsing(Text url, CrawlDatum datum, Content content) voidScoringFilter.passScoreBeforeParsing(Text url, CrawlDatum datum, Content content) This method takes all relevant score information from the current datum (coming from a generated fetchlist) and stores it intoContentmetadata.voidScoringFilters.passScoreBeforeParsing(Text url, CrawlDatum datum, Content content) voidAbstractScoringFilter.updateDbScore(Text url, CrawlDatum old, CrawlDatum datum, List<CrawlDatum> inlinked) voidScoringFilter.updateDbScore(Text url, CrawlDatum old, CrawlDatum datum, List<CrawlDatum> inlinked) This method calculates a new score of CrawlDatum during CrawlDb update, based on the initial value of the original CrawlDatum, and also score values contributed by inlinked pages.voidScoringFilters.updateDbScore(Text url, CrawlDatum old, CrawlDatum datum, List<CrawlDatum> inlinked) Calculate updated page score during CrawlDb.update(). -
Uses of ScoringFilterException in org.apache.nutch.scoring.depth
Methods in org.apache.nutch.scoring.depth that throw ScoringFilterExceptionModifier and TypeMethodDescriptionDepthScoringFilter.distributeScoreToOutlinks(Text fromUrl, ParseData parseData, Collection<Map.Entry<Text, CrawlDatum>> targets, CrawlDatum adjust, int allCount) floatDepthScoringFilter.generatorSortValue(Text url, CrawlDatum datum, float initSort) floatDepthScoringFilter.indexerScore(Text url, NutchDocument doc, CrawlDatum dbDatum, CrawlDatum fetchDatum, Parse parse, Inlinks inlinks, float initScore) voidDepthScoringFilter.initialScore(Text url, CrawlDatum datum) voidDepthScoringFilter.injectedScore(Text url, CrawlDatum datum) voidDepthScoringFilter.passScoreAfterParsing(Text url, Content content, Parse parse) voidDepthScoringFilter.passScoreBeforeParsing(Text url, CrawlDatum datum, Content content) voidDepthScoringFilter.updateDbScore(Text url, CrawlDatum old, CrawlDatum datum, List<CrawlDatum> inlinked) -
Uses of ScoringFilterException in org.apache.nutch.scoring.link
Methods in org.apache.nutch.scoring.link that throw ScoringFilterExceptionModifier and TypeMethodDescriptionfloatLinkAnalysisScoringFilter.generatorSortValue(Text url, CrawlDatum datum, float initSort) floatLinkAnalysisScoringFilter.indexerScore(Text url, NutchDocument doc, CrawlDatum dbDatum, CrawlDatum fetchDatum, Parse parse, Inlinks inlinks, float initScore) voidLinkAnalysisScoringFilter.initialScore(Text url, CrawlDatum datum) voidLinkAnalysisScoringFilter.passScoreAfterParsing(Text url, Content content, Parse parse) voidLinkAnalysisScoringFilter.passScoreBeforeParsing(Text url, CrawlDatum datum, Content content) -
Uses of ScoringFilterException in org.apache.nutch.scoring.metadata
Methods in org.apache.nutch.scoring.metadata that throw ScoringFilterExceptionModifier and TypeMethodDescriptionMetadataScoringFilter.distributeScoreToOutlinks(Text fromUrl, ParseData parseData, Collection<Map.Entry<Text, CrawlDatum>> targets, CrawlDatum adjust, int allCount) This will take the metadata that you have listed in your "scoring.parse.md" property, and looks for them inside the parseData object. -
Uses of ScoringFilterException in org.apache.nutch.scoring.opic
Methods in org.apache.nutch.scoring.opic that throw ScoringFilterExceptionModifier and TypeMethodDescriptionOPICScoringFilter.distributeScoreToOutlinks(Text fromUrl, ParseData parseData, Collection<Map.Entry<Text, CrawlDatum>> targets, CrawlDatum adjust, int allCount) Get a float value from Fetcher.SCORE_KEY, divide it by the number of outlinks and apply.floatOPICScoringFilter.generatorSortValue(Text url, CrawlDatum datum, float initSort) floatOPICScoringFilter.indexerScore(Text url, NutchDocument doc, CrawlDatum dbDatum, CrawlDatum fetchDatum, Parse parse, Inlinks inlinks, float initScore) Dampen the boost value by scorePower.voidOPICScoringFilter.initialScore(Text url, CrawlDatum datum) Set to 0.0f (unknown value) - inlink contributions will bring it to a correct level.voidOPICScoringFilter.injectedScore(Text url, CrawlDatum datum) voidOPICScoringFilter.updateDbScore(Text url, CrawlDatum old, CrawlDatum datum, List<CrawlDatum> inlinked) Increase the score by a sum of inlinked scores. -
Uses of ScoringFilterException in org.apache.nutch.scoring.orphan
Methods in org.apache.nutch.scoring.orphan that throw ScoringFilterExceptionModifier and TypeMethodDescriptionvoidOrphanScoringFilter.updateDbScore(Text url, CrawlDatum old, CrawlDatum datum, List<CrawlDatum> inlinks) Used for orphan control. -
Uses of ScoringFilterException in org.apache.nutch.scoring.similarity
Methods in org.apache.nutch.scoring.similarity that throw ScoringFilterExceptionModifier and TypeMethodDescriptionSimilarityScoringFilter.distributeScoreToOutlinks(Text fromUrl, ParseData parseData, Collection<Map.Entry<Text, CrawlDatum>> targets, CrawlDatum adjust, int allCount) voidSimilarityScoringFilter.passScoreAfterParsing(Text url, Content content, Parse parse) -
Uses of ScoringFilterException in org.apache.nutch.scoring.urlmeta
Methods in org.apache.nutch.scoring.urlmeta that throw ScoringFilterExceptionModifier and TypeMethodDescriptionURLMetaScoringFilter.distributeScoreToOutlinks(Text fromUrl, ParseData parseData, Collection<Map.Entry<Text, CrawlDatum>> targets, CrawlDatum adjust, int allCount) This will take the metatags that you have listed in your "urlmeta.tags" property, and looks for them inside the parseData object.