legacy-knowledge-base
公開されました Jun. 30, 2025

ジャーナル記事の再インデックス作成時のHTML解析エラー(jericho)

written-by

Daniel Carrillo Broeder

How To articles are not official guidelines or officially supported documentation. They are community-contributed content and may not always reflect the latest updates to Liferay DXP. We welcome your feedback to improve How To articles!

While we make every effort to ensure this Knowledge Base is accurate, it may not always reflect the most recent updates or official guidelines.We appreciate your understanding and encourage you to reach out with any feedback or concerns.

legacy-article

learn-legacy-article-disclaimer-text

問題

  • 一般的に、このエラーは四半期リリースにアップグレードした後に発生する可能性があります。
  • 特定のウェブコンテンツを再インデックスまたは更新すると、以下のようなエラーがログに表示されます:
  • ERROR [default-38][jericho:211] EndTag li at (r1,c466,p465) not recognised as type '/normal' because its name and closing delimiter are separated by characters other than white space
    ERROR [default-38][jericho:211] Encountered possible EndTag at (r1,c466,p465) whose content does not match a registered EndTagType

環境

  • DXP 7.0、7.1、7.2、7.3、7.4
  • DXP四半期リリース

解像度

  • これは、無効なHTMLをウェブコンテンツに直接保存した後に発生する可能性があります。
  • これは、インデックス作成プロセスの結果には影響しないが、特定のコンテンツ、またはコンテンツの特定のインデックスされたバージョンについて、誤ったデータをインデックスする可能性がある。
  • 現時点での解決策は、このエラーの原因となっているHTMLを実際に修正することだ。
  • reindexCompanyWebContents.groovyというGroovyスクリプトを実行すると、すべてのWebコンテンツのインデックスを再作成し、無効なWebコンテンツを見つけることができます:
    • companyIdを正しい値に置き換えてください。
    • ジャーナル記事は、articleIdgroupId、タイトルで見つけることができる:
    • INFO  [JOURNAL REINDEXER:-1] Indexing: articleId=12345; groupId=12345; title=Example
      ERROR [jericho:211] <Error>
    • その後、このウェブコンテンツの最新バージョンを確認し、古いバージョンを削除する。
    • 重要:このスクリプトは、ある企業のすべてのジャーナル記事をインデックス化するため、負荷が高くなり、かなりの数のトレースを生成する可能性があります。 より効率的なソリューションが必要な場合、または特定の環境用にカスタマイズされたスクリプトが必要な場合は、エンタープライズ サブスクリプションでサポート チケットを作成してください。

did-this-article-resolve-your-issue

legacy-knowledge-base