Source source = new Source(new URL("https://www.example.com/page.html")); TableIterator iterator = source.findAllTables().iterator(); while (iterator.hasNext()) { Table table = iterator.nextTable(); for (TableRow row : table.getRows()) { for (TableColumn column : row.getColumns()) { String cellData = column.getContent().getTextExtractor().toString(); System.out.println(cellData); } } } import net.htmlparser.jericho.*; import java.io.IOException; import java.net.URL; public class HTMLTableParser { public static void main(String[] args) throws IOException { Source source = new Source(new URL("https://www.example.com/page.html")); TableIterator iterator = source.findAllTables().iterator(); while (iterator.hasNext()) { Table table = iterator.nextTable(); for (TableRow row : table.getRows()) { for (TableColumn column : row.getColumns()) { String cellData = column.getContent().getTextExtractor().toString(); System.out.println(cellData); } } } } }


上一篇:
下一篇:
切换中文