#!/usr/bin/env python3
import subprocess
from pathlib import Path

from scrape_bookmarks import clean_markdown


ROOT = Path(__file__).resolve().parent
pages = {
    "0036-rooming-house-new-property-australia.md": "https://newproperty.com.au/property-types/rooming-house/",
    "0037-a-guide-to-single-tenant-vs-multi-tenant-commercial-real-estate-faqs-answered-binary-stream.md": "https://binarystream.com/a-guide-to-single-tenant-vs-multi-tenant-commercial-real-estate-faqs-answered/",
}

for filename, url in pages.items():
    result = subprocess.run(["w3m", "-dump", "-T", "text/html", url], check=False, capture_output=True, text=True)
    if result.returncode != 0 or len(result.stdout.strip()) < 300:
        print(f"No fallback content for {filename}")
        continue
    title = filename[5:-3].replace("-", " ").title()
    (ROOT / "property-pages" / filename).write_text(clean_markdown(result.stdout, title), encoding="utf-8")
    print(f"Recovered {filename}")
