Code
Hub
Workspaces
Following
Trending
Connect
MCP
copy
Create free account
hub
/
github.com/GAO-pooh/paper-scraper
/ functions
Functions
163 in github.com/GAO-pooh/paper-scraper
⨍
Functions
163
◇
Types & classes
6
↓ 1 callers
Method
_open_informs_tab
在调试 Chrome 中打开 INFORMS 登录页。
informs_scraper.py:312
↓ 1 callers
Method
_open_informs_tab
Open the INFORMS login page in the debug Chrome.
informs_scraper_en.py:305
↓ 1 callers
Method
_parse_article
Parse a single search result item.
sd_scraper_en.py:511
↓ 1 callers
Method
_parse_article
解析单条搜索结果。
sd_scraper.py:528
↓ 1 callers
Method
_wait_for_login
Prompt the user to complete institutional login in the Chrome window.
sd_scraper_en.py:1160
↓ 1 callers
Method
browse_journal
浏览期刊所有文章(按时间倒序)。 通过 /loi/{journal} 页面获取卷期列表,再逐期抓取 TOC。
informs_scraper.py:1081
↓ 1 callers
Method
browse_journal
Browse all articles in a journal (most recent first). Fetches the issue list from /loi/{journal}, then iterates through TOCs.
informs_scraper_en.py:1022
↓ 1 callers
Method
browse_toc
抓取指定卷期的完整目录。 参数 ---- journal_code : 期刊代码,如 "mnsc" volume : 卷号,如 71 issue : 期号,如 3
informs_scraper.py:1149
↓ 1 callers
Method
browse_toc
Fetch the full table of contents for a specific volume/issue. Parameters ---------- journal_code : e.g. "mnsc"
informs_scraper_en.py:1086
↓ 1 callers
Function
build_parser
()
sd_scraper_en.py:1514
↓ 1 callers
Function
build_parser
()
sd_scraper.py:1890
↓ 1 callers
Method
download_pdfs
批量下载 PDF。 原理 ---- INFORMS PubsOnLine 的 PDF 端点: GET /doi/pdf/{doi}?download=true 有效的登录 session coo
informs_scraper.py:1314
↓ 1 callers
Method
download_pdfs
Batch PDF download. How it works ------------ INFORMS PubsOnLine PDF endpoint: GET /doi/pdf/{doi}?download
informs_scraper_en.py:1251
↓ 1 callers
Function
interactive_mode
()
sd_scraper_en.py:1410
↓ 1 callers
Function
interactive_mode
()
sd_scraper.py:1786
↓ 1 callers
Function
main
()
informs_scraper.py:1611
↓ 1 callers
Function
main
()
informs_scraper_en.py:1537
↓ 1 callers
Function
main
()
sd_scraper_en.py:1560
↓ 1 callers
Function
main
()
sd_scraper.py:1936
↓ 1 callers
Method
open_chrome_for_login
Open a debug Chrome window so the user can complete institutional login.
sd_scraper_en.py:1078
↓ 1 callers
Method
open_chrome_for_login
从终端打开一个带远程调试端口的真实 Chrome,供用户手动完成机构登录。
sd_scraper.py:1426
↓ 1 callers
Method
save_to_json
(self, results: list, filename: str, output_dir: str)
informs_scraper.py:1277
↓ 1 callers
Method
save_to_json
(self, results: list, filename: str, output_dir: str)
informs_scraper_en.py:1214
↓ 1 callers
Method
save_to_xlsx
(self, results: list, filename: str, output_dir: str)
informs_scraper.py:1285
↓ 1 callers
Method
save_to_xlsx
(self, results: list, filename: str, output_dir: str)
informs_scraper_en.py:1222
↓ 1 callers
Method
search_advanced
高级搜索:组合关键词、期刊、作者、时间范围。
informs_scraper.py:1186
↓ 1 callers
Method
search_advanced
Advanced search: combine keyword, journal, author, and date range.
informs_scraper_en.py:1123
↓ 1 callers
Method
search_by_keyword
按关键词搜索(支持 AND/OR/NOT 布尔运算符)。 参数 ---- query : 搜索词,如 "machine learning" 或 "supply AND chain" count
informs_scraper.py:998
↓ 1 callers
Method
search_by_keyword
Search by keyword (supports AND/OR/NOT Boolean operators). Parameters ---------- query : search string, e.g.
informs_scraper_en.py:940
↓ 1 callers
Method
send
(method, params=None)
informs_scraper_en.py:598
Method
__init__
( self, member_id=None, password=None, cookies_file=None, use_browser_
informs_scraper.py:138
Method
__init__
(self, text)
informs_scraper.py:746
Method
__init__
( self, member_id=None, password=None, cookies_file=None, use_browser_
informs_scraper_en.py:134
Method
__init__
(self, text)
informs_scraper_en.py:708
Method
__init__
(self, cookies_file=None, use_browser_cookies=False, delay_range=(2, 5))
sd_scraper_en.py:309
Method
__init__
(self, cookies_file=None, use_browser_cookies=False, delay_range=(2, 5))
sd_scraper.py:314
Method
_check_institutional_access
Returns True if institutional download access is confirmed.
sd_scraper_en.py:794
Method
_check_institutional_access
返回 True 表示有机构下载权限。
sd_scraper.py:1112
Method
_close
()
informs_scraper.py:608
Method
_close
()
informs_scraper_en.py:580
Method
_ensure_cookies_with_cdp
用 CDP Chrome 访问 ScienceDirect 主页,获取包含 session cookies 的完整 Cookie。 返回 (cookie_header_str, needs_login)。 若 CDP 不可用,退回到 browser_
sd_scraper.py:790
Method
_ensure_tab
()
sd_scraper_en.py:878
Method
_ensure_tab
若持久 tab 的 DevTools 连接已失效,重建它。
sd_scraper.py:1201
Method
_fetch_one
(pii, pdf_url)
sd_scraper_en.py:892
Method
_fetch_one
在持久 tab 里先导航文章页(建立 Cookie 上下文), 再拦截 pdfft PDF 字节。返回 (bytes|None, note)。
sd_scraper.py:1216
Method
_fetch_pdf_link_from_article
用 curl_cffi 访问文章页 HTML,提取 View PDF 按钮的 href(含 md5/pid)。 返回完整 URL 或 None。
sd_scraper.py:748
Method
_get_cookies_via_browser_cookie3
Read persisted cookies from disk (fallback; lacks session cookies).
sd_scraper_en.py:711
Method
_get_cookies_via_cdp
Extract all relevant cookies from a CDP Chrome context.
sd_scraper_en.py:696
Method
_prompt_login
()
sd_scraper_en.py:781
Method
_prompt_login
()
sd_scraper.py:1095
Method
_s
(method, params=None)
sd_scraper_en.py:857
Method
_s
(method, params=None)
sd_scraper.py:1180
Method
_tab_navigate
(url, wait=5.0)
sd_scraper_en.py:850
Method
_tab_navigate
在持久标签页内导航到 url,等待页面加载,不抛异常。
sd_scraper.py:1172
Method
close_tab
(page_id)
sd_scraper_en.py:775
Method
close_tab
(page_id)
sd_scraper.py:1089
Method
download_pdfs
【主要下载方法】全自动 PDF 下载,无需手动点击机器人验证。 工作原理(已验证可行) --------------------- Cloudflare 的机器人验证分两层: ① /pdfft 端点:无论 curl
sd_scraper.py:837
Method
download_pdfs_via_chrome
Download PDFs by driving Chrome via CDP + Playwright. The script will: 1. Copy persistent cookies from default Chrome Profi
sd_scraper_en.py:1187
Method
download_pdfs_via_chrome
通过 Chrome DevTools Protocol 驱动 Chrome 下载 PDF。 脚本会自动: ① 复制默认 Chrome Profile 的持久化 Cookie(可能保留部分登录状态) ② 启动带调试端口的 Chr
sd_scraper.py:1546
Method
open_tab
(url)
sd_scraper_en.py:770
Method
open_tab
(url)
sd_scraper.py:1084
Method
text
(tag)
informs_scraper.py:758
Method
text
(tag)
informs_scraper_en.py:717
← previous
101–163 of 163, ranked by callers