集成

将 Helodata 与您的团队已在使用的工具配合使用

Helodata 使用标准 HTTP 和 SOCKS5 协议。如果您的工具支持代理 — 几乎所有现代数据工具都支持 — Helodata 即可无缝接入,零迁移成本。以下是我们客户最常用的 15 个框架的实用示例。

Helodata 如何与您的技术栈配合工作

即插即用兼容(现有)

Helodata 提供标准的 HTTP/SOCKS5 端点,采用用户名:密码认证。任何支持这些协议的客户端 — 基本上是所有现代 HTTP 库、抓取框架和无头浏览器 — 都无需修改即可使用。

您不需要 Helodata 专用库。您不需要重写抓取器。将现有客户端指向我们的网关,粘贴控制面板中的凭证,即可开始使用。

一级支持(开发中)

具有自动轮换、重试、粘性会话和类型安全响应处理的原生库将于 2026 年 Q3 发布:

  • Python SDK
  • Node.js SDK
  • Go SDK
  • Java SDK
  • Open-source MCP server for AI agents

目前,以下即插即用方法涵盖所有工作流程。查看SDK 路线图了解详情。

AI 代理与 LLM 框架

LangChain

将 Helodata 用作任何访问网络的 LangChain 工具的 HTTP 后端 — RequestsGetTool、RequestsPostTool 或您自己的自定义 Tool。

Python · LangChain
from langchain_community.tools.requests.tool import (
    RequestsGetTool,
)
from langchain_community.utilities.requests import (
    TextRequestsWrapper,
)

# Get credentials from your Helodata dashboard
PROXY = "http://USER:PASS@gate.helodata.io:7777"

wrapper = TextRequestsWrapper(
    headers={},
    auth=None,
    proxies={"http": PROXY, "https": PROXY},
)
tool = RequestsGetTool(
    requests_wrapper=wrapper,
    allow_dangerous_requests=True,
)

LlamaIndex

LlamaIndex 的 Web 读取器底层使用 httpx。在构造读取器时传入代理配置。

Python · LlamaIndex
from llama_index.readers.web import SimpleWebPageReader
import httpx

PROXY = "http://USER:PASS@gate.helodata.io:7777"
client = httpx.Client(proxies=PROXY, timeout=30.0)
reader = SimpleWebPageReader(html_to_text=True, _client=client)
documents = reader.load_data(urls=["https://example.com"])

n8n

n8n 的 HTTP Request 节点在 Authentication 选项卡上有一个代理字段。将您的 Helodata 网关 URL 放入此处 — 即可用于所有下游节点。

对于自托管 n8n,设置环境变量: N8N_DEFAULT_PROXY=http://USER:PASS@gate.helodata.io:7777

MCP 服务器

第一方 Helodata MCP 服务器将于 2026 年 Q3 发布 — 一条命令即可安装,向 Claude Desktop、Cursor、Cline 及任何 MCP 兼容客户端暴露代理能力。

在此之前,将任何 MCP 服务器的 HTTP 工具指向 Helodata 网关,使用与其它地方相同的凭证即可。 MCP 服务器发布时获取通知 →

网页抓取框架

Scrapy

Scrapy 通过 HttpProxyMiddleware(内置)支持代理。添加到您的 settings.py:

Python · Scrapy settings.py
# settings.py
DOWNLOADER_MIDDLEWARES = {
    'scrapy.downloadermiddlewares.httpproxy.'
    'HttpProxyMiddleware': 110,
}

HTTP_PROXY  = "http://USER:PASS@gate.helodata.io:7777"
HTTPS_PROXY = "http://USER:PASS@gate.helodata.io:7777"

对于按请求轮换代理,使用 scrapy-rotating-proxies 并提供 Helodata 粘性会话凭证列表。

Playwright

将代理配置传递给浏览器上下文(Python、Node.js、Java、.NET 均使用相同格式):

Python · Playwright
from playwright.sync_api import sync_playwright

with sync_playwright() as p:
    browser = p.chromium.launch(proxy={
        "server": "http://gate.helodata.io:7777",
        "username": "USER",
        "password": "PASS",
    })
    page = browser.new_page()
    page.goto("https://example.com")

Puppeteer

Puppeteer 将代理配置作为启动参数接收:

Node.js · Puppeteer
import puppeteer from 'puppeteer';

const browser = await puppeteer.launch({
  args: ['--proxy-server=http://gate.helodata.io:7777'],
});
const page = await browser.newPage();
await page.authenticate({ username: 'USER', password: 'PASS' });
await page.goto('https://example.com');

Selenium

Selenium 4+ 通过 Capabilities 对象支持代理:

Python · Selenium
from selenium import webdriver
from selenium.webdriver.common.proxy import Proxy, ProxyType

proxy = Proxy()
proxy.proxy_type = ProxyType.MANUAL
proxy.http_proxy  = "USER:PASS@gate.helodata.io:7777"
proxy.ssl_proxy   = "USER:PASS@gate.helodata.io:7777"

caps = webdriver.DesiredCapabilities.CHROME.copy()
proxy.add_to_capabilities(caps)
driver = webdriver.Chrome(desired_capabilities=caps)

Apify

Apify Actors 接受 proxyConfiguration 输入。对于自管理代理,请使用:

Apify · input.json
{
  "proxyConfiguration": {
    "useApifyProxy": false,
    "proxyUrls": [
      "http://USER:PASS@gate.helodata.io:7777"
    ]
  }
}

Browserless

Browserless 通过页面连接参数中的 --proxy-server 标志支持自定义代理:

https://chrome.browserless.io?token=KEY&--proxy-server=http://gate.helodata.io:7777

连接后通过 Page.authenticate 传递认证凭证。

BeautifulSoup(配合 requests)

BeautifulSoup 解析 HTML — 它不执行抓取。将其与 requests 或 httpx 配合使用,通过 Helodata 获取数据:

Python · BeautifulSoup + requests
import requests
from bs4 import BeautifulSoup

PROXY = "http://USER:PASS@gate.helodata.io:7777"
r = requests.get(
    "https://example.com",
    proxies={"http": PROXY, "https": PROXY},
)
soup = BeautifulSoup(r.text, "html.parser")

从 zyte 迁移

zyte Smart Proxy Manager 和 zyte API 都提供与 Helodata 类似的代理端点。迁移步骤:

  1. 将 proxy.zyte.com:8011 替换为 gate.helodata.io:7777
  2. 将您的 zyte API 密钥换成 Helodata 凭证
  3. 粘性会话:使用 username-session-XXXX 格式(与 zyte 一致)
  4. 地理定位:在用户名中传入 country-XX(与 zyte 一致)

大多数现有的 zyte 集成无需其他代码更改。 Helodata 的合规 IP 来源和 KYC 合规性 是新增优势,而非对 zyte 价值主张的替代。

HTTP 库

Python requests

Python · requests
import requests

PROXY = "http://USER:PASS@gate.helodata.io:7777"
r = requests.get(
    "https://api.target.com/v1/data",
    proxies={"http": PROXY, "https": PROXY},
    timeout=30,
)

Node.js axios

Node.js · axios + https-proxy-agent
import axios from 'axios';
import { HttpsProxyAgent } from 'https-proxy-agent';

const agent = new HttpsProxyAgent(
  'http://USER:PASS@gate.helodata.io:7777'
);
const r = await axios.get('https://api.target.com', {
  httpAgent: agent,
  httpsAgent: agent,
  timeout: 30000,
});

Python httpx

Python · httpx
import httpx

proxy = "http://USER:PASS@gate.helodata.io:7777"
with httpx.Client(proxies=proxy, timeout=30.0) as client:
    r = client.get("https://api.target.com")

Node.js Cheerio

Cheerio 在 Node 上解析 HTML,类似于 Python 上的 BeautifulSoup。与 axios 或 got 配合使用,通过 Helodata 获取数据:

Node.js · Cheerio + axios
import axios from 'axios';
import * as cheerio from 'cheerio';
import { HttpsProxyAgent } from 'https-proxy-agent';

const agent = new HttpsProxyAgent(
  'http://USER:PASS@gate.helodata.io:7777'
);
const r = await axios.get('https://example.com', {
  httpsAgent: agent,
});
const $ = cheerio.load(r.data);

curl

shell
curl -x http://USER:PASS@gate.helodata.io:7777 \
     https://api.target.com/v1/data

没有找到您的工具?

如果您的工具支持 HTTP 或 SOCKS5 代理 — 几乎所有现代数据工具都支持 — Helodata 即可工作。我们经常被问到的常见场景:

  • wget、lynx、w3m — 标准 --proxy 或 http_proxy 环境变量
  • Java HttpClient — System.setProperty("http.proxyHost", ...)
  • .NET HttpClient — WebProxy 类
  • Rust reqwest — Proxy::http("...")
  • PHP Guzzle — 请求配置中的 'proxy' 选项
  • Ruby Faraday — Faraday::ProxyOptions
  • Go net/http — Transport.Proxy = http.ProxyURL(...)

如果您的技术栈确实不支持标准代理配置,发送邮件至支持团队 — 我们将记录解决方案或将其列入路线图。

常见问题解答

Helodata 是否有官方的 LangChain / LlamaIndex / n8n 集成?

Helodata 目前通过标准 HTTP 代理配置即可与 LangChain、LlamaIndex 和 n8n 配合使用 — 无需 Helodata 专用包。内置自动轮换功能的第一方原生集成已列入 2026 年 Q3 路线图。

我需要 Helodata SDK 才能使用 Helodata 吗?

不需要。Helodata 通过标准 HTTP/SOCKS5 访问,因此任何 HTTP 客户端或抓取框架无需 Helodata 专用库即可使用。2026 年 Q3 发布的 SDK 将添加自动轮换、重试和类型安全响应处理等便捷功能 — 但它们是可选的。

我可以从 Bright Data、Oxylabs 或 zyte 迁移而无需重写代码吗?

大多数情况下可以。Helodata 使用与这些提供商相同的 HTTP/SOCKS5 协议,并支持类似的基于用户名的地理定位和粘性会话约定。对于大多数客户,迁移只需更换凭证。发送邮件至支持团队如果您希望针对您的特定技术栈进行迁移指导。

Helodata 能否与自托管抓取器(如 Crawlee)配合使用?

可以。Crawlee、Colly(Go)及其他自托管抓取框架都通过标准配置支持 HTTP/SOCKS5 代理。集成模式与上述 Scrapy 和 Puppeteer 示例相同。