browser-use ও computer-use AI এজেন্টের জন্য প্রক্সি (২০২৬ গাইড)

4 জুন 2026 প্রকাশিত · ≈11 মিনিট পড়া

2026 হলো সেই বছর যখন AI এজেন্টরা আর কেবল ডেমো থাকেনি। browser-use, OpenAI-এর Operator-ধাঁচের এজেন্ট, Anthropic-এর computer use, এবং Playwright-এর উপর গড়ে ওঠা ডজনখানেক ফ্রেমওয়ার্ক এখন বাস্তব ওয়েবসাইটের বিরুদ্ধে বাস্তব ব্রাউজার চালায় — বুকিং, কেনাকাটা, গবেষণা, মনিটরিং। আর এরা সবাই একই দেয়ালে ধাক্কা খায়: যেসব সাইটে এরা কাজ করে, সেগুলো এদের বট হিসেবেই গণ্য করে, কারণ এরা সত্যিই বট

এই গাইড নির্দিষ্টভাবে ব্রাউজার-চালিত AI এজেন্টদের জন্য প্রক্সি স্তর নিয়ে আলোচনা করে। আপনার এজেন্ট যদি ব্রাউজারের বদলে HTTP লাইব্রেরি ব্যবহার করে (LangChain টুল, CrewAI-এর ভেতরের স্ক্র্যাপার), তাহলে দেখুন AI এজেন্টের জন্য প্রক্সি: LangChain, AutoGPT & CrewAI — এই আর্টিকেলটি সেইসব এজেন্ট নিয়ে যারা একটি পূর্ণাঙ্গ ব্রাউজার নিয়ন্ত্রণ করে।

স্ক্র্যাপারের চেয়ে ব্রাউজার এজেন্ট কেন দ্রুত ব্লক হয়

স্বজ্ঞার বিপরীত হলেও সত্য: একটি বাস্তব Chrome ব্রাউজার চালানো LLM এজেন্ট প্রায়ই একটি সাধারণ Python স্ক্র্যাপারের চেয়ে দ্রুত ব্লক হয়। তিনটি কারণ:

  1. ডেটাসেন্টার IP + নিখুঁত ব্রাউজার = অসঙ্গতি। ব্রাউজার ফিঙ্গারপ্রিন্ট বলে "বাস্তব হার্ডওয়্যারে বাস্তব Chrome," কিন্তু IP-টি AWS বা GCP-এর অন্তর্গত — যেখানে বেশিরভাগ এজেন্ট চলে। অ্যান্টি-বট ভেন্ডররা IP ASN-কে অনেক বেশি ওজন দেয়; ডেটাসেন্টার ASN-এ একটি রেসিডেনশিয়াল-গ্রেড ফিঙ্গারপ্রিন্ট হলো অটোমেশনের পাঠ্যপুস্তকীয় স্বাক্ষর।
  2. এজেন্টরা যন্ত্রের মতো রিট্রাই করে। কোনো অ্যাকশন ব্যর্থ হলে, LLM লুপ একই IP থেকে, প্রায় অভিন্ন টাইমিংয়ে তৎক্ষণাৎ আবার চেষ্টা করে। তিনটি দ্রুত অভিন্ন রিট্রাই হলো আচরণগত-শনাক্তকরণের প্রাথমিক পাঠ।
  3. CDP চিহ্ন রেখে যায়। বেশিরভাগ এজেন্ট ফ্রেমওয়ার্ক Chrome DevTools Protocol-এর মাধ্যমে ব্রাউজার চালায়। সাইটগুলো navigator.webdriver, CDP-নির্দিষ্ট টাইমিং আর্টিফ্যাক্ট, এবং headless লক্ষণের জন্য পরীক্ষা চালায়। একটি ফ্ল্যাগ করা IP-এর সাথে মিলিয়ে স্কোর তৎক্ষণাৎ ব্লক থ্রেশহোল্ড অতিক্রম করে।

তিনটির মধ্যে IP-ই সবচেয়ে সস্তায় ঠিক করা যায়, আর কেবল এটি ঠিক করলেই বেশিরভাগ ব্লক সমাধান হয়ে যায়: এজেন্টকে রেসিডেনশিয়াল প্রক্সির মাধ্যমে রাউট করুন যাতে IP-এর গল্প ব্রাউজারের গল্পের সাথে মেলে।

সেটআপ: রেসিডেনশিয়াল প্রক্সির সাথে browser-use

browser-use Playwright-এর উপর বসে, তাই প্রক্সি সাপোর্ট নেটিভ। প্যাটার্নটি হলো: প্রতি এজেন্ট টাস্কে একটি sticky session, যাতে এজেন্ট কাজ করার সময় IP স্থিতিশীল থাকে, এবং পরবর্তী টাস্কের জন্য একটি নতুন IP।

from browser_use import Agent, Browser, BrowserConfig
from langchain_openai import ChatOpenAI
import uuid

task_id = uuid.uuid4().hex[:8]

browser = Browser(config=BrowserConfig(
    proxy={
        "server": "http://us.jibaoproxy.com:913",
        "username": f"USERNAME-session-{task_id}",   # sticky: same IP for this task
        "password": "PASSWORD",
    },
))

agent = Agent(
    task="Find the current price of the Sony WH-1000XM6 on the three largest US retailers.",
    llm=ChatOpenAI(model="gpt-4o"),
    browser=browser,
)
result = await agent.run()

মূল বিষয়: session-{task_id} সাফিক্সটি। এটি ছাড়া, একটি রোটেটিং গেটওয়ে টাস্কের মাঝপথে এজেন্টকে একটি নতুন IP দিয়ে দিতে পারে — কার্টের বিষয়বস্তু উবে যায়, লগইন বাদ পড়ে, আর এজেন্ট ধাপগুলো আবার করতে গিয়ে LLM কল অপচয় করে। এটি থাকলে, টাস্কটি শুরু থেকে শেষ পর্যন্ত একটি IP-তে চলে, আর পরবর্তী টাস্ক একটি পরিষ্কার IP পায়।

সেটআপ: র‌ Playwright / Computer-Use লুপ

আপনি যদি Playwright-এর উপর নিজের এজেন্ট লুপ তৈরি করে থাকেন (যা বেশিরভাগ Operator-ধাঁচের ও computer-use বাস্তবায়নের পেছনের প্যাটার্ন), তাহলে প্রক্সিটি ব্রাউজার কনটেক্সটে যায়:

from playwright.async_api import async_playwright

async with async_playwright() as p:
    browser = await p.chromium.launch(headless=False)
    context = await browser.new_context(
        proxy={
            "server": "http://us.jibaoproxy.com:913",
            "username": "USERNAME-session-agent42",
            "password": "PASSWORD",
        },
        viewport={"width": 1366, "height": 768},
        locale="en-US",
        timezone_id="America/Chicago",   # match the proxy country
    )
    page = await context.new_page()
    # ... agent loop: screenshot -> LLM -> action -> repeat

প্রক্সির দেশের সাথে মেলাতে locale এবং timezone_id সেট করুন। একটি US IP থেকে UTC+8 ঘড়ি নিয়ে ব্রাউজ করা এজেন্ট একটি অসঙ্গতি, যা আচরণগত সিস্টেমগুলো আপনার বিরুদ্ধে স্কোর করে।

প্রতি-কনটেক্সট প্রক্সি আপনাকে একটি ব্রাউজার, অনেক এজেন্টও দেয়: প্রতিটি new_context() নিজস্ব সেশন সাফিক্স বহন করতে পারে, ফলে দশটি Chrome প্রসেস ছাড়াই দশটি একযোগে এজেন্ট টাস্ক দশটি ভিন্ন রেসিডেনশিয়াল IP-তে চলে।

এজেন্ট ওয়ার্কলোডের জন্য সেশন কৌশল

এজেন্ট ওয়ার্কলোডসেশন কৌশলকেন
গবেষণা / দাম যাচাই (লগইন ছাড়া)Sticky, ১০ মিনিট, প্রতি টাস্কে নতুন সেশনটাস্কের ভেতরে স্থিতিশীল, টাস্কের মধ্যে নতুন IP
লগইন-করা অ্যাকাউন্ট অপারেশনSticky ৩০ মিনিট, প্রতিবার একই সেশন IDলগইনের মধ্যে দেশ পাল্টানো অ্যাকাউন্টকে সাইট ফ্ল্যাগ করে
চেকআউট / বুকিং ফ্লোSticky ৩০ মিনিটচেকআউটের মাঝপথে IP পরিবর্তন সেশন নষ্ট করে এবং জালিয়াতি পর্যালোচনা চালু করে
উচ্চ-পরিমাণ মনিটরিং (শত শত পৃষ্ঠা)রোটেটিং, কোনো সেশন পিন নেইIP বৈচিত্র্য সর্বোচ্চ করা, সংরক্ষণের জন্য কোনো স্টেট নেই

খরচ নিয়ন্ত্রণ: এজেন্টরা ব্যান্ডউইথ পোড়ায়

রেসিডেনশিয়াল ট্রাফিক প্রতি GB হিসেবে বিল করা হয়, এবং একটি ব্রাউজার এজেন্ট পূর্ণ পৃষ্ঠা টানে — ছবি, ফন্ট, ট্র্যাকার — একটি HTTP স্ক্র্যাপারের বিপরীতে। নিয়ন্ত্রণহীনভাবে, একটি এজেন্ট টাস্ক ২০–৫০ MB খেয়ে ফেলতে পারে। প্রভাবের ক্রমানুসারে তিনটি সমাধান:

  1. LLM-এর প্রয়োজন নেই এমন ভারী রিসোর্স ব্লক করুন:
    await context.route("**/*.{png,jpg,jpeg,webp,gif,woff,woff2,mp4}",
                        lambda route: route.abort())
    আপনার এজেন্ট যদি স্ক্রিনশট পড়ে, তাহলে টার্গেট পৃষ্ঠায় ছবি রাখুন কিন্তু ভিডিও ও ফন্ট তবু ব্লক করুন। এটি যদি DOM/অ্যাক্সেসিবিলিটি ট্রি পড়ে, তাহলে ছবিও ব্লক করুন — এতে ট্রাফিক ৬০–৮০% কমে।
  2. শুধু যা রাউট করা দরকার তাই রাউট করুন। LLM API কল (OpenAI/Anthropic) রেসিডেনশিয়াল প্রক্সির মধ্য দিয়ে যাওয়া উচিত নয় — এটি বিশুদ্ধ অপচয়ী GB এবং বাড়তি লেটেন্সি। হোস্ট প্রসেস নয়, ব্রাউজার কনটেক্সট প্রক্সি করুন।
  3. ফ্রেমওয়ার্ক স্তরে রিট্রাই সীমিত করুন। সর্বোচ্চ দুটি রিট্রাই, ব্যাকঅফ সহ এবং দ্বিতীয়টিতে একটি নতুন সেশন ID — তৃতীয় অভিন্ন প্রচেষ্টার চেয়ে একটি নতুন IP বেশি ব্লক ঠিক করে।

ছবি ব্লকিং এবং সীমিত রাউটিং সহ, সাধারণ ব্রাউজার-এজেন্ট টাস্ক ২–৮ MB রেঞ্জে নামে — $2/GB-তে যা প্রতি একশো টাস্কে মাত্র কয়েক সেন্ট।

ফ্রি টুল · সাইনআপ লাগে না

আপনার এজেন্টের ব্রাউজার কি অ্যান্টি-বট স্ক্রিনিং পার হতে পারবে?

আপনার এজেন্ট (বা আপনার নিজের ব্রাউজার) আমাদের Anti-Bot Detector-এ পয়েন্ট করুন: এটি সাইটগুলো ঠিক যে সংকেতগুলো যাচাই করে সেগুলোর স্কোর করে — IP টাইপ, ASN, headless লক্ষণ, ফিঙ্গারপ্রিন্ট সঙ্গতি — এবং বলে দেয় কোনটি আপনাকে ধরিয়ে দিচ্ছে।

অ্যান্টি-বট চেক চালান →

এটি যদি আপনার IP-কে ডেটাসেন্টার হিসেবে ফ্ল্যাগ করে, তাহলে সেটাই প্রথমে ঠিক করার জিনিস — 500MB ফ্রি ট্রাফিক নিন →

প্রক্সি যা ঠিক করে না

সততার অংশ। একটি রেসিডেনশিয়াল IP ASN অসঙ্গতি এবং IP সুনাম ঠিক করে, যা 2026-এর অ্যান্টি-বট স্কোরিংয়ে সবচেয়ে ভারী একক সংকেত। এটি যা ঠিক করে না:

একটি রেসিডেনশিয়াল IP-তে তিনটিই স্ট্যাক করুন, তাহলে ব্রাউজার এজেন্টরা বাস্তব ব্যবহারকারীদের মতোই একই যাচাই পার হয়। সবচেয়ে কঠিন টার্গেটের জন্য (DataDome, PerimeterX), দেখুন আমাদের DataDome/PerimeterX গাইড

সারসংক্ষেপ

আপনার এজেন্টদের রেসিডেনশিয়াল IP দিন

500MB ফ্রি ট্রাফিক — রিসোর্স ব্লকিং চালু রেখে কয়েকশো ব্রাউজার-এজেন্ট টাস্কের জন্য যথেষ্ট।

ফ্রি ট্রায়াল শুরু করুন

সকল IP পণ্যের জন্য · যেকোনো সময় উপলব্ধ বিশাল নোড পুল

এখনই নিবন্ধন করুন এবং আপনার রিচার্জে ১০০% পর্যন্ত ফেরত পান

নতুন ব্যবহারকারীরা নিবন্ধনের সময় 500MB পান, সাথে প্রথম রিচার্জে বোনাস। সীমিত সময়ের অফার।