Token Optimization

Claude Code টোকেন খরচ ৭৫% কমানোর উপায়: প্র্যাকটিক্যাল গাইড

### দ্রুত উত্তর: Claude-কে কীভাবে কম টোকেন ব্যবহার করাবেন

Claude Code-এ টোকেন খরচ ৭৫% পর্যন্ত কমাতে চারটি মূল পদক্ষেপ নিন: বিল্ড ফাইল ও লকফাইল বাদ দিতে একটি কঠোর .claudeignore ফাইল তৈরি করুন, অপরিবর্তনশীল সিস্টেম প্রম্পটের মাধ্যমে Anthropic-এর ৯০% প্রম্পট ক্যাশিং ডিসকাউন্ট ব্যবহার করুন, Context Rot রোধে Scout সাব-এজেন্টের সাহায্যে সাব-টাস্কগুলো আলাদা করুন, এবং রুটিন কোড অনুসন্ধানে Opus-এর বদলে claude-3-7-sonnet কিংবা হালকা claude-3-5-haiku মডেল বেছে নিন।


১. ভূমিকা: টার্মিনাল এজেন্টে টোকেনের অদৃশ্য অপচয়

Anthropic-এর Claude Code-এর মতো স্বায়ত্তশাসিত টার্মিনাল কোডিং এজেন্ট সফটওয়্যার ইঞ্জিনিয়ারিংয়ে বড় পরিবর্তন এনেছে। সাধারণ IDE কোড কমপ্লিশনের বিপরীতে Claude Code সম্পূর্ণ স্বয়ংক্রিয় লুপে কাজ করে: ডিরেক্টরি কাঠামো বিশ্লেষণ করা, হাজার লাইনের কোড ফাইল পড়া, শেল কমান্ড চালানো, কম্পাইলার লগ পর্যবেক্ষণ করা এবং নির্ভুল কোড প্যাচ প্রয়োগ করা।

তবে এই স্বায়ত্তশাসনের কারণে API খরচ উল্লেখযোগ্যভাবে বাড়তে পারে। পূর্বপ্রস্তুতি ও কনফিগারেশন ছাড়া কেবল "JWT রোটেশন সমর্থনের জন্য অথেন্টিকেশন মিডলওয়্যার রিফ্যাক্টর করো"—এমন একটি নির্দেশেই একটি সেশনে ১৫ লাখ থেকে ৩৫ লাখ টোকেন খরচ হয়ে যেতে পারে। এই টোকেন খরচের পেছনে চারটি প্রধান কারণ রয়েছে:

  1. কনটেক্সটের অপ্রয়োজনীয় স্তূপ (Context Rot): প্রতিটি bash কমান্ডের ফলাফল, grep সার্চ, কম্পাইলার ত্রুটি এবং সম্পূর্ণ ফাইলের ডাম্প এজেন্টের সক্রিয় কনটেক্সট উইন্ডোতে জমা হতে থাকে।
  2. ক্যাশ ছাড়া বারবার ডেটা পাঠানো: আগের কথোপকথনে অনিচ্ছাকৃত পরিবর্তনের ফলে Anthropic-এর ৫ মিনিটের ক্ষণস্থায়ী প্রম্পট ক্যাশ বাতিল হয়ে যায়।
  3. অপ্রয়োজনীয় ফাইলের স্ক্যানিং: রেজেক্স সার্চের সময় Claude Code বারবার বিল্ড ফোল্ডার (dist/, target/, .next/), বিশাল আকারের লকফাইল (package-lock.json, pnpm-lock.yaml) এবং ডেটাবেজ ডাম্প পড়ে ফেলে।
  4. অতিরিক্ত বড় মডেলের ব্যবহার: সাধারণ ফাইল খোঁজা বা ডিরেক্টরি দেখার কাজেও অত্যন্ত ব্যয়বহুল রিজনিং মডেল (claude-3-opus বা সর্বোচ্চ Thinking যুক্ত Sonnet) নিযুক্ত করা।

নিয়মতান্ত্রিক ইঞ্জিনিয়ারিং কৌশল — যেমন কঠোর .claudeignore, প্রম্পট ক্যাশিং, সাব-এজেন্ট দ্বারা কনটেক্সট পৃথকীকরণ এবং সুনির্দিষ্ট CLI সেটিংস — প্রয়োগ করে ইঞ্জিনিয়ারিং টিমগুলো তাদের দৈনিক Claude Code টোকেন খরচ ৭০% থেকে ৮০% কমিয়ে আনতে পারে এবং একই সাথে কাজের সাফল্যের হারও বৃদ্ধি করতে পারে।


২. পরিমাণগত অর্থনীতি: টোকেনের মূল্য ও ক্যাশিং আর্কিটেকচার

কোথায় টোকেন অপচয় হয় তা বুঝতে Anthropic API-এর মূল্য তালিকা এবং ক্যাশিং স্তর (২০২৬ সালের মানদণ্ড) পর্যালোচনা করা যাক:

Claude মডেল ভেরিয়েন্ট বেস ইনপুট ($/1M) ক্যাশ রাইট ($/1M) ক্যাশ রিড ($/1M) আউটপুট ($/1M) SWE-bench Verified টার্মিনালে আদর্শ ভূমিকা
Claude 3.5 / 3.7 Haiku $0.80 $1.00 $0.08 $4.00 41.2% সিম্বল সার্চ, রেজেক্স ফিল্টারিং, কমিট মেসেজ তৈরি
Claude 3.7 Sonnet (Standard) $3.00 $3.75 $0.30 $15.00 70.3% প্রধান রিফ্যাক্টরিং, একাধিক ফাইল এডিট, টেস্ট ফিক্স
Claude 3.7 Sonnet (Extended Thinking) $3.00 (ইন) $3.75 (রাইট) $0.30 $15.00 (চিন্তা+আউট) 72.8% জটিল আর্কিটেকচারাল বাগ, কনকারেন্সি রেস কন্ডিশন
Claude 3 Opus / Opus 4.6 $15.00 $18.75 $1.50 $75.00 74.1% নিরাপত্তা অডিট, সম্পূর্ণ সিস্টেম রি-আর্কিটেকচার

খরচ ও টোকেন ৭৫% কমানোর গাণিতিক হিসাব

দেড় লাখ লাইনের একটি TypeScript রিপোজিটরিতে REST API এন্ডপয়েন্ট রিফ্যাক্টর করার জন্য ১৫ ধাপের একটি সাধারণ সেশনের তুলনা করা যাক:

[অ-অনুকূলিত সাধারণ সেশন]
ধাপ ১: পুরো রিপোজিটরি ম্যাপ + package-lock.json + স্কিমা লোড (১৮০,০০০ টোকেন)
ধাপ ২-৫: Grep-এর অপরিবর্তিত আউটপুট, বিল্ড লগ, পুরো ফাইল পড়া (ধাপ প্রতি সঞ্চিত ২৪০,০০০ টোকেন)
ক্যাশ মিস হার: ৪৫% (ডাইনামিক হেডার ও টুলের কারণে ঘন ঘন ক্যাশ বাতিল হওয়া)
মোট প্রসেস করা ইনপুট টোকেন: ৩,২৫০,০০০
প্রকৃত ব্যয় (Sonnet): ~$9.75

[অনুকূলিত সেশন: .claudeignore + Prompt Cache + সাব-এজেন্ট]
ধাপ ১: পরিচ্ছন্ন ও সংক্ষিপ্ত AST সামারি (১৮,০০০ টোকেন) -> ধাপ ১-এই ক্যাশ সম্পন্ন
ধাপ ২-৫: কেবল পরিবর্তনশীল ডিফস, Scout সাব-এজেন্টের সংক্ষিপ্ত রিপোর্ট (ধাপ প্রতি ২২,০০০ টোকেন)
ক্যাশ হিট হার: ৯২% ($0.30/1M ছাড়ের মূল্যে পাঠ)
মোট প্রসেস করা ইনপুট টোকেন: ৪১০,০০০ (টোকেন হ্রাস ৮৭.৩%)
প্রকৃত ব্যয় (Sonnet): ~$0.82 (ব্যয় হ্রাস ৯১.৫%)

৩. প্রথম স্তম্ভ: অপ্রয়োজনীয় কনটেক্সট ছাঁটাইয়ে .claudeignore

যেকোনো রিপোজিটরিতে সবচেয়ে বেশি সাশ্রয়ী পদক্ষেপ হলো প্রোডাকশন মানের একটি সুনির্দিষ্ট .claudeignore ফাইল তৈরি করা।

Claude Code সাধারণত .gitignore ফাইল অনুসরণ করে, তবে সাধারণ .gitignore-এ এমন অনেক ভারী ফাইল থেকে যায় যা LLM-এর কনটেক্সট উইন্ডো নষ্ট করে দেয়। প্যাকেজ লকফাইল, ডকুমেন্টেশন সম্পদ, বিল্ড ফোল্ডার এবং মিনিফাইড বান্ডিল কখনোই এজেন্টের কনটেক্সটে যাওয়া উচিত নয়।

প্রোডাকশন উপযোগী .claudeignore টেমপ্লেট

এই ফাইলটি আপনার প্রজেক্টের রুট ফোল্ডারে রাখুন:

# ==============================================================================
# .claudeignore - প্রোডাকশন টোকেন ফিল্টারিং ম্যাট্রিক্স
# Glob এবং Grep অপারেশনের সময় Claude Code-কে ভারী ফাইল পড়া থেকে বিরত রাখে
# ==============================================================================

# প্যাকেজ লকফাইল (বিশাল আকারের JSON/YAML যা কোড বোঝার জন্য দরকার নেই)
package-lock.json
pnpm-lock.yaml
yarn.lock
bun.lockb
composer.lock
Gemfile.lock
Cargo.lock
poetry.lock

# জেনারেট হওয়া বিল্ড আউটপুট ও বান্ডিল
dist/
build/
out/
.next/
.nuxt/
.astro/
.svelte-kit/
storybook-static/
target/
*.min.js
*.min.css
*.map

# টেস্ট কভারেজ, লগ ও প্রোফাইলিং ডেটা
coverage/
.nyc_output/
*.lcov
*.log
npm-debug.log*
yarn-debug.log*
pnpm-debug.log*
*.heapsnapshot
*.cpuprofile

# মিডিয়া, ছবি ও বাইনারি ফাইল
public/assets/
public/images/
*.png
*.jpg
*.jpeg
*.gif
*.svg
*.webp
*.avif
*.ico
*.pdf
*.zip
*.tar.gz
*.wasm

# প্রজেক্ট ডকুমেন্টেশন ও এক্সটার্নাল স্পেক্স
docs/
*.mdx
specs/swagger/
*.postman_collection.json

# লোকাল এনভায়রনমেন্ট ফাইল ও সিকিউরিটি কি
.env*
!.env.example
*.pem
*.key
*.cert

# ডেটাবেজ মাইগ্রেশন ও SQL ডাম্প
*.sql
*.dump
prisma/migrations/

.claudeignore-এর বাস্তব সুফল

Claude Code যখন কোনো ফোল্ডার স্ক্যান করে, তখন বাদ না দেওয়া একটি package-lock.json (যেখানে প্রায় ২৫,০০০ থেকে ৮০,০০০ লাইন থাকে) একবার পড়তেই ১,২০,০০০-এর বেশি টোকেন নষ্ট করে ফেলে। লকফাইল ও বিল্ড আউটপুট বাদ দিলে প্রাথমিক কনটেক্সটের আকার ১৮০k টোকেন থেকে কমে ১৫k টোকেনের নিচে চলে আসে।


৪. দ্বিতীয় স্তম্ভ: প্রম্পট ক্যাশিং (Prompt Caching) ও ৯০% ছাড়ের ব্যবহার

Anthropic-এর প্রম্পট ক্যাশিং সুবিধা ইনপুট টোকেনকে ৫ মিনিট পর্যন্ত সার্ভারে ধরে রাখে (প্রতিটি ক্যাশ হিটে সময়সীমা আবার নতুন করে শুরু হয়)। ক্যাশ করা টোকেন পড়তে খরচ হয় বেস ইনপুট খরচের মাত্র ১০% (Sonnet-এ $3.00/1M-এর জায়গায় মাত্র $0.30/1M)।

+-------------------------------------------------------------------------+
|                  Anthropic Prompt Caching লাইফসাইকেল                    |
+-------------------------------------------------------------------------+
                                     |
                                     v
+-------------------------------------------------------------------------+
| [সিস্টেম প্রম্পট ও টুল ডেফিনিশন] (স্থির প্রিফিক্স - সর্বদা ক্যাশ থাকে) |
+-------------------------------------------------------------------------+
                                     |
                                     v
+-------------------------------------------------------------------------+
| [রিপোজিটরি আর্কিটেকচার ম্যাপ ও কোডিং গাইডলাইন] (ক্যাশ চেকপয়েন্ট)       |
+-------------------------------------------------------------------------+
                                     |
                                     v (ক্যাশ ভাঙার বিন্দু!)
+-------------------------------------------------------------------------+
| [ইউজারের ডাইনামিক কমান্ড ও টুল ব্যবহারের ইতিহাস] (ক্যাশবিহীন অংশ)       |
+-------------------------------------------------------------------------+

প্রম্পট ক্যাশ অক্ষুণ্ণ রাখার ৩টি নিয়ম

  1. সিস্টেম কনটেক্সটে পরিবর্তনশীল টাইমস্ট্যাম্প দেবেন না: CLAUDE.md-তে বর্তমান তারিখ বা সেশন আইডি যোগ করবেন না। প্রিফিক্সের একটি অক্ষর বদলালেও পরবর্তী সমস্ত ক্যাশ টোকেন বাতিল হয়ে যায়।
  2. ৫ মিনিটের সময়ের মধ্যে কাজগুলো গুছিয়ে নিন: ক্যাশের স্থায়িত্ব ৩০০ সেকেন্ড। কোড রিভিউ করতে ৬ মিনিট বিরতি দিলে পরবর্তী কমান্ডে পুরো ক্যাশ রাইট ফি ($3.75/1M) দিতে হবে।
  3. নির্দেশনাগুলো স্থির থেকে পরিবর্তনের ক্রমানুসারে সাজান: Claude Code স্থির নির্দেশগুলোকে রিকোয়েস্টের শুরুতে রাখে। CLAUDE.md-এর নিয়মগুলো সর্বদা অপরিবর্তিত রাখুন।

৫. তৃতীয় স্তম্ভ: সাব-এজেন্ট ব্যবহার ও সাব-টাস্ক আইসোলেশন

টার্মিনাল কোডিংয়ে সবচেয়ে বড় ভুল হলো মনোলিথিক বা দীর্ঘ সেশনের ফাঁদ (Monolithic Session Trap)। একটি সেশনেই ডেভেলপার Claude-কে বাগ খুঁজতে, টেস্ট লিখতে, কোড রিফ্যাক্টর করতে, ইন্টিগ্রেশন টেস্ট চালাতে এবং ডকুমেন্টেশন লিখতে বলেন।

১২তম ধাপে পৌঁছানোর আগেই কনটেক্সট উইন্ডো ব্যর্থ টেস্ট লগ, কম্পাইলার ত্রুটি এবং কোডের পুরনো সংস্করণে ভরে যায়। এর পরের প্রতিটি সাধারণ প্রশ্নেও এই বিশাল আবর্জনা পুনরায় API-তে পাঠানো হয়।

দুই স্তরের এজেন্ট আর্কিটেকচার: Scout এবং Worker

কোড অনুসন্ধান এবং কোড সম্পাদনার কাজ দুটি আলাদা করুন:

[ইউজারের টাস্ক রিকোয়েস্ট]
       |
       v
+---------------------------------------------+
|  স্তর ১: রিড-অনলি Scout সাব-এজেন্ট          |
|  - claude-3-5-haiku বা হালকা মডেলে চলে      |
|  - Glob, Grep এবং নির্দিষ্ট লাইনের রিড করে  |
|  - ৫০০,০০০ টোকেনকে ২KB সামারিতে সংকুচিত করে |
+---------------------------------------------+
       |
       v (সংক্ষিপ্ত কনটেক্সট হ্যান্ডঅফ)
+---------------------------------------------+
|  স্তর ২: মূল কর্মী এজেন্ট (Worker)           |
|  - claude-3-7-sonnet-এ চলে                  |
|  - নির্দিষ্ট ফাইল পাথ ও AST সিম্বল গ্রহণ করে|
|  - লাইন-নির্দিষ্ট নিখুঁত প্যাচ প্রয়োগ করে   |
+---------------------------------------------+

Claude Code-এ সাব-টাস্ক বিভাজনের বাস্তবায়ন

বড় কাজগুলোকে আলাদা আলাদা টার্মিনাল ধাপে ভাগ করুন:

# ভুল পদ্ধতি: একটি সেশনে কনটেক্সট ফুলে যাওয়া
claude "পুরনো অথেন্টিকেশন ব্যবহার করা সব এন্ডপয়েন্ট খুঁজে বের করো, OAuth2-তে নাও, টেস্ট ঠিক করো এবং ডকুমেন্টেশন লেখো"

# সঠিক পদ্ধতি: পৃথক অনুসন্ধান -> লক্ষ্যভিত্তিক সম্পাদন
# ধাপ ১: কম খরচে অনুসন্ধান
claude --model claude-3-5-haiku -p "পুরনো auth মিডলওয়্যার ব্যবহারকারী ফাইল পাথ ও লাইন নম্বরগুলো কেবল একটি JSON তালিকায় আউটপুট করো।" > auth-audit.json

# ধাপ ২: পরিচ্ছন্ন কনটেক্সটে নিখুঁত সম্পাদন
claude --model claude-3-7-sonnet "auth-audit.json-এ তালিকাভুক্ত ফাইলগুলো OAuth2 মিডলওয়্যারে রিফ্যাক্টর করো। অন্য কোনো ফাইলে হাত দেবে না।"

৬. চতুর্থ স্তম্ভ: সঠিক মডেল নির্বাচন — কোন Claude মডেল কম টোকেন পোড়ায়?

একই কাজের জন্য বিভিন্ন মডেলের টোকেন ব্যবহারের মধ্যে অনেক পার্থক্য থাকে:

  • Thinking বাজেট: বর্ধিত চিন্তন (Extended Thinking) সক্ষমতার মডেলগুলো হাজার হাজার ইন্টারনাল রিজনিং টোকেন তৈরি করে, যা আউটপুট টোকেন হিসেবে বিল হয় (Sonnet-এ $15.00/1M)।
  • টুল ব্যবহারে অতিরিক্ত কথা: কিছু মডেল টুল চালানোর আগে দীর্ঘ ব্যাখ্যা দেয়, যার ফলে আউটপুট টোকেন বৃদ্ধি পায়।
  • অনুসন্ধানের দক্ষতা: স্মার্ট মডেলগুলো ১-২টি নিখুঁত grep কমান্ড দিয়ে কোড খুঁজে নেয়, আর দুর্বল মডেলগুলো বারবার পুরো ফাইল পড়ে।

কাজের ধরন অনুযায়ী টোকেন খরচের তুলনা

কাজের ধরন Claude 3.5 Haiku Claude 3.7 Sonnet (Normal) Claude 3.7 Sonnet (8k Thinking) Claude 3 Opus
প্রজেক্টে সিম্বল খোঁজা 12k টোকেন / $0.01 14k টোকেন / $0.04 24k টোকেন / $0.18 18k টোকেন / $0.27
একটি ফাংশনের বাগ ফিক্স 28k টোকেন / $0.03 22k টোকেন / $0.07 35k টোকেন / $0.24 30k টোকেন / $0.45
একাধিক ফাইল রিফ্যাক্টরিং ব্যর্থতার হার বেশি 140k টোকেন / $0.48 190k টোকেন / $1.25 220k টোকেন / $3.30
জটিল রেস কন্ডিশন সমস্যা সমাধান করতে পারে না 320k টোকেন (ব্যর্থ) 240k টোকেন (সফল) / $1.60 280k টোকেন / $4.20

মডেল ব্যবহারের কৌশল

  • দৈনন্দিন কাজের প্রধান মডেল: দৈনন্দিন কোডিংয়ের ৮০% কাজের জন্য সাধারণ claude-3-7-sonnet ব্যবহার করুন।
  • অনুসন্ধান ও স্ক্রিপ্ট: ফাইল খোঁজা, রেজেক্স তৈরি এবং টেস্ট লগ যাচাইয়ে claude-3-5-haiku ব্যবহার করুন।
  • Thinking মোড সীমিত রাখা: প্রথম চেষ্টায় সমাধান না হওয়া অত্যন্ত জটিল অ্যালগরিদম বা কম্পাইলার ত্রুটির ক্ষেত্রেই কেবল Extended Thinking অন করুন।

৭. উন্নত সেটিংস ও .claude/config.json অপ্টিমাইজেশন

~/.claude.json অথবা প্রজেক্টের .claude/config.json ফাইলের মাধ্যমে Claude Code-এর আচরণ নিয়ন্ত্রণ করা যায়।

উচ্চ দক্ষতার .claude/config.json কনফিগারেশন

{
  "$schema": "https://json.schemastore.org/claude-code-config.json",
  "model": "claude-3-7-sonnet",
  "maxThinkingTokens": 2048,
  "autoCompactContext": true,
  "contextCompactionThreshold": 0.65,
  "allowedTools": [
    "Edit",
    "Bash",
    "Glob",
    "Grep",
    "Read"
  ],
  "toolLimits": {
    "bashOutputMaxLines": 150,
    "readFileMaxLines": 300
  },
  "enableTelemetry": false
}

প্রধান প্যারামিটারগুলোর ব্যাখ্যা

  1. maxThinkingTokens: 2048: চিন্তাভাবনার টোকেন সংখ্যা সীমিত করে, যাতে সাধারণ কাজে প্রতি ধাপে ৮k থেকে ১৬k টোকেন ($0.12 - $0.24) নষ্ট না হয়।
  2. autoCompactContext: true: কনটেক্সট ৬৫% পূর্ণ হলে (contextCompactionThreshold: 0.65) স্বয়ংক্রিয়ভাবে আগের চ্যাট হিস্ট্রি সংক্ষেপ করে নতুনদের জায়গা করে দেয়।
  3. bashOutputMaxLines: 150: টেস্ট বা প্যাকেজ ইনস্টলেশনের হাজার হাজার লাইনের লগ সরাসরি মডেলে চলে যাওয়া বন্ধ করে।

৮. টার্মিনালে টোকেন বাঁচানোর বাস্তবসম্মত প্রম্পট প্যাটার্ন

আপনার প্রম্পট লেখার কৌশলের ওপর মোট টোকেন খরচের ৪০% পর্যন্ত নির্ভর করে:

প্যাটার্ন ১: নির্দিষ্ট লাইন নম্বর উল্লেখ করে পড়া

পুরো ফাইল পড়তে না বলে নির্দিষ্ট লাইন দেখতে বলুন:

# অপচয়: ১,৮০০ লাইন (প্রায় ১৪,০০০ টোকেন) পড়ে ফেলে
"src/auth/session.ts ফাইলটি পড়ো এবং ইউজার টোকেন ভেরিফিকেশন কেন ফেইল করছে তা দেখো"

# সাশ্রয়ী: মাত্র ৬০ লাইন (প্রায় ৪৫০ টোকেন) পড়ে
"src/auth/session.ts ফাইলের ১২০-১৮০ নম্বর লাইন পরীক্ষা করো যেখানে verifyJwt() আছে"

প্যাটার্ন ২: কমান্ড আউটপুট সীমিত রাখা

টেস্ট বা বিল্ড চালানোর সময় কেবল ত্রুটিপূর্ণ অংশ দেখতে চান:

# অপচয়: সফল টেস্টের হাজার হাজার লাইন কনটেক্সটে ভরে ফেলে
"npm test চালাও এবং ভুলগুলো ঠিক করো"

# সাশ্রয়ী: আউটপুট নিয়ন্ত্রণ করে
"npm test -- --reporter=dot চালাও অথবা grep দিয়ে শুধু এরর ফিল্টার করো। সফল টেস্টের লগ দেখাবে না।"

প্যাটার্ন ৩: কনটেক্সট পরিচ্ছন্ন রাখা (/compact/clear)

Claude Code-এর নিজস্ব কমান্ডগুলো নিয়মিত ব্যবহার করুন:

  • /compact: বর্তমান কথোপকথনকে তাৎক্ষণিকভাবে সংক্ষিপ্ত টেকনিক্যাল সারসংক্ষেপে রূপান্তর করে।
  • /clear: নতুন কোনো ভিন্ন কাজ শুরু করার আগে টার্মিনাল রিস্টার্ট না করেই কনটেক্সট সম্পূর্ণ খালি করে দেয়।

৯. টোকেন হ্রাস কৌশলের তুলনামূলক মূল্যায়ন

কৌশল সাধারণ টোকেন সাশ্রয় বাস্তবায়ন জটিলতা কোডের মানের ঝুঁকি মূল কার্যপদ্ধতি
কঠোর .claudeignore ৪০% – ৬০% কম (৫ মিনিট) শূন্য লকফাইল, মিডিয়া ও বিল্ড ফোল্ডার বাদ দেয়
কনটেক্সট সংক্ষেপণ (/compact) ৩০% – ৫০% তাৎক্ষণিক (কমান্ড) কম পুরনো শেল লগ ও অপ্রয়োজনীয় কোড মুছে ফেলে
সাব-এজেন্ট অনুসন্ধান ৩৫% – ৫৫% মাঝারি অতি সামান্য ভারী অনুসন্ধান এবং কোড এডিট আলাদা করে
Thinking বাজেট নিয়ন্ত্রণ ২০% – ৩৫% কম (কনফিগ এডিট) কম-মাঝারি সাধারণ কাজে দীর্ঘ চিন্তাভাবনা প্রতিরোধ করে
লাইনভিত্তিক নিখুঁত প্যাচ ১৫% – ২৫% কম (অভ্যাস) কম পুরো ফাইল নতুন করে না লিখে কেবল ডিফস যোগ করে
প্রম্পট ক্যাশ বিন্যাস ১০% – ২০% (খরচ) মাঝারি শূন্য স্থির প্রিফিক্স বজায় রেখে ৯০% ছাড় উপভোগ করে

১০. উপসংহার ও ৫ ধাপের চেকলিস্ট

Claude Code-এ টোকেন খরচ ৭৫% কমানো মানে কোডের মানের সাথে কোনো আপস করা নয়। বরং একটি পরিষ্কার এবং সংক্ষিপ্ত কনটেক্সট মডেলের মনোযোগ বিচ্ছিন্ন হওয়া ও হ্যালুসিনেশন প্রতিরোধ করে নির্ভুল কোড নিশ্চিত করে।

৫ ধাপের জরুরি চেকলিস্ট:

  1. [ ] .claudeignore যুক্ত করুন: প্রজেক্ট রুটে প্রোডাকশন টেমপ্লেটটি রাখুন এবং সমস্ত লকফাইল ও বিল্ড ফোল্ডার ব্লক করুন।
  2. [ ] config.json অপ্টিমাইজ করুন: Thinking টোকেন সীমা 2048 নির্ধারণ করুন এবং autoCompactContext চালু করুন।
  3. [ ] কাজের ওপর ভিত্তি করে মডেল বেছে নিন: কোডিংয়ে claude-3-7-sonnet, খোঁজার কাজে claude-3-5-haiku এবং জটিল সমস্যায় Thinking ব্যবহার করুন।
  4. [ ] টার্মিনাল আউটপুট নিয়ন্ত্রণে রাখুন: টেস্ট চালানোর সময় সংক্ষিপ্ত ফ্ল্যাগ (--reporter=min, grep ফিল্টার) ব্যবহার করে আউটপুট ১০০ লাইনের নিচে রাখুন।
  5. [ ] নিয়মিত কনটেক্সট রিসেট করুন: কাজের ফাঁকে ফাঁকে /compact অথবা /clear ব্যবহার করে Context Rot প্রতিরোধ করুন।

টার্মিনালে এই ইঞ্জিনিয়ারিং অভ্যাসগুলো রপ্ত করার মাধ্যমে আপনি Claude Code-এর পূর্ণ সক্ষমতা বজায় রেখেও প্রতি মাসের API খরচ অনেকাংশে কমিয়ে আনতে পারবেন।

← সব নিবন্ধ
0 / 4