TLDR تصف Claude Haiku 5.5 بأنه أرخص وأسرع وأكثر النماذج الصغيرة قدراتاً التي شحنتها حتى الآن. صُمم لأحمال العمل عالية الحجم والحساسة للكمون مثل التصنيف والاستخراج والتوجيه والتلخيص ومهام الوكلاء الفرعيين، ويقدم نافذة سياق بسعة 1,000,000 رمز، ومخرجات تصل إلى 128K رمز، وتفكيراً تكيفياً مع مستويات جهد قابلة للضبط.
في المتوسط، تكلفته أقل بنحو 75% للتشغيل مقارنةً بـ Haiku 4.5، مع تحقيق مكاسب كبيرة في اختبارات العمل بالوكالة واستخدام الحاسوب. يمكن للمطورين الوصول إليه عبر Claude API الرسمي (claude-haiku-5-5)، أو Amazon Bedrock، أو Google Cloud، أو Microsoft Foundry، أو بوابات مُحسَّنة للتكلفة مثل CometAPI (بدءاً من $0.08 / $0.40).
أهم النقاط المستخلصة
- الإصدار والتموضع: أُطلق في 7 أكتوبر 2026 كنموذج صغير عالي الإنتاجية ضمن عائلة Claude 5.5—مثالي للدعم اللحظي، ومعالجة المستندات، وخطوات الوكلاء المفوضة.
- المواصفات الأساسية: سياق 1M رمز، حد أقصى للمخرجات 128K (300K عبر Batch API التجريبية)، تفكير تكيفي (الافتراضي جهد medium)، إدخال نص + صور → إخراج نص، حد المعرفة يونيو 2026.
- ميزة التسعير: $0.10 للمدخلات / $0.50 للمخرجات لكل مليون رمز للطلبات حتى 100K (≈90% أرخص من Haiku 4.5 في معظم الطلبات)؛ شريحة أعلى لما فوق 100K. قراءات الذاكرة المؤقتة منخفضة حتى $0.01. تقدم CometAPI معدلات قياسية أقل بنحو 20%.
- قفزة الأداء: مكاسب كبيرة مقابل Haiku 4.5 (مثلاً، OSWorld 72.4% مقابل 15.7%، وTerminal-Bench 39.2% مقابل 0%، وGDPval-AA 1620 مقابل 735 Elo) مع البقاء منافساً أو متفوقاً على GPT-6 Luna في العديد من الاختبارات.
- ميزات المطورين: وسيطة الجهد (
low–max)، تخزين مبدئي للمحفز (prompt caching)، Batch API (خصم 50%)، استخدام الحاسوب/المتصفح (دعم SDK تجريبي). يجب حذف Temperature/top_p/top_k وإلا سيحدث خطأ 400.
ما هي Claude Haiku 5.5 ولماذا تهم في 2026
Claude Haiku 5.5 هي أحدث إضافة من Anthropic إلى الفئة خفيفة الوزن ضمن عائلة Claude. على عكس النماذج الأغلى Opus 5.5 وSonnet 5.5 المُحسّنة للاستدلال المعقد ووكلاء الأفق الطويل، تم تصميم Haiku 5.5 خصيصاً لأحمال العمل عالية الحجم والحساسة للتكلفة والكمون. تصفها Anthropic بأنها “أرخص وأسرع وأكثر نموذج صغير قدراتاً أطلقناه على الإطلاق.”
الاستخدامات الإنتاجية النموذجية تشمل:
- تصنيف التذاكر وتوجيهها في دعم العملاء
- استخراج الحقول والتلخيص من المستندات الطويلة
- ضغط سجل المحادثات لنماذج أكبر
- استعلامات على نمط قواعد البيانات ومهام البيانات المهيكلة
- وكلاء فرعيون سريعون للتعامل مع خطوات ضيقة في الترميز أو استخدام الأدوات أو المتصفح بينما ينسّق نموذج أقوى العملية
ونظراً لأنها أرخص وأسرع بكثير من سابقتها مع سد جزء كبير من فجوة الجودة في المهام العملية القائمة على الوكلاء، تعيد العديد من الفرق هندسة الأنابيب بحيث تتولى Haiku 5.5 غالبية الطلبات ولا تُصعّد الحالات الصعبة إلا إلى Sonnet أو Opus. تشير تعليقات العملاء المبكرة من Asana وHubSpot وBox وغيرهم إلى انخفاضات في الكمون تفوق 30% وتحسينات قابلة للقياس في الدقة على تقييمات داخلية عالية الحجم.
المواصفات التقنية لـ Claude Haiku 5.5
| المواصفة | القيمة | الملاحظات |
|---|---|---|
| معرّف النموذج (Claude API) | claude-haiku-5-5 | بدون لاحقة تاريخ |
| Amazon Bedrock | anthropic.claude-haiku-5-5 (or global/us/eu/au/jp profiles) | |
| نافذة السياق | 1,000,000 tokens | ≈555k كلمة مع المُرمِّز الجديد |
| الحد الأقصى للمخرجات (Messages API) | 128,000 tokens | 300K مع Batch API + ترويسة beta |
| وسائط الإدخال | Text + images | |
| وسيط الإخراج | Text | |
| التفكير | Adaptive (on by default) | يُتحكم به عبر effort |
| الجهد الافتراضي | medium | الخيارات: low, medium, high, xhigh, max |
| حد المعرفة | June 2026 | |
| التزام الإيقاف | Not before October 7, 2027 | |
| المُرمِّز | Newer (same family as Claude 4.7+) | نفس النص ≈30% رموزاً أكثر مقارنةً بـ Haiku 4.5 |
الحدود الأكبر للسياق والمخرجات، إلى جانب التفكير التكيفي، تجعل Haiku 5.5 أكثر قابلية للاستخدام في أنظمة الإنتاج الفعلية مقارنةً بالنماذج الصغيرة السابقة التي كانت تتطلب اقتطاعاً عدائياً أو ميزانيات تفكير ثابتة.
الاستجابات وفحوصات الإكمال
اقرأ كتل المحتوى حسب النوع، بدلاً من افتراض أن content[0] هي الإجابة المرئية. افحص stop_reason قبل قبول المخرجات: يشير max_tokens إلى توليد مقطوع، وتستلزم حالات الرفض استجابة تطبيق صريحة. لطلبات مفعّلة الأدوات، عالج كتل tool-use وأعد نتائج الأدوات بصيغتها الأصلية بدلاً من التعامل معها كإجابة نصية مكتملة.
ما الذي تغير مقارنةً بـ Claude Haiku 4.5 API؟
تغييرات السعة والسلوك والتسعير
| البعد | Haiku 4.5 | Haiku 5.5 | Sonnet 5.5 |
|---|---|---|---|
| نافذة السياق | 200K | 1M | 1M |
| الحد الأقصى للمخرجات | 64K | 128K | 128K |
| الجهد التكيفي | لا | نعم | نعم |
| Anthropic input / MTok | $1.00 | $0.10 | $2.00 |
| Anthropic output / MTok | $5.00 | $0.50 | $10.00 |
| التموضع | نموذج سريع قديم | أعمال روتينية على نطاق واسع | مهام معقدة أصعب |
تنطبق أسعار Haiku 5.5 في هذه المقارنة على المحفزات حتى 100,000 رمز؛ الطلبات الأطول تكلف أكثر. هذه معدلات Anthropic القياسية، وليست معدلات CometAPI. هذه المقارنة نقطة انطلاق للتوجيه وليست ادعاءً بأن النماذج تؤدي بشكل متماثل.
بالنسبة لتكاملات Haiku 4.5، التغييرات الأساسية في التنفيذ هي التفكير التكيفي بدلاً من ميزانية يدوية، عناصر التحكم في الجهد، التحليل الانتقائي لكتل المحتوى، وعدود الرموز المحدثة. قد يستخدم نفس النص حوالي 30% رموز إدخال أكثر. أعد احتساب المحفزات التمثيلية بدلاً من إعادة استخدام تقديرات رموز Haiku 4.5. يحول قسم الترحيل هذه التغييرات إلى قائمة تحقق للنشر.
التحسينات المُبلغ عنها في المعايير
| المعيار | Haiku 4.5 | Haiku 5.5 | Sonnet 5.5 |
|---|---|---|---|
| OSWorld 2.1 (مجموعة فرعية دون اتصال؛ رصيد جزئي) | 15.7% | 72.4% | 83.9% |
| Terminal-Bench 4.0 | 0.0% | 39.2% | 70.6% |
| Humanity’s Last Exam (بدون أدوات) | 10.2% | 45.9% | 56.9% |
| Chartography (بدون أدوات) | 6.4% | 46.4% | 61.6% |
| GDPval-AA v2.1 (Elo) | 735 | 1,620 | 1,840 |
تفيد Anthropic بالنتائج أعلاه في ملخص معايير الإطلاق. إنها نتائج تقييم مُبلّغ عنها، وليست اختبارات حية لأمثلة CometAPI في هذا الدليل. نسبة 72.4% لـ OSWorld هي رصيد جزئي وليست معدل إتمام مهام صارماً.
تصف بطاقة نظام Haiku 5.5 ظروف التقييم. تستخدم تقييمات Haiku 5.5 القياسية تفكيراً تكيفياً عند أقصى جهد وإعدادات أخذ عينات افتراضية ما لم يُذكر خلاف ذلك؛ الإعداد الافتراضي للمنتج هو medium. يستخدم OSWorld عدد 82 مهمة دون اتصال، بدون وصول للإنترنت، بدقة 1080p وحد 500 إجراء. يستخدم Terminal-Bench 4.0 وضع Claude Code الأساسي، بدون خروج للإنترنت و10 تجارب لكل مهمة لـ Haiku 5.5؛ إعداد Sonnet يختلف. صفوف HLE وChartography أعلاه بدون أدوات. يُبلغ GDPval-AA عن تصنيف Elo من تقييمات Artificial Analysis. طابق حزمة الاختبار ذات الصلة، والجهد، وإعدادات الأدوات عند مقارنة النتائج.

تُظهر الصورة الأصلية لـ Anthropic الخاصة بـ OSWorld العلاقة بين الجهد وتكلفة كل مهمة ودرجة الرصيد الجزئي. إنها لا تقيس زمن استجابة API ولا تضمن نفس الأداء على عبء عملك.
تشير الدرجات إلى أداء أقوى بكثير في استخدام الحاسوب والمهام العامة مقارنةً بـ Haiku 4.5، لكنها لا تضمن نفس النتائج في تطبيقك. نفّذ مجموعة تقييم تمثيلية قبل الالتزام بحركة إنتاجية.
يُحتفظ بجدول المعايير والصورة المرفقة كعناصر مقارنة للنماذج. إنها تقييمات مُبلغ عنها وليست اختبارات حية لأمثلة CometAPI. استخدم نفس توزيع المهام وإعدادات الجهد والأدوات عند تقييم تطبيق؛ لا يحدد معيار واحد زمن انتقال البوابة أو معدل النجاح الخاص بك.
كيفية استخدام Claude Haiku 5.5 API عبر CometAPI
أنشئ مفتاحاً واختر المسار الأصلي
أنشئ حساب CometAPI، وأكّد الوصول إلى claude-haiku-5-5، وولّد مفتاح API على جهة الخادم. عيّن COMETAPI_KEY في بيئتك. احتفظ بالمفتاح خارج التحكم بالإصدار وكود المتصفح. مفاتيح Anthropic وCometAPI تعود لمزودين مختلفين؛ استخدم مفتاح CometAPI لكل مثال في هذا الدليل المُحدّث.
export COMETAPI_KEY="your_cometapi_api_key"
pip install --upgrade anthropic
$env:COMETAPI_KEY="your_cometapi_api_key"
| التكامل | SDK base URL | Request path | Credential |
|---|---|---|---|
| Anthropic-compatible Messages | https://api.cometapi.com | /v1/messages | COMETAPI_KEY |
| OpenAI-compatible Chat Completions | https://api.cometapi.com/v1 | /chat/completions | COMETAPI_KEY |
تدعم CometAPI صيغة Messages الأصلية الخاصة بـ Claude وكتل المحتوى. استخدم Anthropic SDK مع جذر base URL الخاص بـ CometAPI. مسار Messages الأصلي هو المفضّل في هذا الدليل لميزات التفكير وكتل المحتوى الخاصة بـ Claude. مسار Chat Completions المتوافق خيار لتطبيق يعتمد نمط OpenAI. أكّد دعم الحقول المتقدمة على مسار البوابة المحدد.
أرسل طلباً بسيطاً وتحقق من النتيجة
curl https://api.cometapi.com/v1/messages \
-H "Content-Type: application/json" \
-H "x-api-key: $COMETAPI_KEY" \
-H "anthropic-version: 2023-06-01" \
-d '{
"model": "claude-haiku-5-5",
"max_tokens": 2048,
"output_config": {"effort": "low"},
"messages": [{"role": "user", "content": "Summarize three AI uses in customer support."}]
}'
import os
import anthropic
client = anthropic.Anthropic(
api_key=os.environ["COMETAPI_KEY"],
base_url="https://api.cometapi.com",
timeout=60.0,
max_retries=2,
)
response = client.messages.create(
model="claude-haiku-5-5",
max_tokens=2048,
output_config={"effort": "low"},
messages=[{"role": "user", "content": "Classify this ticket: I cannot log in."}],
)
if response.stop_reason != "end_turn":
raise RuntimeError(f"Unaccepted completion: {response.stop_reason}")
print("".join(block.text for block in response.content if block.type == "text"))
print(response.usage)
احفظ مثال Python باسم example.py وشغّل python example.py. نقطة التحقق الناجحة هي استجابة مكتملة بنص مرئي وحقول usage. يعني خطأ المصادقة أن المفتاح بحاجة للمراجعة؛ ويعني خطأ النموذج/المسار أن معرف النموذج أو نقطة النهاية أو صلاحيات الحساب بحاجة للمراجعة.
استخدم نفس الصيغة الأصلية من JavaScript
npm install @anthropic-ai/sdk
import Anthropic from "@anthropic-ai/sdk";
const client = new Anthropic({
apiKey: process.env.COMETAPI_KEY,
baseURL: "https://api.cometapi.com",
timeout: 60_000,
maxRetries: 2,
});
const response = await client.messages.create({
model: "claude-haiku-5-5",
max_tokens: 2048,
output_config: {effort: "low"},
messages: [{role: "user", content: "Extract product, quantity and price: 3 laptops at $900 each."}],
});
if (response.stop_reason !== "end_turn") {
throw new Error("Unaccepted completion: " + response.stop_reason);
}
for (const block of response.content) {
if (block.type === "text") console.log(block.text);
}
استخدم إصدار Node.js مدعوماً. احفظ الملف باسم example.mjs، واضبط COMETAPI_KEY وشغّل node example.mjs. دوّن إصدار SDK الذي تتحقق منه للنشر.
تكييف تطبيق متوافق مع OpenAI قائم
إذا كان تطبيقك يستخدم Chat Completions بالفعل، فقم بتثبيت حزمة openai وتهيئة العميل المنفصل أدناه. هذا المسار يعيد choices بدلاً من كتل المحتوى الأصلية. حافظ على تحليل خاص بالمسار، واختبر التفكير والصور والأدوات قبل الاعتماد على ترجمة البوابة.
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["COMETAPI_KEY"],
base_url="https://api.cometapi.com/v1",
)
response = client.chat.completions.create(
model="claude-haiku-5-5",
max_tokens=2048,
messages=[
{"role": "system", "content": "Be concise and helpful."},
{"role": "user", "content": "Explain API rate limits."},
],
)
print(response.choices[0].message.content)
إرسال الصور إلى Claude Haiku 5.5 API
استخدم صورة مع تعليمة تحدد الأدلة والمخرجات التي تحتاجها. تقبل واجهة الرؤية الرسمية كتل محتوى للصور مع بيانات base64، أو عنوان URL للصورة، أو مرجع ملف مرفوع مدعوم. يقرأ هذا المثال ملف PNG محلياً، يضع الصورة قبل السؤال، ويطلب قيماً يمكن التحقق منها مقابل المصدر.
حلّل ملف PNG محلي حقيقي عبر Anthropic Messages API الأصلية.
import os
import base64
from pathlib import Path
import anthropic
# Replace dashboard.png with a real PNG file you are authorized to analyze.
image_data = base64.b64encode(Path("dashboard.png").read_bytes()).decode("ascii")
anthropic_client = anthropic.Anthropic(api_key=os.environ["ANTHROPIC_API_KEY"])
response = anthropic_client.messages.create(
model="claude-haiku-5-5",
max_tokens=2048,
output_config={"effort": "low"},
messages=[{
"role": "user",
"content": [
{"type": "image", "source": {
"type": "base64", "media_type": "image/png", "data": image_data
}},
{"type": "text", "text": (
"Read the visible dashboard metrics. List anomalies with their "
"labels and values, and state when text is unreadable."
)},
],
}],
)
for block in response.content:
if block.type == "text":
print(block.text)
استخدم نوع MIME الذي يطابق الملف الفعلي. تحقق من قابلية القراءة، وأبعاد الصورة، وحدود حجم الطلب قبل الإرسال؛ تجنّب إرسال وسائط عالية الدقة لا تفيد المهمة. بالنسبة لـ CometAPI، غيّر المفتاح وجذر base URL كما في مثال Messages الخاص بها، وتحقق من دعم الصور على المسار المحدد.
التحكم في استدلال Claude Haiku 5.5
تستخدم Haiku 5.5 التفكير التكيفي بشكل افتراضي. يوضح تكوين التفكير الرسمي متى يُقبل التعطيل وكيف تُعاد كتل التفكير. اضبط الجهد عبر output_config.effort؛ لا تعاود استخدام budget_tokens القديمة.
| الجهد | حالة بدء جيدة | المقايضة |
|---|---|---|
| low | تصنيف قصير، استخراج بسيط | عادةً رموز أقل وزمن أقل |
| medium | ردود دعم، عمل وكيل روتيني | توازن افتراضي |
| high | تحليل مستند متعدد الخطوات | احتمال مزيد من الاستدلال |
| xhigh | تقييمات صعبة | معالجة وتكلفة أكثر |
| max | حالات مكثفة الاستدلال | أعلى إنفاق محتمل على الاستدلال |
كوّن التفكير التكيفي مع جهد منخفض.
import osimport anthropicanthropic_client = anthropic.Anthropic( api_key=os.environ["ANTHROPIC_API_KEY"],)response = anthropic_client.messages.create( model="claude-haiku-5-5", max_tokens=4096, thinking={"type": "adaptive"}, output_config={"effort": "low"}, messages=[{"role": "user", "content": "Classify as billing, technical, or account: cannot log in."}],)for block in response.content: if block.type == "text": print(block.text)
يمكن للمطورين تعطيل التفكير عند جهود low وmedium وhigh، وليس عند xhigh أو max. يستهلك التفكير رموز مخرجات مفوترة وميزانية max_tokens حتى عندما يكون نصه مخفياً. قد يحمل حقل تفكير فارغ توقيعاً؛ لا يثبت أن استدلالاً لم يحدث. حافظ على كتل المحتوى المُعادة دون تغيير عند متابعة محادثات الأدوات.
مثال طلب مع تعطيل التفكير
أرسل جسم طلب أصلي مع التفكير المعطل.
{ "model": "claude-haiku-5-5", "max_tokens": 1024, "thinking": {"type": "disabled"}, "output_config": {"effort": "low"}, "messages": [ {"role": "user", "content": "Return sentiment only: positive, neutral, negative."} ]}
بث استجابات Claude Haiku 5.5
يوصل البث النص المرئي تدريجياً ويحسن الاستجابة في التطبيقات التفاعلية. تعامل مع النص المبثوث كتمهيدي إلى أن يكتمل الطلب بنجاح.
ابث النص المرئي باستخدام Anthropic Python SDK.
import osimport anthropicanthropic_client = anthropic.Anthropic( api_key=os.environ["ANTHROPIC_API_KEY"],)with anthropic_client.messages.stream( model="claude-haiku-5-5", max_tokens=4096, output_config={"effort": "low"}, messages=[{"role": "user", "content": "Explain API caching."}],) as stream: for text in stream.text_stream: print(text, end="", flush=True)
تسعير Claude Haiku 5.5 API
مقارنة معدلات الرموز وأشرطة طول المحفز
تم التحقق من المعدلات في 8 أكتوبر 2026. تقارن هذه الجدول تسعير Anthropic القياسي مع معدلات CometAPI المنشورة، بالدولار لكل مليون رمز. تُحدد الشريحة حسب طول المحفز: حتى 100,000 رمز مقابل أكثر من 100,000. تُطبق الطلبات الأطول معدلات الشريحة الأعلى ذات الصلة، وليس مجرد رسم على الرموز الزائدة. يجب تسوية فواتير الحساب والاستخدام المُخزّن والأدوات الاختيارية بشكل منفصل.
| فئة الرموز | Anthropic ≤100K | CometAPI ≤100K | Anthropic >100K | CometAPI >100K |
|---|---|---|---|---|
| المدخلات | $0.10 | $0.08 | $0.50 | $0.40 |
| المخرجات | $0.50 | $0.40 | $2.50 | $2.00 |
| قراءة من الذاكرة المؤقتة | $0.01 | $0.008 | $0.05 | $0.04 |
| كتابة ذاكرة 5 دقائق | $0.125 | $0.10 | $0.625 | $0.50 |
| كتابة ذاكرة ساعة | $0.20 | $0.16 | $1.00 | $0.80 |
يُحتفظ باللقطة الأصلية للمعدلات أعلاه. تحقق من قائمة CometAPI الحالية وفواتير الحساب قبل الشراء أو النشر؛ سعر الإدخال الابتدائي في القائمة ليس عرضاً كاملاً لكل شريحة طول محفز، أو عمليات الذاكرة المؤقتة، أو الأداة الاختيارية.
مثال: تكلفة 100,000 طلب دعم
نفترض 100,000 طلب شهري، لكل منها 2,000 رمز إدخال و300 رمز مخرجات مفوترة، بما في ذلك أي تفكير مولّد. كل محفز يندرج ضمن شريحة حتى 100K. استبعد التخزين المؤقت، ورسوم الأدوات، والمحاولات المعاد إرسالها.
| المكوّن | الاستخدام | Anthropic | CometAPI |
|---|---|---|---|
| المدخلات | 200M tokens | $20.00 | $16.00 |
| المخرجات | 30M tokens | $15.00 | $12.00 |
| الإجمالي | 100,000 requests | $35.00 | $28.00 |
في ظل هذه الافتراضات، يبلغ الفرق التوضيحي $7 شهرياً، أو 20%. تعتمد تكاليف الإنتاج على أطوال الطلبات، والاستدلال المخفي، والتخزين المؤقت وسلوك إعادة المحاولة.
استخدم عدادات الرموز الحالية للنموذج في الحساب. التكلفة = رموز الإدخال × معدل الإدخال المطبق / 1,000,000 + رموز المخرجات المفوترة × معدل المخرجات المطبق / 1,000,000، بالإضافة إلى رسوم الذاكرة المؤقتة والأدوات وإعادة المحاولة المطبقة بشكل منفصل. تُعد رموز التفكير جزءاً من المخرجات المفوترة.
خفّض التكلفة دون فقد جودة المهام المقبولة
| التحسين | الإجراء | الفائدة |
|---|---|---|
| ضبط الجهد | استخدم low حيث تسمح الجودة | تقليل حمل الاستدلال |
| تقليل المحفز | إزالة تاريخ محادثة زائد | رموز إدخال أقل |
| التخزين المؤقت للمحفز | الحفاظ على سياق ثابت معاد استخدامه | خفض تكلفة الإدخال المتكرر |
| البث | عرض الرموز مع وصولها | إدراك أفضل للاستجابة |
| التحقق من المخطط | رفض السجلات المعطوبة مبكراً | تقليل إعادة العمل لاحقاً |
| توجيه النموذج | تصعيد الحالات المعقدة | توازن أفضل بين التكلفة والجودة |
| المعالجة الدُفعية | دُفّع الطلبات غير التفاعلية | توفيرات إضافية محتملة |
لا تختَر تلقائياً أدنى جهد. قد تزيد تكلفة إجمالية إذا أدى الاتصال الأرخص إلى مزيد من المحاولات المعاد إرسالها. قيّم الدقة، وزمني p50/p95، واستخدام الرموز، والتكلفة لكل مهمة ناجحة.
بالنسبة لـ التخزين المؤقت للمحفز، أعد استخدام بادئة ثابتة وافحص إنشاء الذاكرة المؤقتة وقراءة الذاكرة المؤقتة بدلاً من افتراض ضربة. لدى Haiku 5.5 حد أدنى 512 رمزاً للمحفز القابل للتخزين المؤقت على Claude API الموثق. قد يؤدي تغيير الجهد إلى إبطال البادئات المخزنة؛ حافظ على الإعدادات ثابتة داخل المحادثة. نافذة سياق 1M هي سقف سعة، وليست توصية لإرسال كل مستند في كل دورة.
حافظ على بادئة قابلة لإعادة الاستخدام للتخزين المؤقت، اختصر المدخلات غير الضرورية، وقارن تغييرات الجهد. يحسن البث إدراك الاستجابة بدلاً من أن يقلل تلقائياً من الاستخدام المفوتر. قارن التكلفة لكل مهمة مقبولة عبر سير العمل الكامل، بما في ذلك إعادة المحاولات واستدعاءات الأدوات.
دليل ترحيل Claude Haiku 4.5 إلى Haiku 5.5
حدّث التكامل وصيغة الطلب
| المجال | إجراء الترحيل |
|---|---|
| معرف النموذج | استبدله بـ claude-haiku-5-5 |
| التفكير | استبدل budget_tokens اليدوية بالتفكير التكيفي |
| الجهد | استخدم output_config.effort عند الحاجة |
| أخذ العينات | احذف temperature وtop_p وtop_k؛ أي قيمة top_k غير مدعومة |
| محلل الاستجابة | تعامل مع أنواع متعددة من كتل المحتوى |
| ميزانية المخرجات | اترك حيزاً كافياً للاستدلال والمخرجات النهائية |
| prefill | أزل تهيئة المساعد غير المدعومة |
| التخزين المؤقت | أعد اختبار المحفزات عند تغيير الجهد |
| أدوات التكامل | تحقق من إصدارات الأدوات المدعومة |
لمسار CometAPI المستخدم هنا، احتفظ بـ COMETAPI_KEY وجذر base URL الأصلي مع تغيير معرف النموذج وتكوين الطلب. استبدل التفكير المُفعّل سابقاً بميزانية بتفكير تكيفي وجهد. أزل تهيئة المساعد، واحذف معلمات أخذ العينات. حافظ على التمييز بين مصفوفة المحتوى الأصلية لـ Claude واستجابة choices للمسار المتوافق.
حافظ على الحالة وأعد حساب الميزانيات
تفيد إرشادات ترحيل Haiku 5.5 الرسمية بزيادة حوالي 30% في رموز الإدخال للنص المطابق مقارنةً بـ Haiku 4.5. أعد احتساب المحفزات التمثيلية وأعد ضبط الحدود قبل نقل الحركة. تعمل كتل التفكير المُعادة فقط في الحساب الذي أنشأها أو حساب مرتبط؛ يمكن أن يؤدي تغيير الحساب إلى إسقاط تلك الكتل بصمت. حافظ على بادئة محادثة متزايدة فقط بدلاً من تعديل الرسائل السابقة بعد التوليد. افحص stop_reason، بما في ذلك max_tokens والرفض، وتعامل معها صراحةً قبل قبول المخرجات.
أعد احتساب المحفزات التمثيلية بالنموذج المستهدف وأعد ضبط max_tokens وحدود الكمون وتقديرات تكلفة الطلب. اختبر المحادثات المخزنة مقابل الحساب ومسار البوابة الذي سيعيد تشغيلها؛ لا تفترض أن كتل التفكير المُوقّعة قابلة للنقل عبر حسابات غير مرتبطة أو بادئات محادثة مُعاد كتابتها.
الخلاصة
تمثل Claude Haiku 5.5 نقطة تحول حقيقية للكفاءة من حيث التكلفة والإنتاجية العالية. من خلال تقديم أداء أقوى بكثير في استخدام الحاسوب والوكالة بسعر يقارب عُشر سعر Haiku السابق في غالبية الطلبات، جعلت Anthropic نشر النماذج الصغيرة القادرة على نطاق واسع أمراً عملياً. سواءً استخدمت API الرسمي، أو مررت عبر Amazon Bedrock، أو استخدمت بوابة موحّدة مثل CometAPI لمزيد من التوفير وبساطة التشغيل، فإن مزيج السرعة والقدرة والسعر يفتح إمكانات منتجات جديدة كانت غير اقتصادية سابقاً.
