GLM-4.6V-Flash'ın teknik özellikleri
| Öğem | |
|---|---|
| Model ailesi | GLM-4.6V çok modlu model ailesi |
| Konumlandırma | Ücretsiz, hafif çok modlu model |
| Model | GLM-4.6V-Flash |
| CometAPI listeleme adı | glm-4.6v-flash-free |
| Girdi türleri | Video, görüntü, metin, dosya |
| Çıktı türü | Metin |
| Bağlam penceresi | 128K belirteç |
| Düşünme | Etkinleştirilebilir veya devre dışı bırakılabilir |
| Fonksiyon çağrısı | Yerel fonksiyon çağırma desteği |
| Diller | Çince ve İngilizce |
| Açık kaynak model | Hugging Face üzerinde zai-org/GLM-4.6V-Flash; MIT lisansı |
GLM-4.6V-Flash (Free) nedir?
GLM-4.6V-Flash, Z.ai'nin GLM-4.6V modelinin ücretsiz sürümüdür. CometAPI de ücretsiz kullanım sunar; kimlik glm-4.6v-flash-free'dir. Görsel anlayışı akıl yürütme ve araç kullanımıyla birleştirmek için tasarlanmış hafif bir çok modlu modeldir. Model video, görüntü, metin ve dosyaları girdi olarak kabul eder, metin üretir, 128K-belirteçlik bir bağlam penceresini destekler ve derin düşünme modu açılıp kapatılabilir. Z.ai ayrıca görsel algıyı yürütülebilir eylemlere bağlamak için mimarinin kilit bir özelliği olarak yerel Function Call desteğini tanımlar.
GLM-4.6V-Flash (Free) ana özellikleri
- 128K çok modlu bağlam: Model, 128K-belirteç bağlam penceresi için eğitilmiştir ve metnin yanı sıra belgeler ve video gibi uzun, çok modlu girdileri işleyebilir.
- Görüntü, video, dosya ve metin anlama: Girdiler sıradan metinle sınırlı değildir; GLM-4.6V-Flash, görsel ve metinsel bilgiyi birlikte anlamak üzere tasarlanmıştır.
- Yerel fonksiyon çağrısı: Fonksiyon çağrısı görsel modelin içine entegre edilmiştir; böylece görsel girdiler yalnızca betimsel içerik olarak değil, araç odaklı iş akışlarının parçası olarak da kullanılabilir.
- Yapılandırılabilir düşünme: Derin düşünme modu etkinleştirilebilir veya devre dışı bırakılabilir; bu da akıl yürütme derinliği ile yanıt davranışı arasında pratik bir denge sağlar.
- Çok modlu belge anlama: Model, uzun-bağlam iş akışlarında metin, yerleşimler, grafikler, tablolar ve şekiller dahil zengin biçimlendirilmiş sayfaları yorumlayabilir.
- Görsel kodlama ve ajan iş akışları: GLM-4.6V ailesi, ekran görüntüsü odaklı ön yüz yeniden oluşturma/düzenleme ve çok modlu ajan senaryolarını destekler; Flash varyantı ailenin hafif üyesi olarak konumlandırılmıştır.
GLM-4.6V-Flash (Free) kıyaslama performansı
Yayınlanan model kartı aşağıdaki değerlendirme sonuçlarını bildirmektedir: MMBench V1.1 86.9, MMStar 74.7, MMMU (Val) 71.1, MMMU-Pro 60.6, VideoMMU 70.1, MathVista 82.7, AI2D 89.2, OCRBench 84.7, Design2Code 69.8 ve MMLongBench-128K 63.4. Bu değerler model yayıncısı/model kartı tarafından rapor edilmiştir ve belirli kıyas sürümleri ile değerlendirme ayarlarıyla birlikte yorumlanmalıdır.
Z.ai, rapor edilen çok modlu değerlendirme karşılaştırmasında 9B GLM-4.6V-Flash'ın genel olarak Qwen3-VL-8B'yi aştığını belirtmektedir. Aynı dokümantasyon, tam GLM-4.6V modelini daha büyük bir 106B model olarak konumlandırırken, GLM-4.6V-Flash'ı hafif/ücretsiz varyant olarak konumlandırır.
GLM-4.6V-Flash ile GLM-4.6V ve GLM-4.6V-FlashX karşılaştırması
| Model | Konumlandırma | Bağlam | En uygun kullanım |
|---|---|---|---|
| GLM-4.6V-Flash | Ücretsiz, hafif | 128K | Maliyet duyarlı çok modlu uygulamalar, prototipleme, yerel/açık model iş akışları |
| GLM-4.6V-FlashX | Hafif, yüksek hızlı | 128K | Daha yüksek hızlı çok modlu üretim iş yükleri |
| GLM-4.6V | Yüksek performanslı amiral gemisi | 128K | Daha zorlu çok modlu akıl yürütme ve ajan iş yükleri |
GLM-4.6V-Flash'ın kullanım alanları
GLM-4.6V-Flash, yalnızca metin tabanlı bir modele güvenmeden görsel anlayışa ihtiyaç duyan uygulamalar için özellikle uygundur: belge ve grafik analizi, OCR odaklı iş akışları, ekran görüntüsü anlama, video soru-cevap, görsel bağlama, çok modlu kodlama desteği ve araç etkin ajanlar.
GLM-4.6V-Flash'ın sınırlamaları ve dikkat edilmesi gerekenler
Model, GLM-4.6V ailesinin hafif 9B üyesidir; bu nedenle daha büyük GLM-4.6V amiral gemisine eşdeğer olarak otomatik biçimde değerlendirilmemelidir. Kıyas puanları da göreve ve değerlendirme protokolüne göre değişir. Üretim kararları için, yalnızca toplu kıyas sıralamalarına güvenmek yerine, hedef uygulamanın tam girdilerini, araç çağırma akışını, gecikmesini ve çıktı kısıtlarını test edin.
CometAPI'de GLM-4.6V-Flash API'si nasıl kullanılır
CometAPI, OpenAI uyumlu bir arayüz kullandığından, glm-4.6v-flash-free modelini OpenAI SDK'sı ile aynı temel desenle çağırabilirsiniz. CometAPI'nin belgelenmiş temel URL'si https://api.cometapi.com/v1 ve REST uç noktası /v1/chat/completions.
Adım 1: CometAPI API anahtarı edinin
Önce CometAPI hesabınıza giriş yapın. Henüz bir hesabınız yoksa CometAPI üzerinde kayıt olun. Giriş yaptıktan sonra API belirteci yönetimi sayfasını açın ve yeni bir API anahtarı oluşturun. Oluşturulan anahtarı kopyalayın ve güvenli şekilde saklayın; çünkü API isteklerinizi kimlik doğrulamak için kullanılacaktır.
Adım 2: GLM-4.6V-Flash modelini seçin
Bir API isteği oluştururken CometAPI model kimliği olarak glm-4.6v-flash-free belirtin. Bu, GLM-4.6V-Flash'ın ücretsiz sürümü için CometAPI'ye özgü tanımlayıcıdır.
Model çok modlu istekleri destekler; bu nedenle metin, görüntü ve diğer desteklenen görsel girdileri içeren görevlerde kullanabilirsiniz.
Adım 3: API isteğini yapılandırın
İsteğinizi CometAPI'nin sohbet tamamlama uç noktasına gönderin. İsteği CometAPI API anahtarınızla kimlik doğrulayın ve model alanını glm-4.6v-flash-free olarak ayarlayın.
İstek içeriğinde GLM-4.6V-Flash'ın işlemesini istediğiniz yönergeyi verin. Yalnızca metin olan bir istek için normal bir metin istemi sağlayın. Görsel analiz için, modelin hem görsel bilgiyi hem de soruyu anlayabilmesi amacıyla görüntüyü metin yönergesiyle birlikte ekleyin.
Adım 4: İsteği gönderin
Yapılandırılan isteği CometAPI'ye gönderin. CometAPI isteği GLM-4.6V-Flash'a iletir ve modelin yanıtını API üzerinden geri döndürür.
Yanıt, üretilen içeriği ve ilişkili yanıt bilgilerini içerir. Uygulamanız, modelin yanıtını çıkarıp kullanıcıya gösterebilir veya programatik olarak işlemeye devam edebilir.
Adım 5: Yanıtı işlemden geçirin ve doğrulayın
Yanıtı aldıktan sonra döndürülen içeriği ayrıştırın ve uygulamanızda kullanın. Çok modlu uygulamalarda, modelin sağlanan görüntü veya diğer görsel içeriği yorumlamasının, iş akışınızın gereksinimleriyle uyumlu olduğundan emin olun.
Üretim uygulamalarında, bir isteğin tamamlanamadığı durumlarda uygulamanızın düzgün toparlanabilmesi için API hatalarını, istek zaman aşımlarını ve geçersiz yanıtları da ele alın.
CometAPI istekleri için şunu kullanın:
glm-4.6v-flash-free
Bu model kimliği, sağlayıcının altta yatan model adından farklıdır. İsteğinizin CometAPI model kimliğini tam olarak belirtildiği şekilde kullandığından emin olun.