Tüm yazılar
11 dk okuma

ZERADES Tech Daily — 7 Ekim 2026: Mistral Large 4, OpenAI Decisions API, EmbeddingGemma 2

Mistral 1T parametrelik Large 4'ü önizlemeye açtı, OpenAI tipli cevap dönen Decisions API'yi beta'ya aldı, Google cihaz üstü çok modlu EmbeddingGemma 2'yi Apache 2.0 ile yayınladı. Anthropic siber erişimi üç katmana ayırdı.

Özet: Günün iki açık modeli ölçeğin iki ucundan geldi: Mistral, 1T parametrelik Mistral Large 4'ü (Le Chonk) önizlemeye açtı, Google ise cihaz üstünde çalışan çok modlu embedding modeli EmbeddingGemma 2'yi Apache 2.0 ile yayınladı. Sağlayıcı tarafında OpenAI, metin üretmek yerine tipli cevap dönen Decisions API'yi beta'ya aldı; Anthropic de siber güvenlik ekipleri için model erişimini üç katmana ayırdı.

Günün öne çıkanları

Mistral Large 4 önizlemede: 1T parametre, ağırlıklar ay sonunda

Mistral, 6 Ekim'de Mistral Large 4'ün (ML4, gayriresmî adıyla "Le Chonk") public preview'ını açtı. Duyuruya göre ML4, toplam 1 trilyon, token başına 49 milyar aktif parametreli, doğal olarak çok modlu bir model. Model dokümantasyonu ise 1,05T toplam, 52B aktif parametre ve 1,6B'lik bir vision encoder listeliyor; iki kaynak arasındaki bu küçük fark henüz açıklanmadı. Context 1M token. Önizleme API'si Mistral Studio'da açık. Dokümanda lansman indirimiyle fiyat milyon token başına $0,68 girdi, $0,07 cache'li girdi ve $2,09 çıktı (indirimsiz liste: $1,36 / $0,14 / $4,18).

Mistral'in paylaştığı rakamlar şöyle: DeepSWE v1.1'de %61,7, Terminal-Bench 4'te %28,3, SWE-Atlas-QnA'da %59,4. Şirket, birleşik Coding Agent Index'te (49,8) modeli DeepSeek V4 Pro 0813 ve Qwen3.8 Max'in önüne koyuyor. Surge AI ile yapılan kör insan değerlendirmesinde ML4, beş model arasında ikinci çıkmış: Kimi K3 ve GLM-5.3'ün önünde, Claude Opus 5'in arkasında. Siber güvenlikte Artificial Analysis Cyber Index'te ilk beşte olduğunu ve Cybench'te görevlerin %93'ünü çözdüğünü söylüyor. Bu skorların çoğu şirketin kendi ölçümü.

Ağırlıklar henüz yok. Mistral, ağırlıkları "ay sonuna kadar" yayınlayacağını ve o zamana kadar modeli siber güvenlik şirketleri, onaylı ortaklar ve devlet kurumlarıyla gerçek ortamlarda red-team'den geçirdiğini söylüyor. Lisans adı duyuruda geçmiyor. Model, Mistral'in Avrupa'daki kendi veri merkezlerinde 3.800 NVIDIA Grace Blackwell GPU ile sıfırdan eğitilmiş ve önizleme de aynı altyapıda sunuluyor. TechCrunch'a konuşan Mistral VP Science Pierre Stock, bu GPU sayısının Çinli rakiplerin kullandığından iki ila üç kat az olduğunu söylüyor.

Neden önemli: Bu, Çin dışında geliştirilen en büyük open-weight modellerden biri olmaya aday ve Avrupa'da uçtan uca Mistral'in işlettiği bir dağıtım seçeneğiyle geliyor. Bir gün önce duyurulan Reflection Beam ile birlikte, ABD ve Avrupa'dan Çin laboratuvarlarının belirlediği open-weight sınırına iki ciddi aday çıkmış oldu. Gerçek değer, ağırlıklar ve bağımsız ölçümler geldiğinde netleşecek.

Kaynak: https://mistral.ai/news/mistral-large-4/
Kaynak (doküman): https://docs.mistral.ai/models/mistral-large-4-0
Kaynak (ek): https://techcrunch.com/2026/10/06/mistrals-new-1t-model-aims-to-leapfrog-closed-and-open-rivals/

OpenAI Decisions API beta'da: metin yerine olasılık, seçim ve skor

OpenAI, 6 Ekim'de Decisions API'yi public beta'ya aldı. Yeni POST /v1/decisions endpoint'i, metin veya görsel girdiye karşı geliştiricinin tanımladığı sorulara serbest metin yerine tipli cevap dönüyor. Üç soru tipi var: predicate (bir koşulun doğru olma olasılığı, 0–1), choice (verilen seçeneklerden biri ve her seçeneğin olasılığı) ve score (sıralı seviyelere göre olasılık ağırlıklı skor). Tek istekte birden fazla soru sorulabiliyor.

Şimdilik yalnızca gpt-6-luna destekleniyor. OpenAI, cevapların Responses API'ye göre yaklaşık 10 kat hızlı döndüğünü söylüyor. Fiyat yalnızca girdi üzerinden: milyon token başına $0,10. Çıktı, cache okuma veya cache yazma ücreti yok. Görseller yalnızca inline base64 olarak kabul ediliyor. ZDR ve HIPAA uygun müşterilere açık; ABD ve Avrupa (EEA + İsviçre) veri yerleşimi destekleniyor. API, DevDay'de sınırlı önizlemede tanıtılmıştı; GA'nın önümüzdeki haftalarda gelmesi bekleniyor.

Neden önemli: İçerik sınıflandırma, talep yönlendirme ve ajanların "sonraki adım" kararı gibi işler bugüne kadar genelde Structured Outputs ve prompt mühendisliğiyle çözülüyordu. Ayrı ve ucuz bir karar endpoint'i bu işleri hem hızlandırıyor hem de eşik belirlemeyi kolaylaştırıyor, çünkü doğrudan olasılık dönüyor.

Kaynak: https://developers.openai.com/api/docs/guides/decisions
Kaynak (changelog): https://developers.openai.com/api/docs/changelog


AI ve modeller

Google EmbeddingGemma 2: metin, kod, görsel, ses ve video için tek embedding uzayı

Google DeepMind, 6 Ekim'de EmbeddingGemma 2'yi yayınladı. 740M parametreli model Gemma 4 mimarisi üzerine kurulu ve Apache 2.0 lisanslı. Metin, kod, görsel, ses ve videoyu ortak bir 768 boyutlu embedding uzayına taşıyor. Yapı modüler: yalnızca metin için 270M parametre yetiyor, vision (170M) ve audio (300M) encoder'ları isteğe bağlı. Matryoshka Representation Learning sayesinde vektörler 512, 256 veya 128 boyuta kısaltılabiliyor. Context 8K token; Google'a göre bu, 5,5 dakika ses, 29 görsel veya 58 video karesine denk geliyor.

Google, MTEB Code skorunun ilk sürüme göre 68,76'dan 78,68'e çıktığını söylüyor. Kuantize edilmiş haliyle Pixel 11 Pro'da metin için yaklaşık 191MB, tam çok modlu model için yaklaşık 567MB aktif RAM yetiyor. Ağırlıklar Hugging Face ve Kaggle'da. transformers, sentence-transformers, MLX, vLLM, llama.cpp, SGLang, Ollama ve LM Studio desteği ilk günden var.

Neden önemli: Yerel kod tabanı indeksleme, coding ajanları için retrieval ve gizlilik odaklı RAG için küçük, açık lisanslı ve çok modlu bir embedding modeli bulmak zordu. Bunu cihaz üstünde çalıştırmak, veriyi dışarı göndermeden çok modlu arama yapmayı mümkün kılıyor.

Kaynak: https://blog.google/innovation-and-ai/technology/developers-tools/embeddinggemma-2/

TII'den Emirlik Arapçası için Falcon-Emirati, yanında konuşma tanıma ve OCR modelleri

Abu Dabi'deki Technology Innovation Institute (TII), 6 Ekim'de üç model duyurdu. Falcon-Emirati, Falcon-H1-Arabic üzerine kurulu, Emirlik Arapçasına özel 7B parametreli bir dil modeli. TII, modelin Alyah adlı Emirlik Arapçası benchmark'ında %84,83 aldığını ve değerlendirdiği tüm açık Arapça ve çok dilli modelleri geçtiğini söylüyor. Ancak karşılaştırılan modelleri ve skorlarını paylaşmadığı için iddia şimdilik doğrulanamıyor. Model, Falcon Chat platformu üzerinden sunulacak; ağırlıkların açılıp açılmayacağı belli değil.

Yanındaki iki model daha pratik: Falcon-ASR (1,6B), Emirlik ve Standart Arapça ile İngilizce, Fransızca, İspanyolca ve Portekizceyi kelime bazında zaman damgasıyla metne çeviriyor. Falcon-OCR-Arabic ise görsellerden ve dokümanlardan Arapça metin, tablo ve formül çıkaran hafif bir model (Hugging Face blog'una göre 270M parametre).

Neden önemli: Lehçe düzeyinde özelleşmiş bölgesel modeller, büyük çok dilli modellerin zayıf kaldığı alanları dolduruyor. Türkçe gibi kendi ağız ve kullanım çeşitliliği olan diller için de benzer bir yaklaşımın örneği.

Kaynak: https://www.tii.ae/insights/tii-launches-falcon-emirati-alongside-new-arabic-ai-models-speech-and-visual-text
Kaynak (OCR): https://huggingface.co/blog/tiiuae/falcon-ocr-arabic


Provider ve platform

Anthropic, siber güvenlik erişimini üç katmana ayırdı

Anthropic, 6 Ekim'de Cyber Verification Program'ın (CVP) genişletilmiş sürümünü duyurdu ve Project Glasswing ile tek bir programda birleştirdi. Genel kullanıma açık modellerde siber güvenlik işlerinin çoğu bloklanıyor. CVP ise doğrulanmış güvenlik ekiplerine daha az bloklayan sınıflandırıcılarla Claude Opus 5.5, Sonnet 5.5 ve Mythos 5.1 erişimi veriyor. Üç katman var:

  • Defense Access: SOC, olay müdahalesi, malware analizi ve zafiyet doğrulama gibi savunma işleri. Şirket güvenlik ekipleri, kritik altyapı işletmecileri, küçük güvenlik firmaları, open-source maintainer'lar ve geçmişi olan bireysel araştırmacılar başvurabiliyor; başvuruların birkaç günde yanıtlanması hedefleniyor.
  • Red Team Access: Buna ek olarak yetkili penetrasyon testi ve red-teaming. Yalnızca kurumlar başvurabiliyor ve inceleme birkaç hafta sürüyor.
  • Specialized Access: En az bloklu katman. Uçuş sistemleri, elektrik şebekesi ve bankalar arası transfer gibi kritik sistemleri test etmeye yetkili sınırlı sayıda kuruma açık; incelemeler ABD hükümetiyle birlikte yapılıyor.

Programda veri saklama zorunlu. Anthropic'in kendi testinde CVP olmadan tüm CyScenarioBench görevleri ilk prompt'ta bloklanırken, Red Team katmanında hiç blok olmamış ve Opus 5.5 50 görevin 34'ünü tamamlamış. CVP; Claude Platform, Vertex AI ve Microsoft Foundry'de kullanılabiliyor. Bedrock'ta ise yalnızca Enterprise Frontier Safeguards'a uygun müşterilere açık.

Neden önemli: Aynı gün Mistral de ML4'ün kapalı modellerin reddettiği siber görevleri yapabildiğini öne çıkardı. Frontier sağlayıcılar artık siber kabiliyeti herkese kapatmak yerine doğrulama katmanlarıyla açıyor. Güvenlik ürünü geliştiren ekipler için hangi sağlayıcıyla hangi işi yapabilecekleri netleşiyor.

Kaynak: https://www.anthropic.com/news/cyber-verification-program

Claude artık Google Docs, Sheets ve Slides içinde

Anthropic, Claude for Google Workspace eklentisini tüm ücretli planlarda public beta olarak açtı. Claude, Docs, Sheets ve Slides'ta yan panelde açılıyor; açık dosyayı ve seçili metni, hücreleri ya da slaytları görüp doğrudan düzenleyebiliyor. Sheets'te formül, pivot tablo ve native grafik oluşturabiliyor, veri temizliği için aralığı Python'a çekip sonucu geri yazabiliyor. Slides'ta destenin mevcut layout ve temasını kullanıyor. Varsayılan "Ask before edits" modunda her değişiklik onay kartıyla geliyor. Eklentide kullanıcının Claude'daki modelleri, connector'ları ve skill'leri aynen çalışıyor. Ayrıca Claude içinden Google dosyası oluşturup düzenlemek için yeni Docs, Sheets ve Slides connector'ları (beta) geldi.

Neden önemli: Bu, Google'ın kendi Gemini entegrasyonunun bulunduğu ürünlere Anthropic'in birinci taraf olarak girmesi demek. Workspace kullanan ekipler artık aynı dosyada iki farklı sağlayıcının asistanını seçebiliyor.

Kaynak: https://claude.com/resources/articles/claude-now-works-in-google-docs-sheets-and-slides


Araştırma ve açık kaynak

OpenAI, yayınlanmamış bir modelin matematik sonuçlarını GitHub'da açtı

OpenAI, yayınlanmamış bir frontier modelin ürettiği matematik sonuçlarını bir GitHub deposunda yayımladı. The Verge'e göre paket, 372 sonuç ailesi altında toplanmış 722 makaleden oluşuyor. Bu yayın, Institute for Advanced Study bünyesindeki bağımsız matematik ve AI danışma grubunun (AGMAI) önerilerine göre hazırlanmış. AGMAI, paketin "yüzlerce" açık soruya çözüm içerdiğini söylüyor. Depoda ayrıca 10 akıl yürütme özeti, compute tahminleri ve denenen problem sayıları var. OpenAI'a göre ortalama bir sonuç, yaklaşık üç saatlik ChatGPT Pro düşünme süresine denk geliyor. Şirket, modeli "sorumlu şekilde" yayınlamak için çalıştığını söylüyor ama bir tarih vermiyor.

Neden önemli: Sonuçların bağımsız bir komitenin önerdiği formatta, revizyon ve atıf protokolleriyle paylaşılması, AI tarafından üretilen bilimsel çıktının nasıl doğrulanacağına dair bir örnek oluşturuyor. Matematik topluluğundaki etik ve atıf tartışmaları ise sürüyor.

Kaynak: https://openai.com/index/sharing-ai-progress-in-mathematics/
Kaynak (ek): https://www.theverge.com/ai-artificial-intelligence/1005004/openai-math-release-github

Tencent Hunyuan'dan Prism: 2K çözünürlükte video ve sesi birlikte üretmek için sparse attention

Tencent Hunyuan, Fudan ve Zhejiang üniversiteleriyle birlikte Prism'i açık kaynak olarak yayınladı. Prism, videoyu ve senkron sesini tek geçişte üreten modelleri doğrudan 2K çözünürlükte eğitmek için tasarlanmış bir dinamik sparse attention yöntemi. Token dizisini uzay-zaman bölgelerine ayırıyor ve her bölge için, görsel içeriğin ne kadar hızlı değiştiğine ve sesin o bölgeyi ne kadar etkilediğine göre farklı blok şekli seçiyor. Makaleye göre bu yöntem, full attention'a göre eğitimi 2,5 kat hızlandırırken üretim kalitesinde de onu geçiyor. Kod ve model Hugging Face ve GitHub'da MIT lisansıyla yayında; eğitim ve fine-tuning kodu da dahil. Şimdilik bir önizleme sürümü.

Neden önemli: Yüksek çözünürlüklü video üretiminde asıl darboğaz attention maliyeti. Eğitim koduyla birlikte MIT lisanslı bir çözüm, açık video-ses modellerini kendi verisiyle eğitmek isteyen ekipler için somut bir başlangıç noktası.

Kaynak: https://huggingface.co/papers/2610.05416
Kaynak (kod): https://github.com/Tencent-Hunyuan/Prism


Sektör

Anthropic, Claude Startups programını genişletti

Anthropic, SF Tech Week kapsamında Claude Startups programını genişletti. Son beş yılda kurulan veya son iki yılda yatırım alan şirketler başvurabiliyor. Üyelere bir yıllık ücretsiz Claude Team (beş Premium koltuğa kadar), tek seferlik $1.000 API kredisi, Applied AI ekibiyle sanal ofis saatleri ve "Claude Startup Stack" adı altında toplam $45.000'a kadar partner indirimi ve kredisi veriliyor. Program Mayıs'ta başlamıştı. Aynı gün Google da Gemini Startup Forum'un dördüncü dönemi için 17 ülkeden 100'den fazla girişim seçtiğini duyurdu; uygun girişimlere $350.000'a kadar Google Cloud kredisi veriliyor.

Neden önemli: Sağlayıcılar arası rekabet, model fiyatının yanında erken aşama girişimleri kendi ekosistemlerine bağlamak üzerinden de yürüyor. Türkiye'deki AI girişimleri için de başvurmaya değer bir kredi kaynağı.

Kaynak: https://claude.com/resources/articles/were-expanding-the-claude-startups-program-to-help-founders-build
Kaynak (ek): https://blog.google/company-news/outreach-and-initiatives/entrepreneurs/gemini-startup-forum-2026/


Kısa notlar

  • OpenAI, API kullanım katmanlarını beşten üçe indirdi: Build, Launch ve Grow. Organizasyonlar, toplam kredi alımı katman eşiğine ulaştığında otomatik olarak yükseltiliyor. Kaynak: https://developers.openai.com/api/docs/changelog
  • Together AI, 5 Ekim akşamı Together Link'i duyurdu. Araç, Claude Code, Codex, OpenCode ve Pi gibi coding ajanlarını Kimi K3, GLM 5.3, GLM 5.3 Flash ve DeepSeek V4.1 Flash gibi açık modellere tek komutla bağlıyor. "Auto" modunda bir router, her oturumun ilk görevine bakıp modeli seçiyor. Together'a göre maliyet %50'den fazla düşüyor. Kaynak: https://www.together.ai/blog/together-link-frontier-quality-open-models-in-the-harness-you-already-use
  • Google Gemini uygulamasında 9 Ekim'den itibaren ücretsiz kullanıcılar yalnızca Flash Lite modelini kullanabilecek. The Verge'e göre $4,99'luk AI Plus planı da Pro erişimini kaybedecek; Pro ve Deep Think yalnızca AI Pro ve Ultra planlarında kalacak. Kaynak: https://www.theverge.com/ai-artificial-intelligence/1005451/google-gemini-free-flash-lite-only
  • Çin Bilimler Akademisi Otomasyon Enstitüsü ve Wuhan AI Araştırma Enstitüsü, fiziksel dünya ve embodied AI için yaklaşık 9B parametreli çok modlu ZDTaichu5.0-9B'yi açık ağırlıklı olarak yayınladı. Ağırlıkların yanında üç boyutlu etiketleme dahil veri üretim pipeline'ını da açtılar. Haber 6 Ekim tarihli ama yayın tarihi "yakın zamanda" olarak geçiyor ve iddia edilen benchmark sonuçları bağımsız olarak doğrulanmadı. Kaynak: https://feng.ifeng.com/c/8wzq3NaN5Va
  • Çin'deki Ulusal Gün tatili 7 Ekim'de bitiyor; DeepSeek, Qwen, Kimi, GLM ve MiniMax'ten 6 Ekim'de doğrulanmış yeni bir model sürümü yok. Yaklaşan tarihler: 10 Ekim'de Alibaba Model Studio'da üçüncü taraf model kapanışları, 15 Ekim'de StepFun Step 5 açık ağırlıkları.

ZERADES bakışı

Günün iki net eğilimi var. Birincisi, open-weight sınırına Çin dışından gelen adayların hızla artması: Pazartesi Reflection Beam, Salı Mistral Large 4. İkisinin de ağırlıkları henüz yok ve ikisi de "ay içinde" söz veriyor. Bu yüzden Ekim sonunda Çin laboratuvarlarıyla bağımsız karşılaştırmalar asıl haber olacak. İkincisi, siber kabiliyetin erişim politikası haline gelmesi. Anthropic doğrulama katmanlarıyla kapıyı kontrollü açıyor, Mistral ise açık ağırlıkla bu kontrolü müşteriye bırakmayı vaat ediyor.

Denemeye değer olanlar: Sınıflandırma ve yönlendirme işlerini bugün LLM çağrısı ve JSON parse ile yapıyorsanız, Decisions API'yi küçük bir etiketli veri setiyle test etmek maliyet ve gecikme açısından hızlı bir kazanç olabilir. Yerel veya gizlilik odaklı RAG kuruyorsanız EmbeddingGemma 2'yi mevcut embedding modelinizle karşılaştırın. Bu hafta takip edilecekler: 9 Ekim'de Gemini ücretsiz katman değişikliği, 10 Ekim'de Alibaba kapanışları, tatil sonrası Çin laboratuvarlarından gelebilecek sürümler ve 15 Ekim'de Step 5 ağırlıkları.


Kaynaklar

  1. https://mistral.ai/news/mistral-large-4/
  2. https://docs.mistral.ai/models/mistral-large-4-0
  3. https://techcrunch.com/2026/10/06/mistrals-new-1t-model-aims-to-leapfrog-closed-and-open-rivals/
  4. https://developers.openai.com/api/docs/guides/decisions
  5. https://developers.openai.com/api/docs/changelog
  6. https://blog.google/innovation-and-ai/technology/developers-tools/embeddinggemma-2/
  7. https://www.tii.ae/insights/tii-launches-falcon-emirati-alongside-new-arabic-ai-models-speech-and-visual-text
  8. https://huggingface.co/blog/tiiuae/falcon-ocr-arabic
  9. https://www.anthropic.com/news/cyber-verification-program
  10. https://claude.com/resources/articles/claude-now-works-in-google-docs-sheets-and-slides
  11. https://openai.com/index/sharing-ai-progress-in-mathematics/
  12. https://www.theverge.com/ai-artificial-intelligence/1005004/openai-math-release-github
  13. https://huggingface.co/papers/2610.05416
  14. https://github.com/Tencent-Hunyuan/Prism
  15. https://claude.com/resources/articles/were-expanding-the-claude-startups-program-to-help-founders-build
  16. https://blog.google/company-news/outreach-and-initiatives/entrepreneurs/gemini-startup-forum-2026/
  17. https://www.together.ai/blog/together-link-frontier-quality-open-models-in-the-harness-you-already-use
  18. https://www.theverge.com/ai-artificial-intelligence/1005451/google-gemini-free-flash-lite-only
  19. https://feng.ifeng.com/c/8wzq3NaN5Va