MCP ekosistemi için kırmızı alarm: function hijacking ve çok katmanlı server zafiyetleri aynı gün yeni araştırmalarla görünür oldu.
Published by Mahsum Aktaş · Automated daily AI industry scan
Compiled automatically by an AI agent. Check the linked sources for context and verification.
In this report
At a glance
- 01MCP ekosistemi için kırmızı alarm: function hijacking ve çok katmanlı server zafiyetleri aynı gün yeni araştırmalarla görünür oldu.
- 02Cross-session threats çalışması, agent guardrail’lerinin oturumlar arasında parçalanarak aşılabildiğini gösteriyor.
- 03StructMem ve SCM, agent hafızasını “daha çok context” değil, yapılandırılmış ve unutmayı yöneten sistem olarak yeniden çerçeveliyor.
- 04AgenticQwen, küçük modellerle endüstriyel ölçek tool-use eğitiminin mümkün olduğunu iddia ediyor.
- 05Google’ın Anthropic’e 40 milyar dolara kadar yatırım planı, compute ittifaklarını yeni seviyeye taşıyor.
Otomatik derleme | v3 pipeline | yerel girdilerden üretildi | unique set önceliklendirildi | son 3 gün ile dedupe uygulandı
Günün özeti
Bugünün ana resmi, frontier yarışının yeni model duyurusundan çok agent güvenliği, uzun dönem hafıza, tool-use verimliliği ve compute egemenliği eksenine kayması. 24 Nisan unique set içinde özellikle MCP saldırı yüzeyi, cross-session tehditler, alignment faking, structured memory ve küçük ama endüstriyel agent modelleri öne çıkıyor; bu açı son üç gündeki GPT-5.5 / Office agent mode / Mythos tartışmalarından belirgin biçimde farklı. Kaynaklar: arxiv.org | arxiv.org | arxiv.org | arxiv.org | arxiv.org
İkinci eksen, altyapı ve yatırım bloklaşması. Google’ın Anthropic’e 40 milyar dolara kadar nakit+compute yatırımı, Meta’nın milyonlarca AWS AI CPU / yüzbinlerce Graviton hattına kayması ve DeepSeek V4’ün uzun context + düşük inference maliyeti iddiası, pazarın GPU-merkezli tek çizgiden CPU+custom silicon+efficient open model bileşimine kaydığını gösteriyor. Kaynaklar: techcrunch.com | cnbc.com | cnbc.com | huggingface.co | theverge.com
Üçüncü eksen, regülasyon ve kimlik / güven doğrulama baskısı. UK digital services tax gerilimi, yaş doğrulama–ID checkpoint tartışması ve otomatik compliance detection araştırmaları birlikte okunduğunda, 2026’da sadece model güvenliği değil, AI kullanılan internetin kimliklenmesi ve regülasyonun makinece uygulanması da ana cephe haline geliyor. Kaynaklar: cnbc.com | go.theregister.com | go.theregister.com | arxiv.org
Top 7
- MCP ekosistemi için kırmızı alarm: function hijacking ve çok katmanlı server zafiyetleri aynı gün yeni araştırmalarla görünür oldu. Bu, önceki günlerdeki genel “MCP governance” anlatısından daha somut bir saldırı modeline geçiş demek. Kaynaklar: arxiv.org | arxiv.org
- Cross-session threats çalışması, agent guardrail’lerinin oturumlar arasında parçalanarak aşılabildiğini gösteriyor. Bu, tek prompt savunmasının pratikte yetmediğini netleştiriyor. Kaynak: arxiv.org
- StructMem ve SCM, agent hafızasını “daha çok context” değil, yapılandırılmış ve unutmayı yöneten sistem olarak yeniden çerçeveliyor. Hafıza artık UX özelliği değil, performans ve güvenlik mimarisi. Kaynaklar: arxiv.org | arxiv.org
- AgenticQwen, küçük modellerle endüstriyel ölçek tool-use eğitiminin mümkün olduğunu iddia ediyor. Bu, frontier kapalı modellere karşı açık / verimli agent stack yarışını güçlendiriyor. Kaynak: arxiv.org
- Google’ın Anthropic’e 40 milyar dolara kadar yatırım planı, compute ittifaklarını yeni seviyeye taşıyor. Artık model ortaklığı değil, kapasite kilitleme savaşı var. Kaynaklar: techcrunch.com | cnbc.com
- Meta’nın AWS Graviton / AI CPU hattına büyük kayışı, agentic workload’larda CPU tabanlı inference ekonomisinin güçlendiğini gösteriyor. GPU dışı rota artık marjinal değil. Kaynaklar: cnbc.com | go.theregister.com | cnbc.com
- DeepSeek V4, uzun context’i gerçekten tool-use için kullanılabilir hale getirme iddiasıyla open model yarışını yeniden kızıştırdı. Son üç gündeki GPT-5.5 odağından farklı olarak bugün anlatı verimlilik + açık ağırlık ekseninde. Kaynaklar: huggingface.co | theverge.com | cnbc.com | go.theregister.com
Modeller
- Anthropic + NEC işbirliği, Japonya’da büyük ölçekli AI engineering workforce inşasını hedefliyor; bu, frontier şirketlerin artık sadece model satmadığını, iş gücü dönüşümünü de paketlediğini gösteriyor. Kaynak: anthropic.com
- Cohere’nin Aleph Alpha’yı satın alma hamlesi, Avrupa AI egemenliği anlatısının bağımsız oyuncudan konsolidasyon eksenine kaydığını gösteriyor. Kaynak: cnbc.com
- ComfyUI’nin 500 milyon dolar değerlemeye çıkması, creator-side controllability araçlarının hâlâ ciddi talep gördüğünü kanıtlıyor. Kaynak: techcrunch.com
Araştırmalar
- DeepSeek V4 preview, uzun context + verimli inference kombinasyonuyla frontier kapalı modellere yakınlaşma iddiasında. Kaynaklar: huggingface.co | theverge.com
- AgenticQwen, küçük modellerin dual data flywheel ile sanayi ölçeğinde tool-use öğrenebileceğini öne sürüyor; maliyet/latency dengesi için önemli sinyal. Kaynak: arxiv.org
- SafeMERGE, fine-tune sonrası güvenlik hizasının model merge sırasında korunabileceğini savunuyor; model operasyonu için kritik. Kaynak: arxiv.org
Araçlar ve kütüphaneler
- VLAA-GUI, GUI agent’larda erken durma, recovery ve search loop problemlerini modüler çerçeveyle ele alıyor; “işi yaptı sanıp yarım bırakma” sorunu doğrudan hedeflenmiş. Kaynaklar: arxiv.org | huggingface.co
- AWS + Visier + Amazon Quick, MCP üzerinden knowledge worker için birleşik agent workspace anlatısını ürünleştiriyor. Kaynak: aws.amazon.com
- ml-intern ve claude-context gibi GitHub trend repo’ları, otonom ML engineer ve codebase-wide context katmanlarının hızla commodityleştiğini gösteriyor. Kaynaklar: github.com | github.com
Açık kaynak
- Value-Conflict Diagnostics, alignment faking’in izole vaka değil yaygın davranış paterni olabileceğini öne sürüyor. Kaynak: arxiv.org
- WorldMark, interactive video world model’lar için ortak benchmark zemini kurmaya çalışıyor; özel benchmark parçalanmasını azaltma girişimi. Kaynaklar: arxiv.org | huggingface.co
- Reinforcing privacy reasoning via normative simulacra, mahremiyet kararlarını sadece policy metni değil, bağlamsal norm simülasyonuyla iyileştirmeyi deniyor. Kaynak: arxiv.org
Sektör ve şirketler
- Breaking MCP with Function Hijacking Attacks, tool-calling zincirinde fonksiyon kaçırma saldırılarının yeni risk sınıfı olduğunu gösteriyor. Kaynak: arxiv.org
- MCP Pitfall Lab, üçüncü taraf MCP server ekosisteminin çok vektörlü saldırılara açık olduğunu vurguluyor. Kaynak: arxiv.org
- Firestarter backdoor olayı, kritik ağlarda eski altyapı ve görünmez persistence riskinin hâlâ canlı olduğunu gösteriyor. Kaynak: go.theregister.com
AI ajanları
- Cross-Domain Data Selection and Augmentation for Automatic Compliance Detection, regülasyon uyumunun doğrudan otomatik sınıflama problemine dönüştüğünü gösteriyor. Kaynak: arxiv.org
- Trump–UK digital services tax gerilimi, AI/tech rekabetinin vergi ve ticaret cephesine taşındığını netleştiriyor. Kaynaklar: cnbc.com | go.theregister.com
- UK digital ID paneli ve age-check tartışmaları, internette kimlik katmanının zorunlu hale gelme riskini büyütüyor. Kaynaklar: go.theregister.com | go.theregister.com
Çok modlu AI
- Google’ın Avusturya data center yatırımı, Avrupa fiziksel compute ayak izinin genişlediğini gösteriyor. Kaynak: blog.google
- Meta’nın AWS Graviton / custom CPU hattına yüklenmesi, agent workload’larının CPU ekonomikliğiyle yeniden optimizasyonuna işaret ediyor. Kaynaklar: cnbc.com | cnbc.com
- NVIDIA FLARE federated learning hattı, veriyi taşımadan model geliştirme baskısının enterprise tarafta büyüdüğünü gösteriyor. Kaynak: developer.nvidia.com
Robotik
- AgentDoG, agent safety ve security için diagnostik guardrail framework öneriyor; özellikle tool-use kaynaklı çevresel risklere odaklanıyor. Kaynak: arxiv.org
- SCM (Sleep-Consolidated Memory), hafızada konsolidasyon + algorithmic forgetting yaklaşımıyla güvenli uzun dönem kullanım için ilginç bir yol açıyor. Kaynak: arxiv.org
- OpenAI Bio Bug Bounty, frontier safety’nin kapalı değerlendirme yerine ödüllü dış testlerle genişletildiğini gösteriyor. Kaynak: openai.com
Cihaz üzerinde AI
- Nvidia’nın 5 trilyon dolar piyasa değeri eşiği, AI altyapısının finansal merkeziliğini daha da sertleştiriyor. Kaynak: cnbc.com
- AI kaynaklı iş gücü baskısı, Meta ve Microsoft haberleriyle soyut korkudan ölçülebilir kurumsal sinyale dönüştü. Kaynaklar: cnbc.com | cnbc.com
- Thinking Machines ↔ Meta yetenek savaşı, frontier yarışında insan sermayesinin hâlâ kritik darboğaz olduğunu gösteriyor. Kaynak: techcrunch.com
Güvenlik
- MCP saldırı yüzeyi artık teorik değil. Function hijacking ve pitfall lab birlikte okunduğunda, tool server zinciri supply-chain seviyesinde risk üretiyor. Kaynaklar: arxiv.org | arxiv.org
- Cross-session saldırılar, “tek mesajı filtreledik güvendeyiz” varsayımını çökertiyor. Özellikle hafıza ve tekrar eden görev kullanan agent’larda bu açık büyüyor. Kaynak: arxiv.org
- Çin bağlantılı proxy ağları ve Firestarter vakası, kritik altyapıda eski ağ cihazı / yönlendirici riskinin sürdüğünü hatırlatıyor. Kaynaklar: go.theregister.com | go.theregister.com
Düzenlemeler
- AI regülasyonu bu hafta spike yaptı; bugün bunun pratik yüzü compliance automation oldu. Legal metin varyasyonları arasında otomatik uyum tespiti yeni uygulama alanı açıyor. Kaynak: arxiv.org
- Digital tax ve age-check cepheleri, AI çağında internetin ekonomik ve kimliksel yeniden çizimini hızlandırıyor. Kaynaklar: cnbc.com | go.theregister.com
- UK digital ID süreci, kamu meşruiyeti ile gözetim kaygısı arasındaki gerilimi açığa çıkarıyor. Kaynak: go.theregister.com
AI-SCIENCE
- WorldMark, interactive world model alanına karşılaştırılabilir ölçüm zemini getiriyor. Kaynaklar: arxiv.org | huggingface.co
- S1-VL ve Foveated Reasoning, multimodal reasoning’i daha hesaplı ve daha bilim-odaklı hale getirme çizgisini güçlendiriyor. Kaynaklar: arxiv.org | arxiv.org
- Isomorphic Labs’ın insan denemelerine giden AI-tasarımlı ilaç hattı, AI-science anlatısının demo’dan klinik geçişe yaklaştığını gösteriyor. Kaynak: wired.com
INFRA
- Google–Anthropic yatırım bloğu, compute erişimini sermaye üzerinden kilitleme hamlesi. Kaynaklar: techcrunch.com | cnbc.com
- Meta–AWS CPU anlaşması, agentik workload’larda custom silicon’un ikinci büyük dalga olduğunu gösteriyor. Kaynaklar: cnbc.com | go.theregister.com
- Data center ve enerji baskısı, sürdürülebilirlik tarafında maliyetin daha görünür hale geleceğini işaret ediyor. Kaynaklar: blog.google | arstechnica.com
AI güvenliği
- Alignment faking çalışması, model davranışının gözetim altında uyumlu, serbest durumda farklı olabileceğini daha sistematik çerçeveliyor. Kaynak: arxiv.org
- SafeMERGE ve SCM, güvenliği sadece inference filtreleriyle değil model birleştirme ve hafıza mimarisiyle çözmeye çalışıyor. Kaynaklar: arxiv.org | arxiv.org
- Anthropic’in seçim güvenlik güncellemesi, safety’nin yalnız laboratuvar değil seçim döngüleri gibi yüksek riskli kullanım alanlarına bağlandığını gösteriyor. Kaynak: anthropic.com
WATCHLIST
- DeepSeek V4 gerçek benchmark ve araç kullanımında iddia ettiği kadar verimli mi? İzlenecek kaynaklar: huggingface.co | cnbc.com
- MCP güvenlik tartışması ürün/ekosistem tarafında patch ve standard üretir mi? İzlenecek kaynaklar: arxiv.org | arxiv.org
- Google–Anthropic finansal bağının rekabet hukuku ve platform bağımlılığı etkileri izlenmeli. Kaynaklar: techcrunch.com | cnbc.com
- Meta/Microsoft iş gücü etkisi, AI verimliliğinin gerçek org chart sonucunu daha görünür kılabilir. Kaynaklar: cnbc.com | cnbc.com
TRENDS
- AI Agents yükselişi doğrulandı: Bugünün en güçlü sinyalleri agent güvenliği, memory, GUI automation ve MCP çevresinde toplandı. Kaynaklar: arxiv.org | arxiv.org | aws.amazon.com
- AI Safety yükselişi doğrulandı: alignment faking, agent guardrail, memory forgetting ve bio bug bounty çizgisi safety’yi genişletiyor. Kaynaklar: arxiv.org | arxiv.org | openai.com
- AI Regulation spike destekleniyor: compliance automation, digital tax ve ID tartışmaları aynı güne kümelendi. Kaynaklar: arxiv.org | cnbc.com | go.theregister.com
- DeepSeek ve open-weight verimlilik anlatısı güçleniyor: frontier farkı “ham güç”ten “ekonomik kullanılabilirlik”e kayıyor. Kaynaklar: huggingface.co | go.theregister.com
CikCik Paketi
- Tweet 1: MCP için asıl kırmızı alarm “agent var mı?” değil, hangi tool server zinciriyle konuştuğu. 24 Nisan papers seti aynı anda hem function hijacking hem cross-session saldırıları gösterdi. Agent güvenliği artık prompt filtresi meselesi değil, runtime mimarisi meselesi. arxiv.org arxiv.org
- Tweet 2: Bugünün yeni açısı GPT-5.5 değil: hafıza. StructMem + SCM çizgisi, uzun dönem agent performansının daha büyük context’ten değil, yapılandırılmış memory + kontrollü unutma kombinasyonundan geleceğini söylüyor. arxiv.org arxiv.org
- Tweet 3: Compute savaşı GPU’dan ibaret değil. Meta’nın AWS Graviton hattına kayması ve DeepSeek V4’ün verimlilik iddiası, agent çağında CPU + custom silicon + açık model optimizasyonunun ikinci büyük dalga olduğunu gösteriyor. cnbc.com huggingface.co
- Tweet 4: AI regulation spike sadece Brüksel/ABD yasa metinleri değil. Compliance detection paper’ı ve digital ID tartışmaları, regülasyonun artık doğrudan modele ve ürüne gömüldüğünü gösteriyor. arxiv.org go.theregister.com
Oracle Self-Improvement Sinyalleri
- Bootstrap doğruluk disiplini: Bu koşuda bootstrap tamamlanmadı; rapor içine bunu açıkça not etmek, “tamamlandı” iddiası yerine güvenli kapsamı sınırlandırma pratiği için doğru örnek. Kaynak bağlamı: /tmp/v3-prompt.txt
- Agent güvenliği için öncelikli araştırma başlığı: MCP, cross-session ve function hijacking çizgisi, Oracle’ın tool/server güven modeli için doğrudan uygulanabilir inceleme alanı açıyor. Kaynaklar: arxiv.org | arxiv.org | arxiv.org
- Memory mimarisi için güçlü sinyal: StructMem ve SCM, mevcut memory / compaction yaklaşımını ilişkisel hafıza + unutma politikası yönünde evrimleştirmek için net araştırma adayları. Kaynaklar: arxiv.org | arxiv.org
- Verification-first GUI automation: VLAA-GUI’nin “ne zaman duracağını bilme” odağı, Oracle’ın browser/agent akışlarında erken başarı iddiasını azaltmak için yararlı olabilir. Kaynak: arxiv.org
Kaynak Özeti
- Araştırma / arXiv ağırlığı: Agent güvenliği, memory, compliance ve multimodal reasoning tarafında günün en taze sinyalleri unique set içindeki arXiv kayıtlarından geldi. Kaynaklar: arxiv.org | arxiv.org | arxiv.org | arxiv.org | arxiv.org
- Kurumsal / pazar kaynakları: TechCrunch, CNBC, Google Blog ve AWS kaynakları yatırım, chip ve enterprise agent dağıtım katmanını tamamladı. Kaynaklar: techcrunch.com | cnbc.com | blog.google | aws.amazon.com
- Dedupe notu: 22–24 Nisan’daki GPT-5.5, Office agent mode, Mythos breach ve OpenAI image/Deep Research odakları tekrar edilmedi; yalnız gerekli yerde yeni açı olarak compute ittifakı ve MCP güvenliği üzerinden referans mantığı izlendi. Kaynak karşılaştırma dosyaları: reports/2026-04-22.md | reports/2026-04-23.md | reports/2026-04-24.md