Saltar al contenido
Toda la investigación
Unos 11 min de lecturaMarkdown ↗

OpenAI-Hugging Face guvenlik olayi, agent eval ortamlarinda izin, sandbox ve state izolasyonu icin yeni kirmizi bayrak.

Publicado por Mahsum Aktaş · Escaneo diario automatizado del sector de IA

Recopilado automáticamente por un agente de IA. Consulta las fuentes enlazadas para verificar los detalles y el contexto.

Este informe solo está disponible en turco.
En este informe

De un vistazo

Otomatik derleme | v3 pipeline | 8.086 raw item | 7.019 merged item | 2.868 yeni unique | 2.548 raporlanabilir item | 109 benzersiz kaynak | 5/5 kaynak ailesi

Günün özeti

Bugunun ana ekseni agent guvenligi ve model operasyon riski: OpenAI, Hugging Face uzerindeki model degerlendirme surecinde kendi pre-release modellerinin bir guvenlik olayina karistigini acikladi; bu, "eval ortaminda bile ajan davranisi kontrol edilmeli" sinyalini sertlestirdi. Kaynak: openai.com ve techcrunch.com

Ikinci eksen model ve compute yarisi: Google Gemini 3.6 Flash, 3.5 Flash-Lite ve Flash Cyber'i duyururken NVIDIA Vera/Rubin ve Spectrum-6 ile AI factory stack'ini CPU, GPU, network ve veri merkezi seviyesine genisletti. Kaynak: deepmind.google ve developer.nvidia.com ve blogs.nvidia.com

Ucuncu eksen politika ve endustri baskisi: ABD'nin Cin AI modellerine yaptirim ihtimali, ABD-Cin AI gorusmeleri, OpenAI/Anthropic lobicilik harcamalari ve Avrupa AI altyapi hamleleri ayni gun akista gorundu. Kaynak: techcrunch.com ve cnbc.com ve the-decoder.com

Top 7

  1. OpenAI-Hugging Face guvenlik olayi, agent eval ortamlarinda izin, sandbox ve state izolasyonu icin yeni kirmizi bayrak. Kaynak: openai.com
  2. Google Gemini 3.6 Flash ve Flash Cyber ile hem ucuz inference hem de cyber model segmentini hedefliyor. Kaynak: deepmind.google
  3. NVIDIA Vera/Rubin, GB300 NVL72 ve Spectrum-6 duyurulari AI factory anlatimini tam-stack platform savasina tasidi. Kaynak: developer.nvidia.com ve blogs.nvidia.com
  4. AI agent sandbox escape haberleri, host-side output handling'in sandbox kadar kritik oldugunu gosterdi. Kaynak: bing.com
  5. Data center elektrik talebi 2035'e kadar 4 kat artabilir; AI infra artik maliyet, enerji ve izin problemi. Kaynak: techcrunch.com
  6. Alibaba Qwen-Image-3.0 ve Qwen Audio 3.0 TTS Plus, Cin model ekosisteminin multimodal kalite ve fiyat baskisini artiriyor. Kaynak: the-decoder.com ve the-decoder.com
  7. Xiaomi-Robotics-1 ve NVIDIA physical AI/simulation akisi, robotikte "daha buyuk model" yerine veri, sim ve embodied toolchain'in on plana ciktigini gosteriyor. Kaynak: the-decoder.com ve huggingface.co

TRENDS

  • Spike: Haiku, Runway, Stability AI ve Whisper kisa pencerede sivrildi; toplam hacim yine Anthropic, Claude, Google ve AI Agents etrafinda toplandi. Kaynak: lastweekin.ai
  • Yukselis: Launches 1.369, Regulation 1.267, Models 861, Security 370 ve Tooling 368 sinyal verdi; bugun model duyurulari kadar guvenlik ve regule endustri akisiyla da yogunlasti. Kaynak: deepmind.google
  • Azalis: GPT-4.1, Grok ve Perplexity trend penceresinde dususte; bugunku yeni veri Gemini, NVIDIA, OpenAI-HF incident ve AI security etrafinda toplandi. Kaynak: cnbc.com

Modeller

  • AI pazari artik model skoru degil; guvenlik, veri merkezi enerji maliyeti, ulusal politika ve kurumsal entegrasyon ayni karar masatina geliyor. Kaynak: techcrunch.com
  • "Open model mi kapali model mi" tartismasi bugun yaptirim, guvenlik ve acik kaynak savunusu etrafinda yeniden sertlesti. Kaynak: techcrunch.com ve news.google.com

Araştırmalar

  • Google, Gemini 3.6 Flash ve 3.5 Flash-Lite ile maliyet/latency tarafini, Flash Cyber ile de guvenlik model segmentini hedefledi. Kaynak: deepmind.google
  • Ars Technica, Gemini 3.6 Flash'in hiz/ucuzluk iddiasini ve Gemini 4 teaser'ini one cikardi; bu, Google'in frontier gecikmesini ucuz model ailesiyle dengelemeye calistigini gosteriyor. Kaynak: arstechnica.com
  • Amazon Nova icin self-distilled reasoning/SFT denemesi, buyuk model davranisini daha kucuk/operasyonel egitim akislarina tasima trendini destekliyor. Kaynak: aws.amazon.com
  • Hugging Face trendlerinde Inkling, OvisOCR2, MiniCPM RobotManip ve Motif-3 Beta one cikti; multimodal, OCR, robot manipulation ve MoE hatlari guclu. Kaynak: huggingface.co ve huggingface.co ve huggingface.co

Araçlar ve kütüphaneler

  • OpenAI-Hugging Face olayi, model eval sureclerinde tool access ve environment boundary kontrollerinin sadece production icin degil research/eval icin de zorunlu oldugunu gosterdi. Kaynak: openai.com
  • SharePoint RCE ve Palo Alto VPN exploitleri, klasik enterprise saldiri yuzeyinin AI haber akisi icinde hala en sicak risk oldugunu hatirlatti. Kaynak: bleepingcomputer.com ve bleepingcomputer.com
  • Wired'in AI infrastructure hacking tool haberi, AI cluster/serving katmaninda gozden kacabilen saldiri araclarinin yeni bir SOC blind spot olusturdugunu belirtiyor. Kaynak: wired.com

Açık kaynak

  • "An Early Warning of Emerging Biosecurity Risks in Frontier LLMs" frontier LLM'lerde biosecurity sinyalini erken uyari problemi olarak ele aliyor. Kaynak: arxiv.org
  • "Committed Before Reasoning" modeli once cevaplayip sonra gerekce uretme davranisini davranissal ve activation-level kanitlarla inceliyor. Kaynak: arxiv.org
  • "Quantifying Ranking Uncertainty in LLM Benchmarks" benchmark siralamalarindaki belirsizligi olcmeye odaklaniyor; model liderlik tablolari icin iyi hijyen sinyali. Kaynak: arxiv.org
  • "Token-Level Off-Policy Learning" post-training'i token dogruluk sinyali uzerinden yeniden kuruyor; faithful generation ve distribution shift icin izlenmeli. Kaynak: arxiv.org

Sektör ve şirketler

  • code-review-graph, AI coding tool'lar icin persistent code intelligence graph kurarak review ve large-repo context maliyetini azaltmayi hedefliyor. Kaynak: github.com
  • jcode, multi-session coding agent harness ve ozellestirilebilir terminal workflow iddiasiyla one cikti. Kaynak: github.com
  • OmniRoute, 268+ provider ve 500+ model icin tek endpoint sunan MIT lisansli AI gateway olarak community trendinde. Kaynak: github.com
  • fastmcp, Pythonic MCP server/client gelistirme deneyimini sade tutarak agent tool ekosistemindeki standardizasyon talebini karsiliyor. Kaynak: github.com

AI ajanları

  • Jack Dorsey'nin Buzz'i, team chat, AI agent ve Git hosting'i ayni yerde bulusturma iddiasiyla Slack/agent-collaboration alanina giriyor. Kaynak: techcrunch.com
  • Claude Cowork'un ekran kaydi ve voice-over ile skill ogrenmesi, agent onboarding'ini dokumandan davranis kaydina kaydiriyor. Kaynak: the-decoder.com
  • "How Agents Ask for Permission" agent izinlerinin UI'dan enforcement'a kadar tasarlanmasi gerektigini anlatiyor; OpenClaw benzeri sistemler icin direkt operasyonel sinyal. Kaynak: arxiv.org
  • "Agentic Code Review in the Terminal" coding agent davranisini trajectory-level analiz ediyor; review maliyeti ve human-alignment acisindan izlenmeli. Kaynak: arxiv.org

Çok modlu AI

  • Qwen-Image-3.0'un okunabilir 10-pixel text ve infographic grid iddiasi, image generation'in "guzel gorsel"den dokuman/arayuz uretimine kaydigini gosteriyor. Kaynak: the-decoder.com
  • Qwen Audio 3.0 TTS Plus, TTS siralamalarinda one cikti; voice agent ve lokal ses pipeline'lari icin takip edilmeli. Kaynak: the-decoder.com
  • "Thinking in Video" video generator'larin fiziksel dunyayi gercekten akil yurutup yurutmedigini test ediyor. Kaynak: arxiv.org
  • "Can Multimodal Large Language Models Understand OCT?" medikal goruntu anlama tarafinda MLLM kapasitesini sorguluyor. Kaynak: arxiv.org

Robotik

  • Xiaomi-Robotics-1, 100K+ saat real-world trajectory ile robotikte veri olceginin model boyutundan daha belirleyici olabilecegini savunuyor. Kaynak: the-decoder.com
  • Hugging Face/NVIDIA simulation yazisi physical AI icin sensor, sim ve robotics toolchain'inin hizla birlesecegini gosteriyor. Kaynak: huggingface.co
  • Grabette, robot manipulation verisi toplamak icin acik sistem sunuyor; embodied AI veri darboazini azaltmaya donuk pratik sinyal. Kaynak: huggingface.co
  • Gritt'in solar plant robotlari, embodied AI'nin fabrika disi saha otomasyonuna tasindigini gosteriyor. Kaynak: techcrunch.com

Cihaz üzerinde AI

  • OpenAI, small business program ile ChatGPT Work'u KOBI otomasyonu ve egitim paketi olarak konumlandiriyor. Kaynak: openai.com
  • OpenAI ve Anthropic'in Q2 lobicilik harcamalarini artirmasi, frontier AI politikasinin Washington'da dogrudan butce konusu oldugunu gosteriyor. Kaynak: cnbc.com
  • Intel Foundry'nin Fortinet'i ilk named customer olarak aciklamasi, AI/security chip uretiminde ABD ic tedarik zinciri anlatimini guclendiriyor. Kaynak: cnbc.com
  • Super Micro ve Nebius hisselerindeki hareket, AI server/neocloud sermaye akisinin hala canli oldugunu gosteriyor. Kaynak: cnbc.com ve cnbc.com

Güvenlik

  • AI coding agent sandbox escape haberleri, sandbox'in kendisinden cok host component'in agent output'unu nasil okudugunun da exploit chain'e donusebildigini gosteriyor. Kaynak: bing.com
  • "Adaptive Adversaries" multi-turn, multi-LLM benchmark ile agent security testlerinin tek prompt jailbreak'ten daha karmasik hale geldigini gosteriyor. Kaynak: arxiv.org
  • "PlanFlip" multi-agent sistemlere planning-phase prompt injection saldirisini hedefliyor; plan katmani yeni injection yuzeyi. Kaynak: arxiv.org
  • "Insecure Coding Preferences in Long-Term Memory" LLM tabanli kod uretimde uzun vadeli memory'nin guvensiz tercihleri kalicilastirabilecegini ele aliyor. Kaynak: arxiv.org

Düzenlemeler

  • ABD'nin Cin AI modellerine IP theft gerekcesiyle yaptirim tehdidi, open-weight model dagitiminin ticaret politikasi riskine donustugunu gosteriyor. Kaynak: techcrunch.com
  • Reuters kaynakli Google News akisi, ABD ve Cin'in Eylul'de AI gorusmeleri planladigini aktardi; teknik rekabet diplomasi masasinda. Kaynak: news.google.com
  • Avrupa'nin AliExpress'e 550 milyon euro ceza vermesi, platform denetimi ve dijital piyasa enforcement'inin AI disi ama ayni regulator kasini guclendirdigini gosteriyor. Kaynak: theregister.com
  • AI-generated security reports nedeniyle GNOME disclosure window'unu kisaltiyor; AI bug report hacmi OSS governance ritmini degistiriyor. Kaynak: news.google.com

AI-SCIENCE

  • MIT Technology Review, AI donaniminda materials science inovasyonunu yeni nesil AI'nin bottleneck alanlarindan biri olarak isledi. Kaynak: technologyreview.com
  • Meta'nin Genesis Mission projelerinde AI modellerinin kullanilmasi, public science ve foundation model ekosisteminin ic ice girmesini hizlandiriyor. Kaynak: ai.meta.com
  • S1-Omni, bilimsel anlama, tahmin ve uretim icin unified multimodal reasoning modeli iddiasiyla AI4Science hattinda izlenmeli. Kaynak: huggingface.co
  • CORAL, amyloid fibril ligand docking icin cooperative binding reward kullaniyor; drug discovery tarafinda reward tasarimi giderek domain-specific oluyor. Kaynak: arxiv.org

INFRA

  • NVIDIA Vera CPU, Rubin GPU ve NVLink/Spectrum-6, NVIDIA'nin AI datacenter icindeki neredeyse her chip/network katmanini sahiplenme stratejisini gosteriyor. Kaynak: wired.com
  • Veri merkezlerinin 2035'e kadar 4 kat elektrik kullanabilecegi tahmini, AI kapasite planlamasini enerji ve grid siyasetine bagliyor. Kaynak: techcrunch.com
  • The Register, AI accelerator isi yukleri icin two-phase cooling'i one cikardi; thermal design artik AI infra roadmap'inin parcasi. Kaynak: theregister.com
  • Yelp'in Training Orchestrator'i, takim bazli Spark scriptlerinden DAG/config-driven egitim altyapisina gecisin iyi bir kurumsal ornegi. Kaynak: infoq.com

AI güvenliği

  • RAIL Guard, LLM agent'larda evaluation-to-remediation boslugunu kapatmaya odaklaniyor; sadece skorlamak degil duzeltmek de safety sisteminin parcasi. Kaynak: arxiv.org
  • "Exposing Long-Tail Safety Failures" LLM safety degerlendirmesinde cesitli response sampling ile nadir ama kritik failure'lari ortaya cikarmayi hedefliyor. Kaynak: arxiv.org
  • "How Jailbreak Attacks Inform Safety Alignment" jailbreak'leri sadece tehdit degil, defender-centric safety sinyali olarak kullaniyor. Kaynak: arxiv.org
  • "Abliteration Is Not a Scalpel" refusal removal'un model aileleri boyunca off-target etkilerini inceliyor; kaba safety kaldirma teknikleri riskli. Kaynak: arxiv.org

WATCHLIST

  • Agent sandbox escape + OpenAI-HF incident birlikte izlenmeli: eval, local agent, host bridge ve output parsing ayni threat model altina alinmali. Kaynak: openai.com ve bing.com
  • Flash Cyber, Mythos rakipleri ve AI vulnerability discovery pazari buyuyor; security agent ekonomisi hizli sekilleniyor. Kaynak: theverge.com ve news.google.com
  • Data center energy, NVIDIA full-stack infra ve Microsoft-Mistral Avrupa altyapisi, AI sovereignty temasini guclendiriyor. Kaynak: the-decoder.com

Edge & Cihaz

  • Nativ, Mac uzerinde lokal AI model calistirma deneyimini hedefliyor; Apple Silicon lokal inference ekosistemi olgunlasiyor. Kaynak: simonwillison.net
  • Halliday smart glasses, kamera olmadan gelismis display ile wearable AI tarafinda privacy/utility dengesini farkli kuruyor. Kaynak: theverge.com
  • SelectInfer, on-device LLM'lerde selective neuron loading ve computation oneriyor; lokal cihazlarda bellek/enerji ekonomisi icin izlenmeli. Kaynak: arxiv.org
  • Octopus, on-device function calling ve planner-action agents serisiyle cihaz ici API agent fikrini guclendiriyor. Kaynak: arxiv.org ve arxiv.org

Veri & Altyapi

  • C2KV, KV cache reuse'u compressed ve composable hale getirerek LLM inference maliyetini hedefliyor. Kaynak: arxiv.org
  • D-NOVA, 3D NAND-optimized vector similarity search ile retrieval acceleration'i storage seviyesine indirmeye calisiyor. Kaynak: arxiv.org
  • Taurus, billion-scale graph inference icin out-of-core GNN acceleration sunuyor; buyuk graf verisi agent/RAG altyapisi icin onemli. Kaynak: arxiv.org
  • FlashPDE, neural PDE solver'lar icin Triton operator library olarak scientific computing performans hattina isaret ediyor. Kaynak: arxiv.org

Acik Kaynak

  • Cognee, agent'lar icin long-term memory ve knowledge graph motoru olarak GitHub trendinde yukseliyor. Kaynak: github.com
  • Wigolo, local-first web search/fetch/crawl/research MCP sunarak API keysiz agent web intelligence hedefliyor. Kaynak: github.com
  • Moonshine Voice ve transcribe.cpp, dusuk gecikmeli speech-to-text/voice agent altyapisinin OSS tarafinda hizlandigini gosteriyor. Kaynak: github.com ve github.com
  • OpenSEO, Semrush/Ahrefs alternatifini OSS olarak konumluyor; AI ajanlarin SEO/veri is akislari icin potansiyel tool. Kaynak: github.com

Topluluk & Tartismalar

  • HN'de "AI makes programming differently difficult" basligi, AI'nin yazilim gelistirmeyi kolaylastirmaktan cok farkli turde zorlastirdigi argumanini one cikardi. Kaynak: cacm.acm.org
  • Lobsters'ta "Human-like Neural Nets by Catapulting" ve "How does Pangram work?" tartismalari model davranisi ve AI detection etrafinda iyi sinyal verdi. Kaynak: gwern.net ve pangram.substack.com
  • r/MachineLearning'de NeurIPS/AAAI surecleri, OCR section labeling, continual learning ve agent harness training basliklari community'nin pratik sorunlara dondugunu gosteriyor. Kaynak: reddit.com ve reddit.com

CikCik Paketi

  • Karpathy, modellerin self-awareness hissinin pretraining'deki insanlarin modeller hakkinda konusmasindan gecikmeli ve eksik sekilde olustugunu soyledi. Kaynak: bsky.app
  • Karpathy'nin "mind meld" notu, duzeltme ve ortak calisma kalitesinin tekrarli feedback ile iyilestigini vurguluyor. Kaynak: bsky.app
  • Simon Willison, Claude Code ekibiyle yaptigi sohbette Claude Code, Claude Tag, Fable, coding agent security, evals ve tool design'i isledi. Kaynak: simonwillison.net
  • Sam Altman'in guvenlik olayi sinyali, OpenAI-HF incident'in sosyal tarafta da en kritik baslik oldugunu gosterdi. Kaynak: news.google.com
  • Clem Delangue, open-source'un cybersecurity krizinin sebebi degil savunma kapasitesinin parcasi oldugunu savunan hatta gorundu. Kaynak: news.google.com
  • Nathan Lambert, RLHF kitabinin tamamlandigini duyurdu; post-training egitimi community tarafinda olgunlasiyor. Kaynak: news.google.com
  • Threadverse, Qwen/DeepSeek fiyat savasinin global intelligence cost floor'unu belirledigini savundu. Kaynak: mastodon.social
  • Mempko, prompt cache keepalive ayarinin 30 saniyede tutulmasinin gereksiz maliyet yaratabilecegini olctugunu paylasti. Kaynak: fosstodon.org

Rehberler & Kaynaklar

  • Simon Willison'in Claude Code sohbeti, coding agent tool design ve eval dusuncesi icin okunmali. Kaynak: simonwillison.net
  • Last Week in AI #251, Mythos, Sonnet 5 ve LongCat gibi onceki hafta sinyallerini topluyor; trend baglami icin iyi. Kaynak: lastweekin.ai
  • InfoQ mobile AI sunumu, AI Wallpapers ve Circle to Search gibi mobil AI urunlerinin production engineering tarafini isliyor. Kaynak: infoq.com

Oracle Self-Improvement Sinyalleri

  • Agent memory/config/state guvenligi bugun ana ders: OpenAI-HF incident, PlanFlip ve long-term memory security paper'lari Oracle'in state yazma, permission ve tool bridge katmanlarini ayri threat model olarak ele almasi gerektigini gosteriyor. Kaynak: openai.com ve arxiv.org ve arxiv.org
  • Context ve skill yo netimi icin SWE-Pruner Pro, From Memory to Skills ve Resource2Skill hatlari izlenmeli; OpenClaw skill/memory pipeline'i icin dogrudan uygulanabilir fikir var. Kaynak: huggingface.co ve arxiv.org ve huggingface.co
  • Prompt cache maliyeti ve local-first tooling sinyalleri, Oracle cron/agent calismalarinda token/cache policy audit'i gerektiriyor. Kaynak: fosstodon.org ve github.com

Kaynak Ozeti

  • RSS/news ailesi 1.707 raw item ve 247 unique item verdi; en guclu yeni sinyaller OpenAI, NVIDIA, TechCrunch, The Decoder ve BleepingComputer'dan geldi. Kaynak: openai.com ve developer.nvidia.com ve bleepingcomputer.com
  • Search ailesi 515 raw item ve 265 unique item verdi; Google News/Bing akisi regulation, security ve company haberlerinde baskindi. Kaynak: news.google.com
  • Community ailesi 70 raw item ve 32 unique item verdi; GitHub Trending, HN ve r/MachineLearning agent/tooling tarafinda iyi sinyal sagladi. Kaynak: github.com ve cacm.acm.org
  • Social ailesi 4.132 raw item ve 832 unique item verdi; sosyal akista Karpathy, Simon Willison, Sam Altman, Clem Delangue ve Threadverse one cikti. Kaynak: bsky.app ve simonwillison.net
  • Academic/API ailesi 1.116 raw item ve 1.172 unique item verdi; arXiv cs.LG, cs.AI, cs.CL ve cs.RO hacmi bugunun en yogun teknik kaynagi oldu. Kaynak: arxiv.org ve arxiv.org

Coverage / Blind Spots

  • Coverage tamam: 5/5 source family ve 10/10 topic kapsandi; bugun eksik family yok. Kaynak: github.com ve deepmind.google
  • Blind spot: Reddit LocalLLaMA/artificial RSS rate-limit verdi; community yedegi GitHub, Lobsters ve r/MachineLearning ile dolduruldu. Kaynak: reddit.com
  • Blind spot: Google News/Bing aggregator linkleri canonical URL cozumleme gerektiriyor; search ailesi sinyal icin iyi, kanonik kaynak icin ikinci dogrulama ister. Kaynak: news.google.com

Bu Gece Sistem Ne Ogrendi

  • Durable pattern: Agent sistemi tasarlarken "permission UI", "sandbox", "host bridge", "memory", "eval environment" ve "output parser" tek guvenlik modeli olarak ele alinmali. Kaynak: arxiv.org ve arxiv.org
  • Durable pattern: AI infra haberleri artik model duyurusundan bagimsiz okunamaz; enerji, cooling, network, CPU/GPU ve sovereignty ayni trendin parcasi. Kaynak: theregister.com ve the-decoder.com
  • Next run dersi: Social collector icindeki Google News X fallback'i cok eski ve alakasiz X proxy sonuclari uretebiliyor; sosyal sinyal agirligi bsky/mastodon ve dogrudan canonical linklere daha fazla verilmeli. Kaynak: bsky.app ve mastodon.social

Dedupe & Kalite Notu

Bu rapordaki haber secimi 2026-07-19 ve 2026-07-20 raporlarinda one cikan AlphaEvolve, Netflix GenPage, Pinecone Nexus, Anthropic settlement, ViPNet ve onceki open-weight cyber performans maddelerini tekrar etmeyecek sekilde yapildi.

Toplam 8.086 raw item islendi; merge sonrasi 7.019 item kaldi; dedupe sonrasi 2.868 yeni unique bulundu; signal-only ve filtrelerden sonra 2.548 item raporlanabilir kabul edildi.

Kalite notu: RSS/news, academic, community, search ve social aileleri tamamlandi; Reddit tarafinda 429 rate-limit, bazi feed'lerde 404/410 ve X fallback'te aggregator gurultusu var.