• פרסם תאריך
    מאי 14, 2025
  • שיתוף

"Nöronlar hayatta kalmak için birbirleriyle sürekli rekabet içindedir. Her nöron ve nöronlar arasındaki her bağlantı, kaynaklar için bir diğeriyle mücadele halindedir. Bu sınır savaşlarü beynin de kişinin deneyim ve hedeflerini beynin yapısına yansıtacak şekilde sürekli yeniden çizilir.

Bir muhasebeci piyanist olmak üzere kariyerini bırakırsa parmaklarına ayrılmış olan nöral alanlar genişleyecek, mikroskopi uzmanı olmaya karar verirse görme korteksi, aradığı küçük ayrıntıolaseki daal özelliği geliştirecektir."

קאנלי דברה, דיוויד איגלמן

איך זה התחיל?

איך זה התחיל?

Sadece bir yazıda tüm yapay zeka çalışmalarını anlatmak takdir edersiniz ki mümkün değil. Yine de olabildiğince geçmişe gidip bugüne kadar kat ettiğimiz yolu ifade etmeye çalışacağız.

İlk başlangıç ​​noktamız bundan kabaca 13 yıl önce ImageNet הוא סימלי yarışmada adını duyuran AlexNet modeli olacak. Basit bir resim sınıflandırma modeli bile olsa AlexNet'in 2012 yılında bize gösterdiği şey GPU (Graphics Processing Unit) yani ekran kartlarının, derin öğrenme modelinin eğitiminde kullanılabilece:

13 yıl sonra bugün geldiğimiz noktada dünyanın önde gelen ekran kartı üreticisi NVIDIA dünyanın en değerli şirketi oldu. [2]Devamındaki süreçte ekran kartlarının kabiliyetleri ve alan ilgi arttıkça daha büyük yani daha çok parametreli ve daha çok gizli katman içeren modell hayatımıza girmeye başladı.

Böylece daha kaliteli görüntü, sinyal, video modeli görmeye başladık. Büyük modelleri orijinalinde yer almayan görevler için az miktarda veri ve işlem gücüyle eğitmeye dayalı עדין, העברת למידה gibi kavramlar hayatımıza girdi. Lakin doğal dil için büyük bir model üretmek hala mümkün değildi. 

הבעיה היא yolculuğumuzun bir sonraki önemli adımı olan Attention Is All You Need başlıklı makale çözülmüş oldu. 8 yıl önce Google'ın yayınladığı makale bizi Transformer isimli kavram ile tanıştırdı. Artık “büyük” diye ifade edebileceğimiz doğal dil modeli yani LLM'leri eğitebiliyorduk. [4]

2022'nin sonlarında ise (yani bundan sadece 3 yıl önce) ise belki de en önemli adımlardan biri OpenAI tarafından atıldı ve o güne kadar eğitilen hiçbir modelin gösteremediği bir rationaling (muhaymeen gambling) פלטפורמת ChatGPT בעבר.

Her ne kadar modelin görevinin sabit olduğu ve eğitim öncesinde belirlendiği klasik makine öğrenmesi ve derin öğrenme modellinin aksine modelin görevinin doğal dil ile değiştirilebildiği few-shot/dailki modelin sun ve GPT-3 üzerinden כוונון עדין edilen GPT מודלים, bizi tom anlamıyla משימה מחדש ile tanıştırdı. האם אמה בו נדן בו כדר אנמלי? 

ChatGPT'den sadece birkaç yıl önce bir problemi çözmek için eğitilen her model sadece ilgili model üzerinde çalışabilyordu. Mesela 2020 yılında Kaggle üzerindeki ניתוח סנטימנטים של ציוצים yarışmasının temel amacı olan, tweet'lerdeki duyguyu ifade eden cümlecikleri ayıran modelin tamamı, sadece bu sorunu çözmek üzertiline üzertiline. Bu modellerden birini alıp başka bir doğal dil görevinde kullanamazdınız. Örneğin tweet'in hangi dilde yazıldığını modele soramazdınız. Görevi değiştirmenin tek yolu yeniden eğitmekti. Yani konuyla ilgili en az bir uzmana ihtiyaç vardı. ChatGPT ile bu durum ortadan kalktı. Artık bir doğal dil görevini yapmak için bir model eğitmeye ihtiyacınız yoktu. ChatGPT modelinin görevini doğal dil ile (kabaca prompt ile) yeniden değiştirebiliyordunuz. İster tweet'in dilini sınıflandırın, ister duygu durumunu. Artık bir uzmana ihtiyaç yoktu. [5]

כַּיוֹם

Evet artık bir uzmana ihtiyacımız yok. Bilgisayar bilimci olmak zorunda değilsiniz. Kodlama bilmeye de gerek yok. לתקן? להעביר למידה? Eğitim? Artık hiçbirine gerek yok. Yazıp konuşabilyorsanız bu yeterli. Öyle ki OpenAI 1 milyar kullanıcıya ulaşmış durumda yani tüm dünyanın 8'de 1'ine. Bu da demek oluyor ki LLM'ler artık insan hayatının bir parçası haline geldi. [6]

Peki son zamanlarda LLM alanında ne gibi yenilikler oldu?

Peki son zamanlarda LLM alanında ne gibi yenilikler oldu?

LLM'lerin “zeka”sı artık kelime tamamlama becerisinden çok çok-adımlı akıl yürütme kabiliyetiyle değerlendiriliyor. Araştırmalar, zincir-düşünce sistemlerinin küçük göstergelerle bile karmaşık problemi çözme oranını dramatik biçimde artırdığını ortaya koyuyor. Bu yüzden OpenAI, Eylül 2024'te tanıttığı o1 serisini "daha uzun düşünüp sonra cevap veren" ilk model olarak konumlandırdı. Devasa parametre sayıları, exaFLOPS ölçekli eğitim kümeleri ve milyarlarca token, 2020-2024 arası inovasyonun mottosu oldu. Talebin tetiklediği bu dönem, Nvidia'nın piyasa değerini dokuz ayda 1 trilyon $'dan 3 trilyon $'a taşıdı; öyle ki analistler şirketi "AI çağının petrol devi" diye tanımlamaya başladı. [7] Durumu daha Iyi kavrayabilmek için şu grafikleri inceleyelim:

Epoch.ai'den aldığımız ilk grafikte özellikle derin öğrenme tekniğinin popüler olması ile birlikte model eğitmek için gereken işlem gücünün (FLOP cinsinden) yılda ortalama 4.6 kattıebilınıuz gör. Kısaca her yıl 5 kat daha fazla işlem gücüne ihtiyaç duyuyoruz. [8]

SEC(Securities and Exchange Commission)'den aldığımız bu grafikte ise, 2019–2024 döneminde NVIDIA hissesinin birikimli toplam getirisinin hem S&P 500 hem de Nasdaq 100 endekslerini ezici biçimde geride bıraktıyorı. Yani, son beş yılda NVIDIA'ya yatırım yapanlar, geniş piyasa endekslerine yatırım yapanlara kıyasla katbekat daha yüksek bir getiri elde etmiş durumda. [9] 

İki grafikte açıkça gösteriyor ki, yapay zeka uygulamaları hızla yaygınlaştıkça, bu teknolojiyi mümkün kılan donanım ve altyapıya olan talep de katlanarak artıyor. Bir yandan modelin eğitimi için ihtiyaç duyulan işlem gücü sürekli yükselirken, diğer yandan bu gücü sağlayan NVIDIA gibi çip üreticlerinin değeri de benzer bir hızla artıyor.

Fakat bu trendi bozan bazı özel gelişmelerden de bahsetmemiz gerek. Örneğin 2025'in başında Çin merkezli DeepSeek, açık kaynaklı Reasoner-R1 ailesini ve dakikası 0,55 $/M token gibi oldukça rekabetçi fiyatlandırma modeliyle piyasaya girerki den, sektörmekansliye taşıdığını gösterdi. דגם רגיל של OpenAI GPT-4o בעלות של 1 מיליון פלט (צ'יקי) אסימון 10 $ סמל, DeepSeek R1 עולה 2,19 $'a יאפ; gece indirimiyle bu rakam 0,55 $'a kadar düşürdü. Bu durum Avrupa'daki girişimlerin çoğunun birkaç dakikada OpenAI'den DeepSeek'e göç etmesine neden oldu çünkü DeepSeek ile maliyetleri 40 kata kadar düşürmeyi başardılar. [10]

DeepSeek'in rakipleri ile arasındaki fiyat uçurumunu gösteren bir infografik.

Ancak bu başarının ardında ki tek faktör sadece uygun fiyatlandırma değildi. DeepSeek'in yayınladığı rapor, 671 milyar parametrie sahip R1 modellerinin nasıl üst düzey muhakeme yeteneği sağladığını detaylı biçimde ortaya koyuyordu. R1'in, o güne kadar alanın en güçlü kapalı modeli olan OpenAI GPT-4o ile rekabet edebilen sonuçlar sunması, sektörde "daha fazla işlem gücü eşittir daha iyi muhakeme" anlayışını ciddi ciddi. Guardian'ın "DeepSeek Paniği" başlıklı haberinde vurguladığı gibi, R1'in kamuya açılması Nvidia hisselerinin ilk işlem gününde %18 değer kaybederek yaklaşık 600 milyar tarhi birlına dına oldu. [11]

Detaylara inip ve DeepSeek'in paylaştığı makaleyi göz gezdirdiğimiz zaman DeepSeek'in maliyetleri kısmak için ciddi anlamda optimizasyon yaptığını görebiliyoruz. Örneğin sadece Hopper mimarisine sahip kartlarda çalışan FlashMLA ki burada DeepSeek'in elinde iyi miktarda הופר mimarisine sahip H800 (NVIDIA tarafından çin pazarına sunulan H100 muadili ekran kartı) bulunduğinğu kartı דיקט צ'קלים. Ya da MoE (תערובת של מומחים) olarak adlandırılan ve modelin sahip olduğu toplam 1 milyar parametre içinden her işlemde yalnızca küçük bir bölümü (671 milyar parameter gibi) aktif olarak kullanılarak malliçet hesölla yöntemler örnek verilebilir. [37]

Son olarak DeepSeek-R1 'in etkileyici performansını küçük ve ekonomik modelle aktarmak için kullanılan distilasyon (זיקוק) yöntemi de değinmeden geçmeyelim. Eğitim ve çalıştırma maliyetlerinde kayda değer optimizasyonlar yapılmış olsa da R1 hala 671 milyar parameter içeriyor yani sadece çalıştırmak için bile >400GB VRAM (4 bit lazmınızılation) 4090 sadece 24GB VRAM içerdiğine dikat çekelim). Bu durum bizati farkında olan DeepSeek kaliteli ama daha küçük model eğitmek amacıyla, hali hazırda güçlü ve yüksek kapasiteli R1 modelinin ürettiği yine yüksek kaliteli yaklaşan rkull 800 daha küçük modelin eğitimi için kullanmış. Bu şekilde 70, 32, 14, 8, 7 ve 1,5 milyarlık distile edilmiş R1 modelini paylaşarak DeepSeek herkese imkanı yettiği ölçüde kaliteli bir R1 thinking modeli sağlamış oldu. [13]

DeepSeek'in detaylarından sonra geldiğimiz noktayı kabaca özetlersek 3 yıl önce ChatGPT ile birlikte doğal dil ile modele ya da artık daha genel bir isim ile yapay zekaya görev atayabilir hale geldik. Başlangıçta bunlar basit görevlerdi. דהא önce verdiğimiz örnekler gibi mesela bir metnin dilini sınıflandırmak ya da farklı bir stil ile yeniden yazdırmak. Devamında ise beklentileri karşılamak adına birçok yeni teknik ortaya çıktı ve yapay zekanın tek seferde tek bir prompt ile yapabildiği görevlerin kapasitesi arttı. Bunu şu grafikte çok net görebiliriz [14]:

2023 yaz aylarında standard bir matematik testinde %30 basarılı olan model artık %90 seviyesinde basarılılar. Daha iyi נימוק yani muhakeme yeteneğine sahipler. Daha karmaşık problemleri çözebiliyorlar.

Peki bu bizim için bir durak noktası mı? אלבט דייל. İnsanlık olarak yapay zekadan beklentimiz bugünden daha iyi bir muhakeme yeteneği. Öyle ki bir insanla aynı seviyede. Şu an için eğitilmiş insan ile aynı seviyede çeşitli (genel) ve uzmanlıkta bir yapay zeka mevcut değil. Şu anda uzmanlar bu seviyeyi AGI (בינה כללית מלאכותית) yani yapay genel zeka olarak isimlendiriyorlar. Bu seviyede ki bir yapay zeka, kabaca bir insanla aynı seviyede muhakeme yeteneğine sahip olacak ve üretildiği an muhtemelen yapay zeka tarihinde ki yeni kırılma noktası olacak.

Burada muhakeme yeteneğini kabaca bir başarı ölçütü olarak görebiliriz. Ne kadar yüksek muhakeme yeteneği o kadar karmaşık problemlerin, görevlerin çözümü. Biz de Galaksiya olarak, bunlardan biri olan RAG'a (Retrieval Augmented Generation) ve devamında mevcut modelden daha yüksek muhakeme yeteneğinin elde edilmesi üzerine odaklandık. MindGraph isimli Knowledge Graph (bilgi çizgesi) tabanlı bir yapı geliştirdik ve kayda değer sonuçlar elde ettik.

מיינדגרף

מיינדגרף

Bu tanımı açıklamadan önce LLM'lerin hayatımıza girmesiyle iyice anlam kazanmış ve hala aktif olarak üzerine çalışılan konulardan biri olan RAG'ın (הדור המוגבר של אחזור) ne olduğmeliyniz. Daha önce de bahsettiğimiz gibi LLM'ler eğitildikleri verileri kullanarak girilen prompt'lara cevap üretebiliyorlar. Örneğin bir LLM'e "Avrupa'nın yüzölçümü nedir?" gibi bir soru sorarsanız doğru cevabı alırsınız (istisnalar dışında). Peki ya yarın avrupa kıtasının yüzölçümü değişirse? Hatta dinamik bir şekilde her gün değişmeye başlarsa? LLM'de bu bilgiyi nasıl güncelleyeceğiz? Başka bir örnek verelim. LLM'leri hayatımızın artık birçok alanında kullanabilyoruz. Sorular soruyoruz cevap alabiliyoruz. Peki ama sürekli değişen ya da halka kapalı olan (פרטי) veriler hakkında ki sorularımıza nasıl cevap alacağız? Mesela bir şirket yönetmeliği, finansallar ya da yasalar. Kısaca LLM'lerin פרטי ya da dinamik veriler hakkında doğru cevaplar üretmesini nasıl sağlarız?

İşte bu soruya şu an verilebilecek ilk cevap RAG. RAG'ın temel amacı sorulacak olan soruya uygun cevabı içeren veriyi soruyla birlikte prompt içerisinde vermek. Böylece ilgili veriyle modeli yeniden eğitmeden LLM veri ile ilgili sorulara cevap verebilir hale geliyor(En azından teoride). Ve evet bu yaklaşımın bazı zayıf noktaları var. Bunlardan en önemlisi חלון ההקשר מוגבל. חלון ההקשר kabaca bir LLM'in tek seferde girdi ve çıktı olarak işleyebileceği toplam token (bknz: Tokenization ) sayısı. Bizim için önemli olan kısım ise özellikle girdi yani input sınırı. Eski derin öğrenme modellerini düşünün. Bir örneklemin boyutu her zaman sabit idi. Örneğin bir CNN modelinde kullanılan bir resmin boyutu her zaman sabit olmak zorunda idi. Bu bugün de geçerli ve modelden modele göre değişiyor. אתה יכול להציע מודלים של GPT ל-128,000 סמלים לכל היותר. 75 kelimenin kabaca 100 token yaptığını düşünürsek bu da kabaca 250 sayfalık bir kitap yapar. יאני ביזים פרטי יא דא דינאמיק verimiz bundan daha büyük ise modele tek seferde veremeyiz. [15]

דיğer bir בעיה ise tüm veriyi modele verebildiğimiz durumlarda dahi her zaman doğru cevabı alamayabiliriz. Özellikle veriler düzensiz yani saf metinlerden oluşuyor ve sorduğumuz soru yüksek muhakeme yeteneği gerektiriyor ise. Bu durumu daha iyi ifade edebilmek için bir metafor kullanalım. Farz edelim ki bir insan uzmana 250 sayfalık bir kitap verip kitapta geçen isimleri alfabetik sırayla söylemesini isteyelim. Uzmanın tamamlaması gereken adımlar kabaca şu şekilde olurdu:

  1. Kitapta geçen tüm isimleri atlamadan tek tek bir yere not al.
  2. דהא סונרא לא אלינן tüm isimleri alfabetik olarak sırala.

Görüldüğü üzere bu sorunun çözümü tek bir adımdan oluşmuyor en azından makul bir çözüm için en az iki adıma dolayısıyla bu adımları oluşturmak için belli bir seviiyaneğ muhake i noch. 

Peki bu problemlerin üstesinden nasıl geleceğiz?

Birinci problemi çözmenin tek yolu veriyi bir şekilde הקשר חלון içine sığdırmaktan geçiyor. Yani veriyi bir şekilde kısaltmamız ya da filtrelememiz lazım ve bunu yaparken mümkünse sorunun cevabını içeren kısma zarar vermememiz lazım. Bu noktada sıklıkla tercih edilen yollardan biri vektörleri kullanmak [15]:

  1. Öncelikle metin chunk (küçük metin parçaları) bölünür.
  2. Ardından parçalar önceden eğitilmiş bir embedding modeli yardımıyla vektörlere dönüştürülür.
  3. Daha sonra bu vektörler bir veritabanında saklanır.
  4. Kullanıcı soru sorduğu zaman ilgili soruda vektöre dönüştürülür.
  5. Sorunun vektörüne en yakın (genelde kosinüs benzerliği kullanılıyor) olan k sayıda vektör getirilip soru ile birlikte LLM'e verilir.

Böylece metnin sorulan soruyla en alakalı parçaları filtrelenmiş ve context window'a sığmış olur. Vektör çözümü genel basit ve bu alanda sıklıkla kullanılan bir çözüm.

בעיית İkinci ise daha zor. Çünkü sorulan soruyu alt sorunlara parçalamayı ve alt çözüm adımları oluşturmayı gerektiriyor. Farkettiyseniz bu בעיה aslında daha önce de belirttiğimiz ve alanın üzerine yöneldiği yüksek muhakeme problemi ile aynı בעיה. Kabaca LLM'lerden nasıl daha yüksek muhakeme yeteneği elde edebiliriz? 

Doğal olarak bu alan üzerine çalışan neredeyse herkes bu בעיה üzerine eğilmiş durumda. Bunlara חשיבה modelli ya da özel skorlama ajanları içeren çok ajanlı yapıları örnek verebiliriz. Biz ise ise hem birinci hem de ikinci problemi çözebilmek için MindGraph ismini verdiğimiz farklı yaklaşım kullandık.

MindGraph'ın temelini oluşturan bilgi çizgesi, yapısal olarak veriyi node ve edge yani düğüm ve kenarlar olarak tutmakta. İki düğüm arasında bir kenar olması demek iki düğümün bir şekilde birbirleriyle ilişkili olduğu anlamına geliyor. Bu açıdan beyne ve noronların yapısına benzetebiliriz [17].

האם יש לך בעיה עם MindGraph? Öncelikle birinci problemden başlayalım. Birinci problemde temel amacımız büyük miktarda veri için ham metin verisinin soru ile alakalı olan kısımlarını alıp geri kalanlarını filtrelemek idi. Burada ne kadar iyi bir filtreleme yaparsak o kadar iyi bir cevap alabildiğimizden ve bu problem için genel olarak vektör tabanlı çözümler kullanıldığından daha önce bahsetmiştik. Lakin vektör tabanlı yaklaşımlarında kendine יש bazı alt sorunları mevcut.

İçerik filtreleme için sıklıkla tercih edilen vektör tabanlı çözümlerde gördüğümüz ilk sorun bir chunk'ın, sorulan soruyla ne kadar ilgili olup olmadığına dair ölinçülebilirim. Bu nedenle filtreleme için sabit bir sayı kullanıyoruz ve sıralanan chunk'lar arasından sadece bu sabit sayı kadar chunk seçmek durumunda kalıyoruz (Buna top k selection deniyor). Kullanılan sabit sayı bu çözümde bir hiper parametre olmuş oluyor ve ne olacağı verinin türüne, içeriğe ve konuya göre değişiklik gösterebiliyor.

İkinci sorun ise metni chunk'lara parçalamanın temelinde yatıyor. Her bir vektörün içerdiği öznitelikler sadece kesilen chunk'u temsil ediyor ve yine bu kesilen chunk'ların boyutu bir hiper parameter olarak belirleniyor mesela 800 karakter. Ama ya sorulan soruya cevap vermek için gereken minimum alan en az 2000 karakterden oluşuyorsa ne olacak? Hem sorduğumuz soruyu parçalanan chunklar ile eşleştiremiyoruz hemde ilgili alanı neredeyse tam ortadan ikiye böldüğümüz için ciddi miktarda informasyon kaybediyoruz. Bir çözüm olarak daha yüksek bir sabit sayı kullanıp chunk'ları büyütebiliriz. Ama bu da aynı miktarda öznitelikle daha çok informasyonu ifade etmeyi zorunlu kılıyor. Dahası tam ters bir etki yaparak cevabı çok küçük bir alan (mesela 200 karakters) bir bölgeyi bulmamızı çok daha zor hale getiriyor.

İşte bu nedenle MindGraph methodun da vektör tabanlı yaklaşımın yerine KG tabanlı bir yaklaşım tercih ettik. Bunun için önce veriyi bir bilgi çizgesine oturtuyoruz. Böylece unstructured yani düzensiz ve ham metin verisini מובנה yani düzenli bir hale getiriyoruz. Daha sonra ise graph engine dilinde SQL benzeri sorgular yazarak veriyi filtreliyoruz [18].

Örneğin yukarıda bulunan KG'a bakalım. Kullanıcı Iron Man 'in tüm yapımcılarını sırala gibi bir soru sormuş olsun. Bu soruyu cevaplamak için yapmamız gereken çok basit bir Cypher kodu ile Iron Man düğümüne ait tüm komşuları getirmek ve soru ile birlikte LLM'e vermek.

Bu sayede sorulan soruyla ilgili gereken tüm bilgileri, parçalamadan, מובנה yani düzgün ve öz bir biçimde LLM'e verebilmiş oluyoruz. Filtrelemeyi ise sorulan soruda geçen özneye göre çok rahat bir şekilde yapabildik.

İkinci olarak ifade ettiğimiz ve çözümü için muhakeme yeteneğine ihtiyaç duyduğumuz problem ise MindGraph ile getirdiğimiz yaklaşımı şöyle ifade edebiliriz [19].

Yukarıdaki bilgi çizgesini incelediğimizde kişileri, arkadaşlarını ve çalıştıkları şirketleri içeren basit bir yapı görüyoruz. Farz edelim ki kullanıcı Jennifer'in tüm arkadaşlarını ve çalıştıkları firmaları sırala lütfen. şeklinde bir soru sormuş olsun. Şayet bu soruyu eğer vektör benzerlik yöntemi ile cevaplamak isteseydik, sorulan soruyu vektöre dönüştürüp ardından tüm chunk vektörleri ile benzerliğine bakmamız gerekecekti. Ve böylece kalitesiz bir cevap almış olacaktık. אמה נדן?

Bunun ilk nedeni metinde Jennifer'in X ile arkadaş olduğu bilgisinin bulunduğu kısım ile X'in Y şirketi için çalıştığı bilgisinin bulunduğu kısmın muhtemelen çok farklı yerlerde geçiy. Mesela farklı iki dokümanın çok farklı sayfalarında. Bunun ikinci nedeni ise sorunun iki adımdan oluşuyor olması:

Jennifer'in arkadaşlarını bul.

Bulunan arkadaşların çalıştıkları şirketleri bul.

yani tesadüfen eksiksiz ve öz miktarda chunk ve informasyonu filtreleyip LLM'e verdiğimiz farz etsek bile LLM'e ham veriyi verip veriler arasında ilişki kurmasını yani muhakeme yeteneği gösteruzmesi bekliyoruzmesi. Hem de hiçbir yol göstermeden.

Şimdi ise MindGraph kullandığımız durumda ise tek yapmız reken:

  • ג'ניפר'אֲנִי,
  • IS_FRIENDS_WITH מעבר לארקדסלריני
  • עבודות_ל üzerinden çalıştıkları şirketleri

getiren basit bir Cypher שאילתה yazmak. דהא סונרא דנן בילגי סורו איל ללמ'ע ורמק. Bu sayede LLM'i az ve öz miktarda bilgi ile beslemiş ve gereksiz bilgiden arındırmış oluyoruz. Daha önemlisi ise bilgilerde geçen nesne, özne ve kavramları yani kısaca entity'leri node ve edge yapısında birbirlerine bağlı şekilde verdiğimiz için muhtemel muhakeme yollarını LLM'e işluyar etmişe.

CEmONC

Sonuç olarak, MindGraph yaklaşımının potansiyelini değerlendirdiğimiz testler ve ön çalışmalar oldukça heyecan verici sonuçlar ortaya koydu. 

MindGraph'ı klasik RAG yöntemleriyle karşılaştırdığımızda, özellikle maliyet avantajları ve muhakeme yeteneğindeki çarpıcı artışı net bir şekilde görüyoruz. Buna örnek olarak daha önce bir müşterimizde, RAG yerine doğrudan כוונון עדין yöntemini tercih ettik ve tamamen müşteriye özel, oldukça özelleşmiş bir model geliştirdik. Bu süreç kabaca 9000 dolara mal oldu. MindGraph yöntemini kullandığımızda ise çok daha düşük maliyetlerle, aynı hatta daha yüksek muhakeme kabiliyetine sahip sonuçlar elde edebildiğimizi gördük.

MindGraph'ın avantajlarını daha iyi ifade etmek için somut örnekler üzerinden ilerleyelim. Diyelim ki bir gıda şirketinde üretimden sorumlu bir yöneticisiniz. Üretim hattınızda kritik bir ekipman olan paketleme makinesi durdu ve hızlıca karar vermeniz gerekiyor. "Paketleme makinesi durursa, önümüzdeki ay sipariş teslimatlarımız, stoklarımız ve lojistik nasıl etkilenir?" gibi bir soruya geleneksel vektör RAG yöntemleriyle doğru cevap almak oldukça zor olacaktır. Çünkü bu tarz sorular çok sayıda verinin analiz edilmesini ve karmaşık ilişkilerin değerlendirilmesini gerektiriyor. Oysa MindGraph sayesinde, üretim hattı, stok ve teslimat gibi farklı kaynaklardan elde edilen verileri grafik tabanlı bir yapıya oturtarak tek seferde net bir cevap alabiliyoruz.

Bir başka örnekte ise daha stratejik bir soruya odaklanalım. Erdem, Galaksiya'nın büyük ortağıdır. Galaksiya ise Deepin'in, Deepin de Twinize'ın büyük ortağı konumundadır. Şimdi Erdem, stratejik bir hamle öncesinde şu soruların cevaplarını arıyor olabilir:

  • "Deepin şirketindeki hisse oranımız %20 azalırsa, Twinize üzerindeki doğrudan ve dolaylı kontrolümüz nasıl etkilenir?"
  • "Galaksiya olarak Twinize'ın büyümesinden elde edeceğimiz toplam değer artışı, Deepin'deki olası bir küçülmenin yaratacağı zararı telafi eder mi?"

Bu tarz çok katmanlı ve ilişkisel soruları geleneksel yöntemlerle ya da basit RAG yaklaşımlarıyla çözmek neredeyse imkansızdır çünkü bu senaryolar yüksek seviyede muhakeme gerektirir. MindGraph ise bu tip karmaşık ilişkileri doğrudan ve verimli şekilde çözebilen, akıllı sorgularla çalışır. Böylece herhangi bir uzman müdahalesine veya yeni bir eğitim sürecine gerek kalmadan, bu soruların yanıtlarını net olarak alabilmekteyiz.

MindGraph'ın diğer bir önemli avantajı ise güncelleme kolaylığı. כוונון עדין של מודלים שלה, ו-MindGraph'ın esnek yapısı sayesinde bilgi çizgesini güncelleyerek sürekli ve gerçek zamanlı adaptasyon sağlanabilyor. Bu sayede hem maliyetleri düşürüyor, hem de operasyonel süreçleri basitleştiriyoruz.

Galaksiya olarak, MindGraph metodunu geliştirmeyi, bilgi çizgesi tabanlı yaklaşımları yüksek muhakeme yeteneği gerektiren tüm alanlarda uygulamayı ve bu yöntemlerle yapay zeka modelinin dabiliyleriini taşmaylerıni sürdürmekteyiz. Bir sonraki adımda sizlerle daha detaylı benchmark sonuçları paylaşıyor olacağız. הו זמנה כדר

הישאר רגוע ...

Behçet ŞENTÜRK, מהנדס למידת מכונה

הפניות

[ 1]: viso.ai. 2024. "AlexNet: ארכיטקטורת למידה עמוקה מהפכנית." גישה אחרונה ב-5 במאי. https://viso.ai/deep-learning/alexnet/.

[2]: CNBC. 2025. "Nvidia עוקפת שוב את אפל והופכת לחברה בעלת הערך הרב ביותר בעולם." גישה אחרונה ב-5 במאי. https://www.cnbc.com/2025/01/21/nvidia-passes-apple-again-to-become-worlds-most-valuable-company-.html.

[3]: רשתות נוירונים ולמידה עמוקה. 2019. "מדוע קשה לאמן רשתות נוירונים עמוקות?". גישה אחרונה ב-5 במאי. http://neuralnetworksanddeeplearning.com/chap5.html.

[4]: ואשואני, אשיש, נועם שזיר, ניקי פארמר, יעקב אוסקורייט, ליון ג'ונס, איידן נ' גומז, לוקאש קייזר ואיליה פולוסוחין. 2017. "תשומת לב היא כל מה שאתה צריך." arXiv (אוניברסיטת קורנל), ינואר. https://doi.org/10.48550/arxiv.1706.03762.

[5]: kaggle. 2020. "חילוץ סנטימנטים בטוויטר." גישה אחרונה ב-5 במאי. https://www.kaggle.com/competitions/tweet-sentiment-extraction/overview.

[6]: פורבס. 2025. "ChatGPT הגיע למיליארד משתמשים? 'הוכפל תוך שבועות בלבד' אומר מנכ"ל OpenAI." גישה אחרונה ב-5 במאי. https://www.forbes.com/sites/martineparis/2025/04/12/chatgpt-hits-1-billion-users-openai-ceo-says-doubled-in-weeks/.

[7]: מגזין טכנולוגיה. 2024. "פריחה של דור הבינה המלאכותית גורמת לערך של Nvidia לעקוף את מיקרוסופט." גישה אחרונה ב-5 במאי. https://technologymagazine.com/digital-transformation/gen-ai-boom-causes-nvidia-value-to-overtake-microsoft.

[8]: EPOCH AI. 2025. "מודלים בולטים של בינה מלאכותית." גישה אחרונה ב-5 במאי. https://epoch.ai/data/notable-ai-models.

[9]: SEC. 2024. "תאגיד NVIDIA." גישה אחרונה ב-5 במאי. https://www.sec.gov/Archives/edgar/data/1045810/000104581024000029/nvda-20240128.htm.

[10]: רויטרס. 2025. "DeepSeek נותנת לחברות הטכנולוגיה של אירופה הזדמנות להדביק את הפער במרוץ הבינה המלאכותית העולמי". גישה אחרונה ב-5 במאי. https://www.reuters.com/technology/artificial-intelligence/deepseek-gives-europes-tech-firms-chance-catch-up-global-ai-race-2025-02-03/.

[11]: הגרדיאן. 2025. "מיליארדרים בטכנולוגיה הפסידו כמעט 100 מיליארד דולר בירידות בשוק המניות שנגרמו על ידי DeepSeek." גישה אחרונה ב-5 במאי. https://www.theguardian.com/technology/2025/jan/28/deepseek-selloff.

[12]: github. 2025. "FlashMLA." גישה אחרונה ב-5 במאי. https://github.com/deepseek-ai/FlashMLA.

[13]: ollama. 2025. "deepseek-r1." גישה אחרונה ב-5 במאי. https://ollama.com/library/deepseek-r1:671b.

[14]: EPOCH AI. 2025. "מודלים אמריקאים כיום עולים על מודלים שאינם אמריקאים." גישה אחרונה ב-5 במאי. https://epoch.ai/data-insights/us-vs-non-us-performance.

[15]: openai. 2025. "מהם אסימונים וכיצד לספור אותם?" גישה אחרונה ב-5 במאי. https://help.openai.com/en/articles/4936856-what-are-tokens-and-how-to-count-them.

[16]: E2E Cloud. 2025. "יישום טכניקות RAG מתקדמות עם מסד נתונים של Elasticsearch Vector." גישה אחרונה ב-5 במאי. https://www.e2enetworks.com/blog/implementing-advanced-rag-techniques-with-elasticsearch-vector-db.

[17]: שיאו, מינגקינג, ייקין ג'ו, די חה, וג'ואושן לין. 2024. "רשתות נוירונים בעלות זינוק זמני עם עיכוב סינפטי לצורך הנמקת גרפים." arXiv (אוניברסיטת קורנל), מאי. https://doi.org/10.48550/arxiv.2405.16851.

[18]: לי, ג'וני, טיאני טאנג, וויין שין ז'או, ז'יצ'נג ווי, ניקולס ג'ינג יואן וג'י-רונג וון. 2021. "יצירת גרף ידע לטקסט ברמת קומץ פעולות עם מודלים של שפה מאומנים מראש." arXiv (אוניברסיטת קורנל), ינואר. https://doi.org/10.48550/arxiv.2106.01623.

[19]: יוגי אנליטיקס. 2022. "אנווידיה עוקפת שוב את אפל והופכת לחברה בעלת הערך הרב ביותר בעולם." גישה אחרונה ב-5 במאי. https://vitalflux.com/nosql-data-models-concepts-examples/.