kaan hacıhaliloğlu

yapay zeka mühendisi · yorumlanabilirlik · istanbul

fizik okudum, bana kapatamadığım bir alışkanlık bıraktı: altta gerçekte ne oluyor diye sormak. bugün yapay zekanın çoğu, kimsenin tam olarak açıp okuyamadığı modellerin üstünde çalışıyor. bu ya korkutucu ya da ilginç, ben ilginç olanı seçtim.

şu an sabancı üniversitesi'nde veri bilimi yüksek lisansı yapıyorum, tezim büyük dil modellerinde (llm) reddetme yönü üzerine. bir model "bu konuda yardımcı olamam" dediğinde içeride belirli bir şey oluyor ve bu, aktivasyon uzayında bir yön olarak gösterilebiliyor. jailbreak'lerin modeli bu yönden nasıl uzaklaştırdığını ve bunun savunma (ya da saldırı) için ne anlama geldiğini haritalıyorum.

SCL'de (synthetic consumer lab) yapay zeka mühendisiyim: yapay zeka tabanlı bir pazar araştırması motoru kuruyorum, gerçek tüketiciler gibi davranan sentetik tüketiciler. yazması bile garip bir cümle. backend, frontend, ajanlar, istatistik, hepsi bende. SoundBoost'ta da derin öğrenmeyle çalışan bir ses mastering platformunun yapay zeka tarafındayım.

lisansı boğaziçi'nde fizikte bitirdim, EarthML grubunda transformer modelleriyle deprem tespiti üzerine çalıştık. arada padova'da bilgisayar bilimleri yüksek lisansına başladım, olmadı. neden olmadığını blogda yazdım.

kısaca
şu an

yapay zeka mühendisi, SCL (synthetic consumer lab) ve SoundBoost

araştırma

mekanistik yorumlanabilirlik, llm güvenliği, reddetme yönü

eğitim

sabancı üniversitesi (veri bilimi yl), boğaziçi üniversitesi (fizik lisans)

araçlar

python, pytorch, transformerlens, nnsight, fastapi, laravel, typescript

diller

türkçe (ana dil), ingilizce

kullanıcı adı

kaanhho (x, hugging face, linkedin), khdoex (github)