Teknoloji Meraklıları Haftalığı (Sayı 410): Bilmeniz Gereken AI'ın Üç Mekanizması
Burada her hafta paylaşmaya değer teknoloji içeriklerini kaydediyoruz, Cuma günü yayınlanır.
Bu dergi açık kaynak, katkıda bulunmak için iletişim. Ayrıca 《Kim İşe Alıyor》 hizmeti, programcı iş ilanları yayınlar. İşbirliği için e-posta ile iletişime geçin (yifeng.ruan@gmail.com).
Kapak Görseli

Ningxia Shapotou manzara bölgesindeki dev gözleri bağlı heykel. (via)
Bilmeniz Gereken AI'ın Üç Mekanizması
Bu, "AI Küçük Bilgiler Serisi"nin üçüncü makalesi. İlk ikisi sırasıyla 《Büyük Modeller Ne Kadar Bellek Gerektirir》 ve 《AI Önbelleği Nedir》 idi.
AI teknolojisi anlayışımı netleştirmek için kendi çalışma notlarımdan bazılarını paylaşıyorum. Mümkün olduğunca anlaşılır yazmaya çalışıyorum, umarım işinize yarar.

Bugün temel bir sorudan bahsedelim: AI neden sorularımızı cevaplayabiliyor, cevabı nasıl biliyor?
Bu konuda büyük modellerin işleyişini ayrıntılı olarak açıklayan birçok makale ve kitap bulabilirsiniz, genellikle çok zordur. Ancak profesyonel olmayanlar için sadece AI'ın üç mekanizmasını bilmek yeterlidir.
(1) Parametre Mekanizması
Makro düzeyde, tüm büyük modeller insan bilgisinin bir modellemesidir. Tüm insan bilgisini tanımlamak için bir matematiksel model oluşturur.
Nasıl tanımlar? Bir parametre mekanizması kullanır, bilgiyi "token" adı verilen birimlere ayırır ve ardından tüm token'lar arasındaki matematiksel ilişkileri hesaplar. Bu sürece "eğitim" denir.
Bu matematiksel ilişkiler sayısız parametre ile temsil edilir. Örneğin, büyük model GLM 5.3, 744 milyar parametreye sahiptir; bu parametreler tüm token'lar arasındaki ilişkileri (yani ağırlıkları) oluşturmak için kullanılır. "Eğitim" aslında bu 744 milyar ağırlığı bulmak, insan bilgisinin yapısını, yani tüm token'lar arasındaki ilişkileri tanımlamaktır.
Eğitim tamamlandığında, büyük modele soru sorduğumuzda, bu ağırlıklara göre en olası token'ları bulur ve böylece olasılığa uygun bir cevap üretir.
Dolayısıyla, büyük modeller aslında bir "sıkıştırma-üretme" mekanizmasıdır, insan bilgisini sayısız parametre içinde soyutlar ve daha sonra yeniden üretir.
(2) Çıkarım Mekanizması
Anlaşılması kolaydır, parametre ne kadar fazlaysa model o kadar iyidir. Çünkü daha fazla parametre, çeşitli bilgileri daha hassas bir şekilde tanımlamaya ve böylece daha doğru bir şekilde geri getirmeye olanak tanır.
Ancak bir yandan, parametreler sonsuz artırılamaz; eğitim ve kullanım maliyeti doğrusal olarak artar ve kullanım sırasındaki hesaplama süresi de uzar.
Diğer yandan, tüm bilgiyi dahil etmek gerekli değildir; birçok bilginin parametrelere dahil edilmesine gerek yoktur, tamamen mantıksal çıkarım yoluyla elde edilebilir.
Örneğin, yalnızca bir şehrin doğum ve ölüm oranlarını bilmek, nüfusun net büyüme oranını hemen öğrenmek için yeterlidir. Bunu ezberlemek gerekmez, çıkarım yoluyla elde edilebilir.
Büyük modeller, çıkarım mekanizmasına dayanarak, parametrelerde bulunan bilgilerden mantıksal kurallar yoluyla, dahil etmediği bilgileri çıkarır.
(3) İnternete Bağlanma Mekanizması
Model ne kadar çok parametreye ve ne kadar güçlü çıkarıma sahip olursa olsun, tüm bilgileri içeremez, her zaman cevaplayamayacağı sorular olacaktır.
Örneğin, büyük modele bugünkü borsa kapanış endeksini sorarsanız cevaplayamaz. Parametreler bu bilgiyi içermez ve çıkarım yoluyla da elde edilemez.
Bu durumda model, Agent veya uygulama çerçevesi tarafından sağlanan internete bağlanma mekanizmasına güvenerek, bilmediği bilgileri otomatik olarak internette arar.
(4) Özet
İşte bu üç mekanizma sayesinde AI sorularımızı doğru bir şekilde cevaplayabilir.
İlk olarak, parametre mekanizması büyük modelin temel bilgisini sağlar; ikinci olarak, çıkarım mekanizması çıkarım yoluyla elde edilen bilgiyi üretir; son olarak, internete bağlanma mekanizması, önceki iki mekanizmanın elde edemediği bilgileri almak için kullanılır.
Topluluk Önünde Konuşmanın Püf Noktaları
Birçok öğrenci, topluluk önüne çıkıp kalabalık bir ortamda konuşma yapmaktan endişe duyar.
Aslında, birkaç püf noktasını bilmek ve doğru bir anlayışa sahip olmak, başarılı bir topluluk önünde konuşma yapmanızı sağlar.

(1) Başarılı bir konuşmanın içeriği yalnızca %30, performans becerileri ise %70'tir.
Bilmelisiniz ki, konuşma bir şovdur; ses tonu, hareketler, yüz ifadeleri, jestler vb. kullanarak dinleyicilerin dikkatini çekmelisiniz, içerik aslında belirleyici değildir.
(2) Önceden iyi hazırlık yapın.
Konuşma metni, slaytlar, şakalar, tonlama, tempo gibi tüm detayları defalarca pratik yapmak en iyisidir. Sahneye çıktığınızda ne olacağını tahmin edemezsiniz; tekrarlanan pratik, önceden belirlenmiş yol boyunca sorunsuz ilerlemenizi sağlar.
(3) Belirli teknik detaylardan bahsediyorsanız, dinleyicilere neden bunlara dikkat etmeleri gerektiğini anlatmak için daha çok "neden" (why) üzerinde durmalısınız.
"Nasıl yapılır" kısmına gelince, genel fikri ve kavramı kısaca anlatmak yeterlidir; ayrıntılı işlemler ve uygulama tamamen atlanabilir, çünkü kimse doküman ezberlemenizi dinlemek istemez.
(4) Gerginlik normaldir.
Ancak iyi hazırlık yaptıysanız ve metni ezberlediyseniz, sahneye çıktığınızda duruma alıştığınızda gerginliği çabucak unutursunuz.
(5) İyi veya kötü konuşun, her zaman kendinize güvenmelisiniz. Kendiniz bile anlattığınız şeyden şüphe ediyorsanız, dinleyicileri ikna etmeniz zor olur.
Topluluk önünde başarılı konuşmacılar, kendine güvenen insanlardır, yetenekli olanlar değil. Birçok kötü yönetici ve dolandırıcı başarılı konuşmalar yapmıştır; bu, içeriğin sahneye çıkmak için gerekli koşul olmadığını gösterir.
(6) Bir konu hakkında konuşmayı gerçekten arzuluyorsanız, kesinlikle sahneye çıkma şartına sahipsinizdir.
Teknoloji Haberleri
Amerikalı bir tasarımcı, kullanıcının eline bir düz plaka olarak geçen cam elyafından bir sandalye icat etti.

Birkaç dakika içinde parçaları ayırıp birleştirerek bir sandalye haline getiriliyor.

Bu düz plaka tasarımı, nakliye hacmini, depolama alanını ve nakliye maliyetlerini büyük ölçüde azaltıyor.

Yeterli dayanıklılık sağlamak için eğrilerin gerilimine ve birbirine kenetlenen parçalara güveniyor.

Bu hafta, ünlü Amerikalı şarkıcı Dolly Parton 80 yaşında vefat etti. Bu haber oldukça ani geldi, çünkü kısa bir süre önce bir konser vereceğini açıklamıştı.

Ancak, kendisi sahneye çıkmayacak, bir "sanal avatar" yapılmasına izin verecek ve bu avatar sahnede şarkı söyleyecek.
Detayları açıklamadı ancak teknolojik olarak artık tamamen mümkün. Günümüzdeki AI sadece gerçekçi şarkı söylemekle kalmıyor, aynı zamanda gerçek zamanlı görüntü üretebiliyor ve hayranlarla etkileşime girebiliyor.
Bu tür "sanal avatar konserleri" birçok avantaja sahip; örneğin, çok sayıda düzenlenebilir, günde birkaç kez bile yapılabilir, bilet fiyatları düşüktür ve gerçek konserlerde yapılamayan birçok şey yapılabilir; örneğin vefat eden şarkıcılar da konser verebilir. İlk kez yapıldığında, ardından çoğalacağına ve özel bir pazar oluşturacağına inanıyorum.
ASUS, herhangi bir bisiklete takılabilen ve normal bir bisikleti elektrik destekli bisiklete dönüştüren bir "bisiklet güçlendirici" piyasaya sürdü.

Prensibi basit: bir pilin bir tekerleği döndürmesi.

Arka tekerleğin üstüne monte ediyorsunuz ve kendi kendine arka tekerleği döndürerek güç sağlıyor.

Yokuş çıkma ve ağır yük taşıma konusunda oldukça yardımcı, yaygınlaştırılmaya değer.

Makaleler
- Çalkantılı Yapay Zeka Çağı Geldi (İngilizce)

Bill Gates bu hafta yayınladığı bir makalede, yapay zekanın riskleri olduğunu ve gelişim hızının yavaşlatılması gerektiğini öne sürdü.
Ancak, 2023'te tam tersi görüşte bir makale yayınlamıştı: “Yapay Zekanın Riskleri Kontrol Edilebilir”.

Peki neden üç yıl içinde görüşü değişti? Ne düşünürse düşünsün, yapay zekanın gelişimi ancak hızlanabilir, yavaşlaması mümkün değil.
- Ox Alpha, GLM'dir (İngilizce)

Geçen günlerde internette anonim bir model olan Ox Alpha ortaya çıktı ve performansıyla herkesin dikkatini çekti; herkes hangi şirketten çıktığını tahmin etmeye çalıştı. Sonunda Zhipu, bunun GLM 5.3 Flash olduğunu kabul etti.
Ancak bundan önce bile bazı kişiler kanıtlarla arkasındaki şirketin Zhipu olduğunu tahmin ediyordu. Bu makale, modelin yazarının nasıl bulunacağını anlatıyor.
Bu arada, bu modelin Artificial Analysis puanı 57'dir ve bu, DeepSeek V4 Pro'dan (puan 53) daha yüksektir. Bu gerçekten etkileyici çünkü etkinleştirme parametreleri yalnızca 18B, ikincisinin 49B'sinden daha az. Ayrıca, parametre sayısı az olduğu için yerel bilgisayarda çalıştırılabilir.
- Git Worktree Kullanım Kılavuzu (İngilizce)

Bir Git deposunun genellikle tek bir çalışma dizini vardır; aynı anda iki veya üç özellik geliştirirken geçiş yapmak zahmetlidir.
git worktree komutu, birden çok çalışma dizini oluşturabilir. Bu makale kullanım kılavuzudur.

Yabancı bir kullanıcı, AliExpress ana sayfasında WebAudio API'sini kullanan bir kod parçası olduğunu ve bu sayfayı her açtığında Bluetooth kulaklığının bağlantısının koptuğunu fark etti. Kodu dikkatlice inceledi ve bunun kullanıcıyı tanımak için yapıldığını buldu.
- Google Workspace Alan Adı Hatası (İngilizce)

Google'ın kurumsal ofis hizmeti Google Workspace, kullanıcının alan adını bağlamayı gerektirir ancak yazarın alan adı bir türlü onaylanmadı.
Yazar müşteri hizmetlerine başvurdu, karşı taraf bir sürü gereksiz şey söyledi ama sorunu çözemedi. Sonunda dayanamayıp ön uç kaynak kodunu kendisi inceledi ve alan adını kontrol eden bir ön uç fonksiyonu olduğunu buldu; bu fonksiyonu devre dışı bırakınca alan adı bağlanabildi. Google'ın mevcut durumu gerçekten içler acısı.
- Xorshift ile Rastgele Sayı Üretimi (İngilizce)

Çoğu kişi bilmez, günlük işlemlerdeki rastgele sayıların çoğu Xorshift algoritması ile üretilir: tohum değeri üzerinde Xor işlemi ve kaydırma yapılarak rastgele sayı elde edilir. Bu makale, uygulama detaylarını anlatıyor.
Araçlar

Debian tabanlı bir Linux dağıtımı. Değişmez (immutable) bir sistem uygular, tüm işlemler atomiktir. (@NN708 tarafından gönderildi)

Terminal üzerinden A hisse senedi K-line grafiği, F/K oranı ve işlem hacmi görüntüleme aracı. (@Folgerjun tarafından gönderildi)

Yüklenen PDF dosyalarının renklerini tersine çeviren (beyaz zemin siyah yazı → siyah zemin beyaz yazı) oldukça ilginç bir araç sitesi.

Mac için yapay zeka programlama geliştirme ortamı (ADE). Uyumlu iPhone sürümü de mevcut. (@jiweiyuan tarafından gönderildi)
- PicLite (Tu Qing)

Platformlar arası resim sıkıştırma aracı. Yerel klasör izleme, resim formatı dönüştürme, toplu sıkıştırma, filigran ekleme, resim yükleme gibi özellikler sunar. (@amiaoapp tarafından gönderildi)

Bu Chrome eklentisi, mevcut penceredeki tüm sekmeleri çok satırlı döşeme biçiminde gösterir. (@hezhizheng tarafından gönderildi)
Açık kaynaklı elektronik fatura düzenleme ve gider raporlama masaüstü aracı. Kullanıcının kendi QQ veya 163 posta kutusuna bağlanarak e-postalardaki faturaları toplu olarak toplar, OCR tanıma, sınıflandırma ve arşivleme yapar ve Excel özeti oluşturur. (@EthanYoQ tarafından gönderildi)

Tarayıcıda sahne çerçevesi oluşturma, karakter pozları yerleştirme, kamera hareketi ve kurgu yazma imkanı sunar; ardından yapay zeka video modeline daha doğru video üretmesi için gönderir. (@HaD0Yun tarafından gönderildi)

Bu site, e-posta şablonları sağlar; kullanıcılar Markdown formatını doldurduğunda biçimlendirilmiş bir e-posta oluşturulur.

Go dili ve SQLite veritabanına dayalı, olayları kaydeden ve izleyen, yerleşik Web arayüzüne sahip bir istatistik sunucusu.
Kaynaklar

SpaceX, Louisiana'da yeni bir "Yıldız Gemisi Üssü" inşa edecek. İşte resmi sitesi, bilim kurgu filmi gibi görünüyor.

Kullanıcıların gerçek San Francisco sokak haritasında gezinmesini sağlayan bir web oyunu. Belirli bir yer belirtilebiliyor, oldukça havalı.
- Şehir Yolları (city road)

Bu site, bir şehirdeki tüm yolları bir çizgi grafiğine dönüştürebilir. Yakınlaştırma desteği sunar.
Görseller
Londra'da, insanların beklemediği birkaç küçük kamusal heykel bulunuyor.
Bir alışveriş caddesindeki binanın birinci katının en üst kısmında, peynir çalan iki fare heykeli var.

Bunun trajik bir olayı anmak için yapıldığı söyleniyor.

- yüzyılda, iki işçi burada kayıp bir peynir yüzünden kavgaya tutuşmuş ve bu kavga ölümle sonuçlanmış; sonradan peynirin fareler tarafından çalındığı anlaşılmış.
Londra'da ayrıca bir "Fare Evi" heykeli de var.

Bunun nedeni, dükkan sahibinin cadde üzerindeki kapı numaralarından birinin eksik olduğunu fark etmesi. Kendisi bu heykeli yaparak eksik kapı numarasını bu Fare Evi'ne vermiş.

Aşağıda diğer bazı minyatür heykeller var.



Seçme Yazı
Sosyal medyanın temel özelliklerinden biri, "homojen" ağları teşvik etmeleridir.
Homojenlik, kullanıcıların kendilerine benzeyen insanlarla karşılaşması anlamına gelir. Örneğin, kuş gözlem meraklıları çevrimiçi kuş gözlem gruplarına katılır, bowling meraklıları diğer bowling meraklılarıyla bir araya gelir.
Bunun sonucu, ağın marjinal insanları bir araya getirmesidir. Dünyanın düz olduğuna inananlar, internette kolayca bağlantı kurabilir; oysa gerçek hayatta bu neredeyse imkansızdır çünkü dünyanın düz olduğuna inanan insan sayısı çok azdır ve birbirleriyle karşılaşamazlar.
Homojen ağlar, insanların görüş dağılımına dair algısını çarpıtabilir. Aslında azınlıkta olan bir görüş, uzun süre homojen bir ağda kalan kişiler tarafından çoğunluğun fikir birliği olarak yanlış algılanabilir. Bu, "yanlış mutabakat etkisi" olarak adlandırılır.
Yanlış mutabakat etkisi birkaç soruna yol açar: (1) Katılımcıların azınlık görüşüne olan inancını pekiştirebilir. (2) Bir kişi, azınlık görüşünün yaygın olarak kabul edildiğini yanlış anladığında, çoğunluğun iradesine göre işleyen kurumlardan memnuniyetsizlik duyabilir ve toplum tarafından dışlandığı hissine kapılabilir.
Sözler
1.
İyi yetişmiş bir insanın göstergesi, en iyisinden keyif alabilmesi ve en kötüsüne dayanabilmesidir.
-- Tang Shizeng, bu hafta vefat eden ünlü gazeteci
2.
Dünyamız, genellikle başkalarının yerine kendini koyan bir dünya değildir. Ancak, dünyayı 10 yaşındaki bir çocuğa anlatabilmek ya da 80 yaşındaki birinin açabileceği bir kavanoz tasarlayabilmek, bazen başlangıçta yapmak istediğiniz şeyi daha iyi başarmanızı sağlar.
-- Bir 10 Yaşındaki Çocuk Gibi Anlatın Bana
3.
Birisi "Nöbet Devri Kapandı" başlıklı bir yazı yazarak, nöbetlerin AI'ya devredilmesi gerektiğini öne sürdü. Yalnızca AI sorunu çözemediğinde insanların devreye girmesi gerektiğini ve AI'nın insanları çağırması gerektiğini belirtti.
-- AI ile İlgili Güvenilirlik Kazaları Geliyor
4.
İnsanlar yavaş yavaş fark ediyor ki, AI kullanarak yeni bilgiler öğrenmek geleneksel yöntemlerden çok daha hızlı, çünkü AI çok farklı bilgileri özetlemede son derece başarılı. Ancak AI ile öğrenirken beyin öğrenme sürecine aktif olarak katılmadığı için, bilginin anlaşılması ve hatırlanması geleneksel yöntemlere göre daha zayıf kalıyor. İnsan beyninin çalışma biçimi, sarmal öğrenmenin bilgiyi ezberlemenin en iyi yollarından biri olduğunu gösteriyor. AI doğrudan sonucu vererek, aradaki tekrarlı düşünme adımlarını atlamamıza neden oluyor.
5.
Eğer ev fiyatları çökerse, ben zarar görürüm ama bunun bir faydası da olur: Çocuğum daha ucuz bir eve sahip olabilir. Doğru, miras olarak alacakları azalır, ancak hayatları boyunca daha uygun fiyatlı konutlardan yararlanırlar.
-- CD'ler ve NIMBY (Bahçeme Değil) Etkisi
Geçmiş Yıllardan
En Anlaşılır Sinir Ağı Açıklaması (#363)
Singapur'da Klima Olmasaydı (#313)
Açık Kaynak Yazılım Nasıl Para Kazanır? (#263)
Bilgi Adacıkları, Bilgi Yazılımları (#213)
(Son)