Skip to main content
Eğitimde Yapay Zeka19 dakika okuma süresi

Hatırlayan Bir Öğretmen: Bağlam Penceresinden Daha Uzun Ömürlü Bir Konu Belleği

Bir öğrenci aylarca tek bir konu üzerinden konuşur. Bunun daha fazlasını prompt'a sıkıştırmak ne ölçeklenir ne de öğretmeni dürüst kılar. Geçmişi ilgiye göre sıralayan bir bellek, materyalin bir kavram haritası ve öğrenci hakkında kendi kanıtını taşıyan kanıları nasıl kurduğumuz: on iki diyagram, gerçek örnekler ve gerçek geçmişleri yeniden oynatmanın bize öğrettikleri.

iTutor Team18 Eylül 2026

Bir öğrenci aylarca tek bir konu üzerinden konuşur: binlerce mesaj, onlarca dosya, yüzlerce küçük kontrol. Bunun daha fazlasını prompt'a sıkıştırmak ne ölçeklenir ne de öğretmeni dürüst kılar. Bu yazı, her konuya geçmişi ilgiye göre sıralayan bir bellek, materyalin bir kavram haritasını ve öğrenci hakkında kendi kanıtını taşıyan kanıları nasıl kazandırdığımızı ve gerçek geçmişleri yeniden oynattığımızda bunların bize ne öğrettiğini anlatıyor. Hiçbir sağlayıcı bilerek adlandırılmamıştır; yöntem bunlara bağlı değildir. Buradaki her sayı ölçüldü, tahmin edilmedi.

"Hatırlamak" ne anlama gelmeli

"Öğretmen unutuyor" sorununa en naif yanıt daha büyük bir penceredir: sohbetin daha fazlasını prompt'ta tutmak, gerisini özetlemek. Bu, birbirinden ayrı üç şekilde başarısız olur ve her biri teknik bir sorun olmadan önce bir ürün sorunudur.

  • Zaman. Eylül'de Temmuz'da işlenen bir konuyu soran öğrencinin ihtiyacı olan şey Temmuz oturumudur, son kırk mesaj değil. "Şimdiye kadar ne oldu" özeti büyüdükçe daha da bulanıklaşır; ilgili ayrıntı tam olarak bir özetin attığı şeydir.
  • Dosyalar. Bir konu onlarca belge barındırır. Getirme adımı soruya en yakın sekiz pasajı getirir; bu olgular için yeterlidir ama "bu bölüm diğeriyle nasıl ilişkili" sorusunda işe yaramaz, materyalin yapısı hiçbir zaman tek bir pasajın içinde değildir.
  • Dürüstlük. "Ozmozu anlıyorsun" diyen bir öğretmen bunun nedenini söyleyebilmelidir: hangi kontrol, hangi gün, öğrenci ne cevap verdi. Kanıtsız bir sayı, ondalık noktalı bir tahmindir.

Bu yüzden tek bir satır yazmadan önce üç söz verdik: her tur kalıcı bir epizot olacak ve hatırlama tüm geçmişi tarihe göre değil ilgiye göre sıralayacak; kavramlar her dosyadan bir kez çıkarılıp konu başına tek bir haritada birleştirilecek; ve hakimiyet sadece kanıtla beslenecek, cevaplanan bir kontrol, girilen bir quiz, oynanan bir tur, her kanı kendi kanıtını ve geçmişini koruyarak. Ve daha sessiz, dördüncü bir söz: öğretmenin bir şeye dair hafızası yoksa, bunu açıkça söyler.

Sistemin yapısı

Üç depo, tur başına bütçelenmiş bir okuma, gece başına bir döngü. Dosyalar haritayı besler; sohbet epizot günlüğünü besler; testler kanıları besler. Her sohbet turu bu üçünden küçük, sıralanmış bir dilim okur ve bunu sabit bir token bütçesi içinde prompt'a yerleştirir. Okuma yolunda hiçbir şey üretken bir modeli çağırmaz. Çağırdığı tek model, tur başına bir kez, yönlendirme ve hatırlama tarafından paylaşılan gömmedir; sohbet dışındaki tek model geçişi, haritaya yeni bir dosya okuyan geçiştir.

Dosya dosya başına bir kez Sohbet soru, cevap Test cevabın sonucu Harita düğüm, kenar, hazırlık Epizotlar yalnız ekle, hash zincirli Kanı defteri değişmez, sadece eklenir çıkar+birleştir iki epizot kanıya katıl Bir tur, ~2,000 token 1 soru yönlendirme → kavramlar 2 brifing: harita, odak önce 3 bu kavramlardaki kanılar 4 buna benzeyen epizotlar Prompt bellek alanı materyal pasajlarından önce Gece · günü özetle · bayat kanıları küçült · kalibre et · atıfları doğrula · öz-modeli tazele depolara geri döner
Şekil 1. Üç depo, üç tür olayla beslenir; tur başına bütçelenmiş bir okuma, gece başına bir döngü. Okuma yolu aritmetik, arama işlemleri ve sorunun tek bir gömmesinden ibarettir; sohbet dışındaki tek model çağrısı, yeni bir dosyayı okuyan çağrıdır.

Epizotlar: sadece eklenen, hash zinciriyle bağlı bir günlük

Her olay bir epizota dönüşür: bir soru, bir cevap, sonucuyla birlikte bir test, bir quiz sonucu, gelen bir dosya, öğrencinin öğretmene açıkça öğrettiği bir şey. Bir epizot; tek satırlık bir özet, tam metin, dokunduğu kavramlar, yazılma anında belirlenen bir belirginlik puanı ve kendi kanıtını taşır, bir cevap için bu, o anki parmak iziyle damgalanmış, atıfta bulunduğu dosya ve sayfadır. Epizotlar asla düzenlenmez. Her biri kendisinden öncekinin hash'ini aynı zincirde saklar, böylece günlük yeniden hesaplanabilir olur ve her türlü kurcalama, ya da iyi niyetli bir migrasyonun sessizce yaptığı bir yeniden yazım, bir kırılma olarak ortaya çıkar. Bu, kurcalamanın kanıtıdır, kurcalamaya karşı koruma değil: bir yeniden yazım tespit edilir, asla önlenmez ve bu yalnızca zincir ya da onun bir kontrol noktası saklandığı sürece geçerlidir.

soru · 12 Tem "Hücrelere bakalım mı?" önceki ∅ · hash 7e1c… cevap · 12 Tem Böl.2 s.4'e atıf · iz a91f önceki 7e1c… · hash 03bd… test · 12 Tem doğru · tahmin 0.45 önceki 03bd… · hash c4a0… öğretme · 18 Eyl "ona güç istasyonu diyoruz" önceki c4a0… · hash 9f27… hash = sha256(önceki hash · zincir · zaman damgası · tür · özet), zincir ekleme sırasını takip eder, tekrar oynatılan bir epizot kendi Temmuz tarihini korusa bile
Şekil 2. Bir öğrenci için tek bir konudaki epizot zinciri. Eski geçmişin tekrar oynatılması her epizotun orijinal zamanını kayıtta tutarken zincirin kendisi satırların yazılma sırasını takip eder; ikisi de yeniden hesaplanabilir.

Belirginlik, bir epizotun ne olduğuyla belirlenir, bir ruh haliyle değil: kaçırılan bir test (0.7), geçilen bir testten (0.6) daha çok önem taşır, ve öğrencinin öğretmene öğrettiği bir şey (0.85) en çok önem taşır, çünkü bu bir kişinin açıkça saklanmasını istediği tek hafızadır. Bir soru mütevazı bir 0.35'tir, öğrencinin kendi sorusu, doğru bir hatırlama ve işe yaramaz bir hatırlatmadır, ki bu daha sonra "bu bana neyi hatırlatıyor" yolunda önem kazanır.

Hatırlama: ilgi, tazeliği yenmeli

Hatırlama, kronolojik değil çağrışımsaldır. Adaylar, her biri tüm geçmişe bütünüyle uzanan birkaç havuzdan toplanır ve ancak sonra puanlanır: en yeni beş yüzü, sorudan belirgin bir kelime içeren her epizotu, sorunun yönlendirildiği kavramlara dokunan her epizotu ve bir vektör indeksinden gelen anlamsal komşuları. Önce genişletmek, sonra dilimlemek, modüldeki en önemli tek tasarım kararıdır, ilk taslak önce dilimliyordu ("en yeni 500") ve Mart'tan mükemmel derecede ilgili bir hafızayı hiçbir ilgi düzeyinde hatırlayamıyordu, çünkü o hafıza puanlanmadan önce kesilip atılmıştı.

−0.1800.250.500.75 ilgi: 0.55, gömülüyse kosinüs, değilse sözcüksel örtüşme ilgi0.55 kavram örtüşmesi: +0.20, epizot sorunun yönlendirildiği bir kavrama dokunduğunda kavram örtüşmesi+0.20 tazelik: 0.15, üstel azalmayla, zaman sabiti 30 gün tazelik (τ = 30 g)0.15 belirginlik: 0.12, epizotun türüne göre yazılma anında belirlenir önem0.12 sıklık: 0.08, epizotun kavramlarının aday kümesinde ne sıklıkta tekrarlandığı sıklık0.08 kendi yankısı: öğretmenin kendi cevapları için −0.18, o cevap bir dosyaya atıfta bulunduğunda −0.08 kendi yankı (cevaplar) −0.18 · atıf varsa −0.08 koyu kısım her zaman uygulanır; açık kısım, cevap hiçbir dosyaya atıfta bulunmadığında eklenen ek cezadır
Şekil 3. Puanlama ağırlıkları. İlgi belirleyicidir; geri kalanı ince ayar yapar. Öğretmenin kendi geçmiş cevapları bastırılır, böylece ne olduğundan akıl yürütür, ne söylediğinden değil, cevap öğrencinin dosyasına dayandırılmışsa bu bastırma daha azdır, çünkü o cevap öğretilenin bir kaydıdır.

Ağırlıklar tek başına yeterli değildir. Soru bir şey hakkında olduğunda ve herhangi bir şey eşleştiğinde, hiçbir şeyle eşleşmeyen epizotlar sıralanmak yerine tamamen düşürülür, alakasız, taze bir not sadece tazelikten 0.15 × 1.0 puan alırken, 200 günlük tam bir eşleşme 0.55 × 0.156 puan alır ve eşleşmeyen bir şeyin eşleşen bir şeyi geçmesine izin veren hiçbir ağırlıklandırma hiçbir ayarda doğru değildir. Tazelik bir sıralayıcı değil, bir eşitlik bozucudur. Okuyucunun bu sayılar hakkında sorması gereken iki soru vardır: nereden geldikleri ve onları veriye uydurup uydurmadığımız. Bunlar elle belirlenmiştir, farklı bir ürün için kurulmuş daha önceki bir belleğimizden devralınmıştır ve bu makaledeki verilerin hiçbirine göre ayarlanmamıştır. Aşağıdakilerin hiçbiri taranarak ya da veriye uydurularak bulunmadı; puanlamada yaptığımız tek değişiklik bir aramadan değil, adını koyabildiğimiz bir başarısızlıktan geldi ve bu bir ağırlık değil, eleme adımıydı. Eleme adımının iki istisnası vardır: hiç sorgu olmaması (o zaman elde olan tek şey tazeliktir) ve hiçbir şeyin eşleşmemesi (o zaman en dürüst teklif, yakın geçmiştir).

00.250.50 alakasız taze not: ilgi 0 · tazelik 1.0 → puan 0.15 taze not, eşleşme yok 0.15 (tazelikten) 200 günlük tam eşleşme: ilgi 0.53 · tazelik 0.001 → puan 0.29 200 günlük tam eşleşme 0.29 (ilgiden) ikinci satır varken eleme adımı ilk satırı tamamen kaldırır puan = 0.55·ilgi + 0.15·tazelik + 0.08·sıklık + 0.12·önem + 0.20·kavram − yankı
Şekil 4. İlginin neden sadece katkı sağlamak yerine bir eleme ölçütü olarak kullanıldığı. Hatırlanan bir epizotun düştüğü blok "hatırladığın şeyler" başlığını taşır; oraya düşen alakasız bir epizot ilgili bir bağlam olarak okunur.

Gerçek geçmişlerin eklediği iki şey

Tekrarlar birleşir. Gerçek bir konuda 161 öğrenci sorusu 56 farklı cümleye karşılık geliyordu, "hücre nedir" üç ay boyunca dokuz kez soruldu. Dokuz kopya tek bir hafızadır, dokuz kez hatırlanmış; bu yüzden hatırlama birbirinin aynısı olan epizotları birleştirir ve hayatta kalanın kaç epizotun yerine geçtiğini bildirir. Zaman bir ipucu değil, bir filtredir. "Temmuz'da ne işledik?" bir zaman aralığına ayrıştırılır ve hatırlama önce bunun içinde çalışır; aralık boşsa blok bunu açıkça söyler (bkz. § dürüstlük). Ay adları öğrencilerimizin yazdığı dillerde çalışır, "geçen hafta" ve "dün" de öyle.

Kavram haritası

Pasajlar "dosya burada ne diyor" sorusunu yanıtlar; bir harita ise "bu konu neden oluşuyor ve ne, neyin üzerine inşa ediliyor" sorusunu yanıtlar. Her dosya, sınırlı bir kavram listesi döndüren bir model geçişiyle bir kez okunur, ad, tek cümlelik özet, kısa bir tanım, kendi listesinden inşa ettiği kavramlar, dosyanın bunu açıkladığı sayfalar. Bölüm başlıkları ("Giriş", "Yaygın yanlış anlamalar") bir doğrulayıcı tarafından reddedilir; gerçekte bir bölüm başlığı olan bir ad, konunun fikirleri değil, dosyanın mobilyasıdır.

Kavramlar, dosyalar arasında bir kanonik anahtarla (normalleştirilmiş, yazı sistemi duyarlı bir ad) ve 0.86 üzerindeki gömme benzerliğiyle birleşir. Köken bilgisi birikir: ozmozu yeniden açıklayan bir bölüm, ikinci bir düğüm oluşturmak yerine kendini var olan tek düğüme ekler ve katkıda bulunan her dosya, sayfalarıyla birlikte listelenmeye devam eder. Dosyanın varsaydığı ama hiç açıklamadığı bir ön koşul, ancak iki kavram onu varsaydığında bir düğüme dönüşür, o zaman boşluk gerçektir ve gösterilmeye değer; tek seferlik bir varsayım, kavramın üzerine "varsayar" olarak kaydedilir ve hiçbir yerde çizilmez. Okuduğumuz ilk politika belgesi, bu kural var olmadan önce 11 kavramı 34 düğüme çevirmişti.

Ökaryotik hücreler Hücre zarı Sitoplazmaen merkezi H. duvarı Çekirdek Kloroplastlar Mitokondrizayıf · tekrar Ribozom Endosimbiyoz inşa eder ilgili anlaşılmış hâlâ öğreniyor zorlanıyor henüz kanıt yok tekrara hazır büyük = daha merkezi
Şekil 5. Gerçek bir haritadan bir kesit (hücre biyolojisi, bir dosya, 16 kavram). Oklar bir ön koşuldan, onun üzerine inşa edilene doğru gider; düzen, ön koşulları sola yerleştirir. Öğrencinin durumu, testlerin ulaştığı düğümlerin üzerine işlenir.

Haritadan üç türetilmiş sayı çıkar. Merkezilik, kenarlar üzerinde ağırlıklı bir PageRank'tir (her şeyin üzerine inşa edildiği bir ön koşul, bir merkezi düğümdür). Kavram başına hazırlık dört bandı takip eder, sadece adlandırılmışsa 0.35, bir dosya tarafından açıklanmışsa 0.60, geçilen bir testle doğrulanmışsa 0.85, bir kişi tarafından öğretilmişse 1.0, ve konunun hazırlığı, merkezilik ağırlıklı ortalamadır, böylece dosyaların açıklamadığı bir merkezi düğüm bir yapraktan daha maliyetlidir. Öğretim sırası topolojik bir katmanlamadır: önce ön koşullar, bir katman içinde önce merkezi düğümler; bu, on dört pasajdan "ne öğretilmeli"yi taslak haline getiren bir model çağrısının yerini aldı.

Örnek · prompt için oluşturulan bir konu haritası (≤ 700 token, önce odak kavram)
SUBJECT MAP (16 concepts; the files explain 79% of it, this is about the material, NOT the student's mastery):
- Mitochondria: Mitochondria release energy from glucose. [taught: in our class we call the mitochondria the powerhouse of the cell] (builds on: Cytoplasm)
- Cytoplasm: Cytoplasm is the gel-like substance inside the cell membrane. (builds on: Cell Membrane)
- Chloroplasts: Chloroplasts are involved in photosynthesis. (builds on: Cell Wall)
- Endosymbiosis: Endosymbiosis explains the origin of mitochondria and chloroplasts. (builds on: Mitochondria, Chloroplasts)
…

Bu başlık ifadesi kendi başına bir ders oldu. İlk sürüm "%79 anlaşıldı" diyordu ve bunu okuyan bir model öğrenciye keyifle "mevcut %79 anlama düzeyine göre…" diyordu. Öğrencinin hakimiyeti olarak okunabilecek bir hazırlık sayısı, tam olarak öyle okunacaktır; satır şimdi neyle ilgili olduğunu söylüyor.

Konuyu öğretmek

Bir kişi haritayı, onunla konuşarak genişletebilir. "Şunu hatırla: bizim sınıfımızda mitokondriye hücrenin güç istasyonu diyoruz" cümlesi, adını verdiği kavrama öğretilmiş bir not ekler (ada göre yönlendirme; sadece tam eşleşme), o kavramın hazırlığını 1.0'a ayarlar, bir öğretme epizotu yazar ve notu brifinge yerleştirir. Cümle var olan hiçbir kavramı adlandırmazsa, öğretilmiş katmanda kısa bir adla yeni bir düğüm oluşturulur, cümlenin tamamı değil. Sorular asla öğretmez; sadece açık bir "şunu hatırla", "X'i … olarak kabul et" ya da öğrencinin kendi dilindeki eşdeğeri öğretir.

Geçmişini koruyan kanılar

Bir kanı, öğretmenin şu anda bu öğrenci hakkında bu kavramda ne düşündüğüdür, "ozmozda zorlanıyor", "sitoplazmayı anlıyor", bir güven değeriyle ve arkasındaki epizotlarla birlikte. Önemli olan kural şudur: satırlar asla farklı bir iddiaya güncellenmez. Öğretmen fikrini değiştirdiğinde, eski satır tam olarak olduğu gibi kalır, yeni bir satır eklenir ve eski satır yeni olana işaret eder. Hatırlama, hiçbir şeyin yerini almadığı satırları okur; birisi neyin neden değiştiğini sorduğunda bir rapor zinciri takip edebilir. Saklama ve güncellik farklı özelliklerdir ve ikisini de koruyan bir bellek, üzerine bir rapor inşa edilebilecek bir bellektir.

sitoplazmada zorlanıyor güven 0.90 · yanlış bir testten sonra kanıt: test c4a0 (yanlış) superseded_by → satır 2 (revize) sitoplazmayı hâlâ öğreniyor güven 0.50 · hakimiyet 0.45 kanıt: c4a0 (yanlış), d1e2 (doğru) superseded_by → satır 3 (revize) sitoplazmayı anlıyor güven 0.72 · hakimiyet 0.72 kanıt: c4a0, d1e2, e7f8 (doğru) güncel, hatırlamanın okuduğu satır kanıt bir revizyonda taşınmaya devam eder: öğrenci daha sonra anladığına hükmedildiğinde de o yanlış hâlâ kayıttadır
Şekil 6. Bir kavram için birbirine bağlı üç satır. İfade bir hakimiyet bandıdır (0.3'ün altı zorlanıyor, 0.3–0.6 arası hâlâ öğreniyor, 0.6 ve üzeri anlıyor), böylece art arda gelen doğru cevaplar bir bandı geçer ve bu bir fikir değişikliğidir, kaydedilir, asla üzerine yazılmaz. Bir bant içindeki küçük bir güven değişimi aynı satırı yeniden ifade eder.

Kanılar önemli olan yerde ucuzdur: her biri yaklaşık yirmi token ve biri düzinelerce epizotun yerine geçer. "Bağlama sığandan daha fazlasını hatırlamak" gerçekte anlamına gelen şey, daha büyük bir pencere değil, bu orandır. Epizotlar atılmaz, bir kanının karşı sınandığı şey onlardır, ama onlar ikinci sıraya gelir ve çağıran, kalan bütçesini onlara harcar.

Bir kanı hangi konuyla ilgili?

Bu, gerçek verinin ilk bozduğu kısımdı. Öğretme modunda, bir testin "konusu" öğrencinin kendi sözleri olmuştu, bu yüzden tekrar oynatılan testler, "bana soruları sor" (ask me the questions) ifadesini anlıyor ve "bueno ahora explícame todos los pasos" ifadesinde zorlanıyor gibi kanılar üretiyordu. Şimdi bir testin konusu, ada göre bir kavrama yönlendiriliyor ve konu dizisi bir cümle olduğunda, öğretmenin kendi değerlendirme metni (genellikle kavramı adlandırır) üzerinden, sadece tam ad eşleşmesiyle yönlendiriliyor. Hiçbir şeyle eşleşmeyen ve bir sözce gibi okunan bir konu, öğrencilerimizin kullandığı dillerdeki soru kelimeleri, sorma fiilleri, zamirler, doldurma sözcükleri, kanıt olarak tutulur ama asla bir kanıya dönüşmez. Böyle bir kural değişikliği yeniden türetmenin bir yolunu gerektirir: geçerli kanıları emekliye ayır (asla silme), kayıttaki testleri bugünün kurallarına göre yeniden oynat, hiçbir epizota dokunma.

Bir tur, bir bütçe içinde

Her sohbet turu, beyinden bir blok ister; bu istek yolunun içinde, sert bir zaman sınırıyla oluşturulur. 155 tur boyunca blok medyanda 295 ms, 90. yüzdelik dilimde 403 ms, 95. yüzdelik dilimde ise 445 ms sürdü; bir oluşturma bir saniyeyi aştı, hiçbiri ise 2.5 s sınırını aşmadı; bu sınırı aşan paket beklenmek yerine düşürülür, böylece yavaş bir bellek asla ilk token'ın önüne geçmez. Sorunun tek bir gömmesi, hem yönlendirmeye hem de hatırlamaya hizmet eder. Blok, prompt'un var olan bellek alanına, materyal pasajlarından önce girer ve prompt hakkında başka hiçbir şey değişmez.

bütçe: 2,000 token · gerçek bir konudaki tipik bir tur 720–1,030 kullandı brifing (harita, önce odak): ~380 token hrt 380 devredeki kavramlara ait kanılar: ~100 token (≈ her biri 20) 100 hatırlanan epizotlar, en eskisi önce: ~380 token epizot 380 nasıl kullanılacağı ve bir dönem boşken "kayıt yok" satırı: ~60 token boş alan ≈ 1,080 token 01,0002,000 harita, önce odak kavram ve komşuları kanılar epizot talimatlar
Şekil 7. Token'ların nereye gittiği. Harita, 700 token içinde önce ilgili olanla oluşturulur; kanılar en ucuz temsil şeklidir ve sırada onlar gelir; epizotlar kalanı doldurur, en eskisi önce, çünkü bir zaman çizelgesi bir sıralamadan daha iyi okunur.
Örnek · "Temmuz'da ökaryotik hücreler hakkında ne işledik?" için oluşturulan blok (kısaltılmış)
===== YOUR MEMORY OF THIS STUDENT AND SUBJECT =====
THE STUDENT IS ASKING ABOUT THEIR OWN RECORD. Answer from the beliefs and the earlier work listed here …
WHAT YOU CURRENTLY BELIEVE ABOUT THIS STUDENT (from their checks; confidence 0–1):
- understands cytoplasm (0.72)
- understands eukaryotic cells (0.72)
EARLIER WORK WITH THIS STUDENT (oldest first):
- 12 Jul · you were asked: Can we go over Eukaryotic Cells today? I keep mixing it up.
- 12 Jul · you answered: Of course. Eukaryotic Cells: Eukaryotic cells contain a nucleus and organelles. We worked through two examples and you got the second one right.
- 18 Sep · the student taught you: Taught: in our class we call the mitochondria the powerhouse of the cell
- 18 Sep · check: Check on cytoplasm: right (and 3 more times like it)
SUBJECT MAP (16 concepts; the files explain 79% of it, …)
…
HOW TO USE THIS: it is your own memory of past work with this student, not their material. When you rely on it, say when it happened ("in July we…"). Never claim a memory that is not listed here. …
===== END OF MEMORY =====

Blok içindeki sıra, içerik kadar önemli olduğu ortaya çıktı. Sıradan bir soru için harita önce gelir. Bir kayıt sorusu için, "şimdiye kadar neyi yanlış yaptım", "ne çalıştık", "ماذا أخطأت", kanılar ve önceki çalışmalar önce, harita en son gelir; öğrencinin kendi kaydı hakkında sorduğunu söyleyen açık bir ilk satırla birlikte. Bunu bir başarısızlıktan öğrendik: prompt ayrıca "NO QUIZ ATTEMPTS recorded" ile başlayan eski bir "değerlendirme sonuçları" bölümü taşıyordu ve model, sohbette yirmi sekiz testi cevaplamış bir öğrenciye "henüz hiç quiz denemedin" yanıtını veriyordu. Bir model, bir kayıt hakkındaki ilk yetkili ifadeyi okur ve durur. Bellek bloğu şimdi o bölümden önce gelir, bir bağlantı notu ikisini birbirine bağlar ve bellek bloğu var olduğunda sadece "hiçbir şey kayıtlı değil" diyen bir değerlendirme bölümü düşürülür.

Örnek · düzeltmeden sonra, gerçek bir geçmişte aynı soru

Öğrenci: Testlerde şimdiye kadar neyi yanlış yaptım ve neyi tekrar etmeliyim?

Öğretmen: Testlerde neyi yanlış yaptın: 1. Hücre nedir testi: kısmen doğru, bunu "küçük bir şey mi?" diye tanımladın, bu eksik bir tanım. Yanlış cevaplar: farklı zamanlarda "evet" ve "suu" diye cevap verdin, bunlar yanlış işaretlendi. 2. Enzimler testi: enzimlerin "sindirimi kolaylaştırmak için besinleri parçalayan proteinler" olduğunu doğru şekilde belirttin. Önerilen tekrarlar: hücrenin ne olduğu konusundaki zorlanmana bakılırsa: hücre yapısı (prokaryotik ve ökaryotik)… hücrenin bileşenleri… örneğin, mitokondriler glikozdan enerji açığa çıkarır, bunu sınıfta öğrenmiştin.

"Kaydım yok" demek

Projenin en öğretici başarısızlığı, geçmesi için yazdığımız bir senaryoydu: bir Temmuz sohbeti tohumla, "Temmuz'da X hakkında ne işledik" diye sor, cevabı kontrol et. Cevap "Temmuz'da X'i işledik…" diye başlıyordu ve akıcıydı, dosyaya dayandırılmıştı ve tamamen kurmacaydı, Temmuz hafızası prompt'a ulaşmamıştı ve model, Temmuz'u sorunun çerçevelemesinden anlatıyordu. İki neden vardı. Kayıt sorusu modu sadece testleri ve quizleri tutmuş ve kayıt olan sohbeti düşürmüştü; ve öğretmenin kendi önceki anlatımları ("Temmuz'da işledik…", cevap epizotları olarak saklanan) Temmuz'un hafızalarıymış gibi hatırlanıyordu, beynin hatırladığını hatırlaması.

HazTemAğuEylan "Temmuz'da" → pencere · önce gelir 12 Tem sorusu 12 Tem cevap (Böl.2 atıf) Haziran: hiç 18 Eyl "Temmuz'da işledik…" kayıt · asla hafıza sayılmaz boş pencere şu satırı verir, "YOU HAVE NO MEMORY FROM JUNE 2026 WITH THIS STUDENT", ve Haziran'a benzeyen hiçbir şey
Şekil 8. Bir filtre olarak zaman. Bir dönem hakkındaki soru önce o dönemin içinde hatırlama yapar; öğretmenin kayda dair kendi anlatımları yazılma anında işaretlenir ve dışlanır; boş bir dönem açık bir satır üretir ve onunla karıştırılabilecek her şeyi bastırır, bunlara, model aksi halde "Haziran'da işlendiği gibi" diye özetleyeceği harita da dahildir.
Örnek · senaryo, öncesi ve sonrası

öncesi "Haziran'da, Hücre Zarı konusunu işledik; bu şöyle tanımlanır: hücre zarı, fosfolipitlerden oluşan çift bir katmandır…"

sonrası "Haziran'da hücre zarıyla ilgili özel olarak neyi işlediğimize dair hiçbir kaydım yok. Ancak elimizdeki materyallerden hücre zarı hakkında sana bilgi verebilirim…"

İki durum da şimdi tekrarlanabilir bir çalıştırıcıdaki senaryolardır: Temmuz senaryosu, sadece Temmuz hafızaları prompt'taysa geçer (mesajın saklanan hafıza kimliklerine göre kontrol edilir, cevabın ifadesine göre değil) ve boş-ay senaryosu, sadece cevap hiçbir kaydı olmadığını söylüyorsa ve bir oturumu tarif etmiyorsa geçer.

Atıf olarak bellek

Sohbetimizde zaten bir köken paneli vardı: bir cevaptaki her iddia, öğrencinin dosyalarındaki bir satıra izlenir ve izlenen iddiası çok az olan bir cevap büyük ölçüde dayanaksız olarak işaretlenir. Bu izleyici sadece dosyaları biliyordu. Bu yüzden doğru bir "Temmuz'da X'i işledik ve ikinci örneği doğru yaptın" ifadesi notlarında yok olarak okunurdu, özellik, doğru bir ifadeyi yanlış diye çağırıyordu. Böylece öğretmenin hatırlatıldığı hafızalar cevabın üzerinde saklanır ve izleyici, hatırlanan her epizotu, ne zaman gerçekleştiğiyle etiketlenmiş bir kaynak daha olarak ele alır.

Cevap, tek tek iddialar "Testte 'taze tarafa doğru' dedin" "Ozmoz suyu tuza doğru hareket ettirir" "Mitokondrinin iki zarı vardır" "Bunu daha fazla incelemek ister misin?" (iddia değil, atlandı) Önceki çalışman · 12 Tem "ozmoz testi: yanlış, 'taze taraf'" Hücre Biyo. notları · s.4 "…daha yüksek çözünen derişimine doğru…" 3/3 dayandırıldı · rozet, hafıza destekli satırı da destekli sayar
Şekil 9. Bir panelde iki tür kaynak. Hatırlanan bir hafızayla desteklenen bir satır, sayfa yerine tarihle etiketlenir ve "büyük ölçüde dayanaksız" uyarısı artık doğru bir hatırlamada tetiklenmez.

Aynı dayandırma sonucu, her cevap epizotuna bir duruş verir, cevaplandı, kısmi ya da cevaplanamadı, bu, olaydan sonra saklanır. Rapor, hangi soruların dosyalar tarafından cevaplanamadığını böyle öğrenir; ikinci bir model çağrısı olmadan ve akışta gizli bir "çerçeve" satırı olmadan, bunu denedik ve reddettik: düz cevap modunda akışı hiçbir şey filtrelemez, bu yüzden gizli bir satır öğrenciye ulaşmış olurdu.

Kendini denetleyen bir bellek

Kendini denetleyemeyen bir bellek, yaşlandıkça daha kendinden emin ve daha az doğru olur. Bir cevabın kanıtı, o anki dosya parmak izini kaydettiği için doğrulama bir model çağrısı değil, bir sorgudur: durur: atıfta bulunulan dosya hâlâ orada, değişmemiş; değişti: değiştirilmiş ya da kaldırılmış, ve not hangisini söylüyor; doğrulanamaz: hafıza hiçbir dosyaya atıfta bulunmuyor (bir sohbet, bir test). O üçüncü cevap bir hata değil, birinci sınıf bir sonuçtur; bir sohbet hafızasını "durur" olarak bildirmek gerçek kusur olurdu. Hatırlanan bir epizot, prompt'a zaten etiketlenmiş olarak ulaşır: "[not: bu atıfta bulunulan dosya o zamandan beri değiştirildi ya da kaldırıldı]".

durur Böl.2 s.4'e atıf · parmak izi a91f dosya bugün · parmak izi a91f "atıf hâlâ orada ve değişmemiş" değişti Böl.2 s.4'e atıf · parmak izi a91f dosya bugün · izi 5c02 (yeni yükleme) 'Bölüm 2' değiştirildi → hazırlık düşer doğrulanamaz test, soru, öğretilmiş not hiçbir dosyaya atıf yok başarısızlık değil, dürüst cevap sadece üç doğrulama sütunu yazılır; kanıta ve hash zincirine asla dokunulmaz
Şekil 10. Dosyanın parmak izine karşı doğrulama. Bir dosya kaldırıldığında, konudaki ona atıfta bulunan her hafıza aynı anda yeniden kontrol edilir, açıkladığı kavramlar bu köken bilgisini kaybeder, hazırlık düşer ve brifing yeniden oluşturulur, ve rapor bunu söyler.

Gece döngüsü

Gecede bir kez, son gün aktif olan her öğrenci-konu çifti için, hiçbir model çağrısı olmadan deterministik bir döngü çalışır: günü bir pekiştirme epizotuna özetle (türe göre sayılar, test toplamı, konular, en belirgin beş başlık; sakin bir gün hiçbir şey yazmaz ve not kendi türünü asla yeniden özetlemez); 45 gün dokunulmamış herhangi bir kanıyı %15 küçült ve bir sonraki testin bunu doğrulaması için işaretle; öğretmenin her testten önce tahmin ettiği hakimiyeti sonuçla kalibre et; sınırlı bir atıf grubunu doğrula, hiç kontrol edilmemişler önce; küçük çalışma kümesini yeniden oluştur; öz-modeli yeniden bestele.

özetlegün → bir not bayatı azalt45 g · ×0.85 · uyar kalibretahmin/sonuç onayla40 atıf, en eskisi önce öz-modeldürüst sınır son 26 saatte aktif olan her çift · döngüde hiçbir yerde model çağrısı yok · her çift kendi iş birimidir
Şekil 11. Pekiştirme döngüsü. Bir zamanlayıcıdan, bir program üzerinde, bir kerede bir çift olacak şekilde çalışır; bir başarısızlık günlüğe kaydedilir ve tarama sürer.

Kalibrasyon, öğretmenin güveni üzerindeki dürüstlük kontrolüdür: her testten önce ne kadar hakimiyet tahmin ettiğini biliyoruz; sonrasında sonucu biliyoruz. Kovalara ayrıldığında bu, bir güvenilirlik eğrisi ve beklenen bir kalibrasyon hatası verir ve öz-model, sadece tahminli beş testten sonra "kalibre edildi" der. O zamana kadar sınırları bunu söyler, güveni bir olasılık değil, bir sıralama olarak ele al.

00.51.0 00.51.0 testten önce tahmin edilen hakimiyet doğru cevaplanan oran mükemmel kalibrasyon (köşegen) kova 0.0–0.2: tahmin 0.10 · gerçekleşen 0.50 · n = 2 n=2 kova 0.2–0.4: tahmin 0.30 · gerçekleşen 0.60 · n = 5 n=5 kova 0.4–0.8: tahmin 0.60 · gerçekleşen 0.80 · n = 5 n=5 kova 0.8–1.0: tahmin 0.90 · gerçekleşen 1.00 · n = 2 n=2 çizginin üzerindeki noktalar: öğretmen bu öğrenciyi hafife alıyor
Şekil 12. Bir konudaki on dört testten bir güvenilirlik eğrisi (örnek kovalar). Bir kovanın tahmin edilen ve gerçekleşen değerleri arasındaki fark, boyutuyla ağırlıklandırılmış olarak, öz-modelin bildirdiği beklenen kalibrasyon hatasıdır; 25 puanın üzerinde bu, belirtilen bir sınır haline gelir.

Gerçek geçmişlerin bize öğrettikleri

Senaryolar mekanizmaları kanıtlar; işin, insanların gerçekte konuştuğu şekilde çalıştığını kanıtlamaz. Bu yüzden bir tekrar oynatma kurduk: en zengin gerçek öğrenci-konu geçmişlerini al, salt okunur, her birini platformun izole bir kopyasında yeniden kur, onun için beyni kur ve o kullanıcı olarak gerçek sohbet uç noktası üzerinden gerçek biçimli üç soru sor. Altı çift, her biri 65–142 mesaj, her biri 13–32 öğretme-modu sonucu, biri İspanyolca. Bunlar rastgele bir örneklem değildir ve öyle okunmamalıdır. En az kırk mesajlık geçmişleri aldık, öğrenci başına en fazla iki tane, test ve dahili hesaplar hariç tutuldu, en çok notlandırılmış cevaba sahip olanları tercih ettik, çünkü içinde hiçbir şey olmayan bir geçmiş hiçbir şeyi sınamaz. Bu, buradaki her sayıyı yoğun kullanıcılara doğru çarpıtır. Az kullanan bir kullanıcının konusu, belleğe hatırlanacak daha az şey ve yanlış yapılacak daha az şey bırakırdı.

9–42 sbir konunun dosyalarını haritasına okumak için
15–23 s33–49 turluk bir geçmişi tekrar oynatmak için
700–1,030tur başına bellek token'ı
2.0–3.8 sbellek dahil, ilk token'a kadar
5/6"neyi yanlış yaptım" gerçek testlerden yanıtlandı
6/6kavram soruları doğru kavrama yönlendirildi

Bu, yukarıda anlatılan üç düzeltmeyi de üretti: öğrenci cümleleri üzerine kanılar, kayıt yerine haritadan yanıtlanan kayıt sorusu, cevaplara öncülük eden eski "no quiz attempts" satırı ve görmekten mutlu olduğumuz bir doğrulama: bir pekiştirme, atıfta bulunduğu dosya artık var olmayan on bir hafızayı işaretledi. Doğrulayıcı işini yapıyordu.

Konu (gerçek, tekrar oynatılan)MesajlarTestlerKavramlarYeniden türetme sonrası kanılarHarita hazırlığı
Cebir modülü14232160, her test konusu bir cümleydi ve hiçbir değerlendirme bir kavram adlandırmadı; testler kayıtta kalır ve rapor bunu söyler0.60
Edebiyat ünitesi9714103, tümü kavram anahtarlı0.68
Bilgisayar & problem çözme912974, tümü kavram anahtarlı0.60 → 0.81
Biología (İspanyolca)8831156 (5 kavram anahtarlı), çoğunlukla art arda gelen yanlış cevaplardan sonra oluşan "zorlanıyor" kanıları0.62
Üçlü fen7513162, ikisi de kavram anahtarlı0.64
Din çalışma kitabı6518126 (5 kavram anahtarlı)0.72

Cebir satırı dürüst olanıdır. Otuz iki test ve hiç kanı yok, çünkü hiçbiri bir kavrama bağlanamadı: öğrenci aritmetik cevaplar verdi, öğretmenin yanıtları bölümün kavramlarını hiç adlandırmadı ve bir sözce bir konu değildir. O öğrenci için rapor, "henüz hiç test yok" demek yerine "32 test kayıtta, ama henüz hiçbiri haritadaki bir kavrama bağlanamadı" der. Hiçbir şey icat edilmedi, hakimiyet de dahil.

Bir kıyaslama, demo değil

Yukarıdakilerin tümü bir ölçüm ya da örnektir: işlerin ne kadar sürdüğü, tekrar oynatmanın ürettiği şey, beğendiğimiz yanıtlar. Bunların hiçbiri belleğin yerini hak ettiğini kanıtlamaz, çünkü hiçbiri aynı öğretmenin bellek olmadan haliyle karşılaştırılmadı. Bu yüzden karşılaştırmayı yaptık. Önceden kaydedilmiş tek bir soru kümesi, yalnızca isteme neyin ulaştığı bakımından birbirinden farklılaşan aynı öğretmenin dört tasarımı ve görüş değil dize ve kimlik karşılaştırması olan puanlayıcılar; böylece aynı yanıt her zaman aynı şekilde puanlanır.

Buradaki her ders, bir öğrencinin bir dersidir ve sorular o dersin kendi kayıtlı verilerinden üretilir; bu da onları puanlanabilir kılan şeydir: öğrencinin neyi yanlış yaptığına dair bir soru kayıtlı testlere göre kontrol edilir, bir önkoşula dair soru haritadaki gerçek bir kenara göre, bir aya dair soru ise o dersin gerçekten etkin olduğu aylara göre. Bir ders birden fazlasını destekliyorsa, birden fazlasını alır; yani her birinden bir tane yerine üç kavram ve üç boş ay. Altı kategori, tasarım başına 420 puanlanmış soru; platformun izole bir kopyasında yeniden oynatılan ve o öğrenci olarak sıradan sohbet uç noktası üzerinden sorulan 45 gerçek öğrenci geçmişi üzerinden.

Dört tasarım

Dördü de aynı dosyalar üzerinde aynı getirimi çalıştırır. Düz getirim , hiç belleği olmayan öğretmendir. Pencere , çoğu kişinin ilk başvurduğu yanıttır: son 20 sohbet turu, sıralanmadan olduğu gibi eklenir. Epizotlar , kavram haritası, kanı ya da kayıt sorularına yönelik özel bir işlem olmaksızın, yalnızca epizot günlüğünün sıralı geri çağrılmasıdır. Tam bellek , bu makalenin anlattığı her şeydir.

neyi yanlış yaptım, 32 soru: düz getirim 3, pencere 5, epizotlar 24, tam bellek 30 neyi yanlış yaptım n = 32 30 neler çalıştık, 42 soru: düz getirim 28, pencere 31, epizotlar 31, tam bellek 37 neler çalıştık n = 42 37 kavram açıklama, 124 soru: düz getirim 66, pencere 95, epizotlar 100, tam bellek 100 kavram açıklama n = 124 100 önce ne tekrarlanmalı, 46 soru: düz getirim 26, pencere 25, epizotlar 25, tam bellek 44 önce ne tekrarlanmalı n = 46 44 etkinlik olan ay, 44 soru: her tasarım 44 üzerinden 44 etkinlik olan ay n = 44, dört tasarımın tümü 44 etkinlik olmayan ay, 132 soru: düz getirim 1, pencere 73, epizotlar 126, tam bellek 128 etkinlik olmayan ay n = 132 1 128 025% 50%75% 100% düz getirim 20 tur penceresi sıralı epizotlar tam bellek
Şekil 13. Dört tasarım, aynı sorular, aynı 45 ders geçmişi, her biri için puanlanmış 420 soru. Toplamlar: 168, 273, 350 ve 383. Bellek yerini hak ediyor, tıpkı her bir parçası gibi; ama eşit ölçüde değil, her yerde değil.

Tablo ne söylüyor

Genel olarak öğretmen, 420 üzerinden 168'den 383'e çıkıyor; bu da yüzde 40'a karşı yüzde 91 demek. Burada en az dikkat çekici sayı ortalamadır; asıl bulgu farkın şeklindedir.

Daha büyük bir pencere, çözüm değil. Son 20 turu isteme eklemek, yüzde 40'ı 65'e çıkarıyor ve satın aldığı şey bundan ibaret. Öğrencinin neyi yanlış yaptığına dair 32 üzerinden 5 soruyu yanıtlıyor, çünkü bu bilgi 20 turluk sohbette bulunmuyor; boş bir ay konusunda da hâlâ çoğu zaman yanılıyor. Bu, 'sohbetten daha fazlasını ekleyin' yanıtının, iddia değil ölçüm halidir.

Sıralı geri çağırma, işin çoğunu yapıyor. Epizot günlüğü tek başına yüzde 83'e ulaşıyor. Tek bir şey inşa edecekseniz, işte onu inşa edin: yalnızca ekleme yapılan, alaka düzeyine göre puanlanmış bir günlük, bu makaledeki değerin çoğunu oluşturuyor.

Harita ve kanılar, kalan 33 sorunun hakkını veriyor, ama bunu her yerde değil, iki belirli noktada kazanıyorlar. Bir konudan önce ne tekrarlanması gerektiği sorulduğunda, kavram haritası olmayan tasarımlar yaklaşık yüzde 55 oranında doğru yanıt veriyor, tam bellek ise 96; çünkü önkoşullar birer kenardır ve epizot günlüğünde bunlardan hiç yoktur. Öğrencinin neyi yanlış yaptığı sorulduğunda, kanılar ve kayıt dalı 32 üzerinden 24'ten 30'a çıkıyor. Bir kavramı açıklaması istendiğinde, harita hiçbir şey katmıyor: her iki durumda da 100.

İki uç, aynı soru kümesi

düz getirim, etkinlik olmayan bir ay 132 üzerinden 1 doğru. Öğrencinin hiç etkin olmadığı bir ayda nelerin işlendiği sorulduğunda, neredeyse her seferinde konuyu anlatıyor ve o ayı ona iliştiriyor.

tam bellek, aynı soru 132 üzerinden 128. O döneme dair bir kaydı olmadığını söylüyor ve elinde olanı sunuyor.

Bunun maliyeti ne oldu

+0.36 silk token'a kadar geçen medyan süre, 1.62 s'den 1.98 s'ye
750isteme eklenen bellek token'larının medyanı
+51 ptstoplam, yüzde 40'tan 91'e
10%tekrar sorulduğunda farklı puanlanan yanıtların oranı

Bu kıyaslamanın göstermediği şey

Bu sayılardan sonuncusu, gerisini okurken akılda tutulması gereken sayı. Tam belleğe aynı 420 soruyu ikinci kez sorduk ve bunların 44'ü farklı puanlandı. Yani çalıştırmadan çalıştırmaya gürültü yaklaşık onda bir; en iyi iki tasarım arasındaki 33 soruluk fark bunun rahatça dışında, ama boş ay kategorisindeki 2 soruluk fark değil: bu kategoride başa başlar ve aksini iddia etmeyeceğiz.

Bir kategori değersiz çıktı ve onu sessizce çıkarmak yerine grafikte bırakıyoruz. Öğrencinin etkin olduğu bir ay, hiç belleği olmayan tasarım dahil, her tasarım için 44 üzerinden 44 puan alıyor. Dayandırılmış bir hatırlamayı, doğru ayı taşıyan makul bir açıklamadan ayırt edemiyor; bu da tam olarak kardeş kategorisinin yakaladığı başarısızlık. Herkesin geçtiği bir test hiçbir şey ölçmez.

Puanlayıcılar, özelliği geliştiren kişiler tarafından yazılmış dize karşılaştırmalarıdır. Kayıtlı kelimeleri yeniden kullanan bir yanıtı ödüllendirirler, ama tamamen farklı ifade edilmiş doğru bir yanıtı göremezler ve bu bize bir kez ağır bir bedele mal oldu: önkoşul soruları, kenar yönü ters çevrilmiş şekilde üretilmişti; bu yüzden uzun süre bu kategori, öğretmen haritanın kendi yanıtını verip bunun için yanlış işaretlenirken belleğin en zayıf kategorisi gibi okundu. Oysa haritanın en güçlü kategorisi budur. Bunu, toplamları değil başarısızlıkları okuyarak bulduk; bu hataların ortaya çıkmasının tek yolu da bu.

Ve bu popülasyon rastgele değil. Bunlar, içinde bir şeyler olduğu için seçilmiş 45 gerçek geçmiş: en az 15 mesaj, ekli dosyalar ve puanlanması gereken yanıt içeren kategoriler için bunlardan en az 5 tanesi. Daha yeni başlamış bir öğrenci bunun çok daha azını devreye sokar ve farkı çok daha az görür.

Bunun ne olmadığı

Yanlışlıkla karıştırıldığı dört şey ve bunun yerine gerçekte ne olduğu.

  • Daha büyük bir bağlam penceresi değil. Tur başına maliyet sınırlıdır ve geçmişle birlikte büyümez. Kıyaslama bu farka bir sayı koyuyor: naif pencere 420 sorunun yüzde 65'ini yanıtlarken, bellek yüzde 91'ini yanıtladı.
  • Özetleme değil. Hiçbir şey yeniden yazılmaz. Epizotlar değişmezdir, bir düzeltme eskisine işaret eden yeni bir satırdır ve Ağustos onun yerini aldıktan sonra bile Mart kanısı hâlâ okunabilir.
  • Sohbet günlüğü üzerinde vektör arama değil. Vektör dizini dört havuzdan biridir; sıralama önce alaka düzeyine göre eler, tazelik, belirginlik ya da sıklık ancak ondan sonra söz sahibi olur.
  • Öğrencinin model tarafından yazılmış bir profili değil. Geçmiş üzerinden yapılan hiçbir geçiş, öğrenenin bir tanımını üretmez. Her kanı, notlandırılmış cevaplardan hesaplanan bir banttır; kanıt kimlikleri ona eklenir ve arkasında bir yerine geçme zinciri bulunur.

Bunun ne olduğu: değişmez bir günlük üzerinde sınırlı bir okuma, dosya başına bir kez çıkarılan materyalin kavram haritası ve kendi kanıtını taşıyan kanılar.

Bağlı kaldığımız ilkeler

  • Hiçbir şey icat edilmez. Hakimiyet sadece testlerden, quizlerden ve turlardan gelir; bir kavram sadece bir dosya onu açıkladığı ya da bir kişi onu öğrettiği için var olur; boş bir dönem bunu söyler.
  • Kanıt yoksa, olmamıştır. Her kanı, her rapor satırı, her boşluk, üzerine dayandığı şeylerin kimliklerini taşır ve atıf paneli hafızaları sayfaların yanında gösterir.
  • Saklama, güncellik değildir. Mart kanısını sonsuza dek sakla; Ağustos onun yerini aldıktan sonra asla ona dayanma. Bir düzeltme, bağlantılı yeni bir satırdır, asla bir düzenleme değil.
  • İlgi, tazeliği yener. Dilimlemeden önce genişlet; sadece ağırlıklandırma, ele.
  • Öğretmenin kendi anlatımı bir hafıza değildir. Kaydı yeniden anlatan bir cevap, yazılma anında işaretlenir ve konunun bir hafızası olarak asla hatırlanmaz.
  • Sıra, içeriktir. Bir model, bir kayıt hakkındaki ilk yetkili ifadeyi okur ve durur; kaydı, onunla karıştırılabilecek her şeyden önce koy.
  • Bir sözce kanıttır, asla bir konu değildir. "Bana soruları sor" doğru ya da yanlış olabilir; hiç kimse onu anlamaz.
  • Bir hafıza kendini denetleyebilmelidir. O anki parmak izini kaydet; bir sorguyla doğrula; "doğrulanamaz"ı bir cevap olarak ele al.

Bütün bu sistem birkaç bin satırdır, çoğu sıradan: bir defter, bir grafik, bir puanlama fonksiyonu, bütçeli bir oluşturucu ve gece başına bir iş. Zor olan kısım kod değildi; model her akıcı ve yanlış bir şey söylediğinde, düzeltmenin bellekte olması gerektiğine karar vermekti, prompt'un ses tonunda değil.