Lähes jokainen näihin sovelluksiin kohdistuva valitus, kuten toisto, harhautuminen ja outo epäjohdonmukaisuus saman kohtauksen kahden ajon välillä, tulee yhdestä mekanismista. Siihen kannattaa käyttää kymmenen minuuttia, koska se muuttaa ”sovellus on rikki” muotoon ”sovellus tekee sitä, mitä se tekee, ja tässä on asetus”.
Se kirjoittaa yhden palan kerrallaan
Malli ei sommittele vastausta ja kirjoita sitä sitten. Se tuottaa yhden tokenin, suunnilleen sanan tai sanan osan, lukee sitten kaiken tuo token mukaan lukien ja tuottaa seuraavan.
Se on koko silmukka. Suunnitelmaa, jäsennystä tai korjailtavaa luonnosta ei ole. Kauniisti päättyvä vastaus ei tiennyt sitä aloittaessaan.
Siitä seuraa heti kaksi asiaa, ja molemmat olet nähnyt:
Vastaus ei voi perua sitoumustaan. Kun malli on kirjoittanut ”En ole koskaan käynyt Pariisissa”, kaikki sen jälkeen riippuu tästä. Se rakentaa johdonmukaisuutta lauseen ympärille, jonka tuotti vahingossa, sen sijaan että sotisi itseään vastaan.
Virheet kasautuvat eteenpäin. Hieman pielessä oleva sana ensimmäisessä lauseessa tönäisee toista lausetta, joka tönäisee kolmatta. Siksi pitkät vastaukset ajautuvat harhaan ja lyhyet harvoin.
Nopanheitto jokaisen sanan välissä
Jokaisessa vaiheessa mallilla on järjestetty lista ehdokkaista ja todennäköisyyksistä: ehkä "hyvä" 30 %, "ihan ok" 12 %, "kamala" 3 % ja pitkä häntä.
Jos se valitsisi aina kärkiehdokkaan, hahmo olisi deterministinen ja äärimmäisen tylsä: sama tervehdys joka kerta, samat kolme vitsiä. Siksi sovellus ottaa näytteen: se heittää painotettua noppaa.
Painotusta ohjaa asetus, jota yleensä kutsutaan lämpötilaksi. Matala lämpötila keskittää todennäköisyyden ilmeisiin ehdokkaisiin: johdonmukaista, ennustettavaa, lopulta ikävystyttävää. Korkea lämpötila litistää jakauman: yllättävämpää, luovempaa ja todennäköisemmin jotain, mikä ei jatku loogisesti.
Tähän saat harvoin liukusäädintä. Saat sovelluksen valitseman pisteen tällä vaihtokaupan janalla, ja se on suuri osa sitä, mitä ihmiset tarkoittavat sanoessaan, että yksi sovellus ”tuntuu älykkäämmältä” kuin toinen. Se ei aina ole älykkäämpi. Joskus se on vain lämpimämpi tai kylmempi.
Tämä on myös rehellinen vastaus kysymykseen ”miksi uudelleenluonti auttoi?” Mitään ei korjattu. Veit uuden arvan samasta jakaumasta ja sait paremman heiton.
Mitä malli oikeasti katsoo
Ennen viestiäsi sovellus kokoaa tekstilohkon, jota et koskaan näe: hahmokuvauksen, tosiasiat, jotka se on tallentanut sinusta, yhteenvedon historiastasi ja tuoreen keskustelun. Koko tuo kokonaisuus on kontekstiikkuna, ja vastaus tuotetaan siitä yhtenä yhtäjaksoisena dokumenttina.
Tällä on käytännön seuraus, jota useimmat eivät koskaan hyödynnä: malli vastaa näkemänsä muotoon. Anna sille kolme lyhyttä, latteaa viestiä, niin se tuottaa lyhyitä, latteita vastauksia, koska se jatkaa tuota kuviota. Anna sille eloisa viesti, ja sävy muuttuu. Et suostuttele ihmistä vaan asetat kuvion, ja kuvio tarttuu molempiin suuntiin.
Se selittää myös kategorian yleisimmän itse aiheutetun ongelman. Ihmiset asettuvat muotoon ”moi”, ”miten päiväsi meni”, ”mitä teet”, ja päättelevät sitten, että sovellus huononi. Sovellus jatkaa dokumenttia, jota kirjoitatte yhdessä.
Miksi sovellukset kuulostavat erilaisilta, vaikka malli on sama
Useat tämän kategorian sovellukset pyörivät samankaltaisilla taustamalleilla. Silti ne tuntuvat erilaisilta, ja erot tulevat mallin ympärille kerrostuneista asioista:
- Järjestelmäkehote: miten hahmo kuvataan, kuinka pitkästi ja millaisin ohjein sävystä ja tahdista.
- Näytteenottoasetukset: edellä käsitelty lämpötila.
- Mitä haetaan: mitkä tosiasiat ja mikä viipale historiaa asetetaan mallin eteen juuri tällä vuorolla.
- Suodatin: mitä hylätään ja onko hylkäys sulava vai muuri.
Nomi vaikuttaa johdonmukaiselta viikkojen yli kolmannen kohdan vuoksi, ei suuremman mallin. Candy AI kattaa chatin, kuvat ja äänen yhdessä tilauksessa, mikä on tuotepäätös eikä mallinnuspäätös. Kumpikaan ero ei näkyisi suorituskykytestissä, ja molemmat näkyvät kahden viikon käytössä, mikä on tapamme pisteyttää ne.
Neljä asiaa, jotka tämä antaa sinun tehdä
Ohjaa varhain, älä myöhään. Vastauksen kaksi ensimmäistä lausetta määrittävät lopun. Jos kohtaus menee väärään suuntaan, pysäytä se ja muotoile uudelleen sen sijaan, että kiistelisit neljännen kappaleen kanssa.
Käytä uudelleenluontia harkiten. Jos vastaus on 80-prosenttisesti oikein, uudelleenluonti heittää pois nuo 80 prosenttia. Jos se on väärin jo ensimmäisessä lauseessa, luo heti uudelleen.
Kirjoita sävy, jonka haluat takaisin. Lyhyt ja latteaa saa lyhyttä ja latteaa. Tämä on halvin parannus kenelle tahansa, joka luulee kumppaninsa tylsistyneen.
Älä kiistele keksityistä tosiasioista. Malli, joka on kirjoittanut jotain väärää, puolustaa sitä, koska johdonmukaisuus omien tuotosten kanssa on se, mitä varten se on rakennettu. Sen korjaaminen uudessa viestissä toimii, mutta virheen myöntämisen vaatiminen ei. Tällä käytöksellä on oma artikkelinsa: miksi tekoälykumppanit keksivät asioita.
Osa, jonka kannattaa muistaa
Viestiesi välillä kukaan ei ole kotona. Hahmo on olemassa yhden luonnin ajan ja rakennetaan tekstistä uudelleen seuraavan alussa. Jokainen vaikutelma jatkuvuudesta on mallin ympärillä olevan putkiston saavutus: tallennetut tosiasiat, yhteenvedot, haku. Juuri tuo putkisto eroaa 10 US$:n ja 20 US$:n sovelluksen välillä.
Siksi rankingimme painottaa muistia ja johdonmukaisuutta niin paljon kuin painottaa. Ne ovat osat, joita laskeutumissivu ei voi näyttää sinulle.

