Share.

    30 Kommentare

    1. CementMixer4000 on

      Miks ma peaks vabatahtlikult hiinlastele oma infot andma, las näevad vaeva selle jaoks.

    2. Täna õhtul plaanisin uurida. Kui midagi huvitavat leian postin homme 🙂

    3. hea_kasuvend on

      Olen 4 või 5 päeva kasutanud; DeepSeek on mõnevõrra asjalikum kui ChatGPT koodimise osas (haarab rohkem konteksti korraga ja väljendub kiiremini), ja tõlketöid teeb umbes samaväärselt. Samuti ei ürita ta sinust targem olla ja ise mingit sitta juurde hallutsineerida. Koodi osas, tõsi, kipub iga rida kommenteerima ja unustab ruttu ära kui keelasid.

      Kiirus ja vähem limiite oligi peamine pluss alguses, aga nüüdseks on serverid ennast sama kooma tõmmanud kui ChatGPT omad. Reasoning tokenite nägemine mulle väga meeldib, lihtsalt uudishimust, mis kapoti all on.

      Muud juttu pole selle robotiga veel ajanud, aga ei kipu ka midagi isiklikumat hiinasse postitama.

    4. Investigaator_188 on

      Andsin GPT ja DS jaoks ülesande teha lihtne püütoni skript: BeautifulSoup teeki kasutades tõmmata ilmaportaalist andmed ning saata meilile hoiatus kui minu talu kohal on 24h jooksul oodata tugevat tuult kirde suunalt.

      GPT oli oluliselt kiirem. Mõlemad hakkasid probleemi õigest otsast lahendama aga esimese paari korraga ei saanud hakkama. Siis tegin ülesande juppideks. GPT sai peale paari veaparandust tööga hakkama. DS hämas rohkem. Ajas klassid segamini ning ei tahtnud sõna kuulata kui ninapidi probleemi sisse torkasin. DS puhul oli hea see, et ta kirjutas oma mõtlemise loogikat rohkem lahti kui GPT. See tõstab usaldusväärsust kasutajakogemuse osas, et ma näen rohkem mis sisemine monoloog tal seal toimus.

      Lõppkokkuvõttes: Abi oli mõlemast aga ma jään GPT juurde kuna DS nvn paari nädala pärast tõmbab oma kiirused veelgi alla ning parema tulemuse jaoks peab tulevikus ikkagi maksma. GPT oli ka tasuta kujul väga reibas mingi hetk kui reklaamida oli vaja. Kui kasutajad käes, siis saab raha hakata küsima. Neil on see vana hea barõgade ärimudel, et esimene gramm on tasuta ja edasi maksad sest ilma ei saa.

    5. Kasutasin, et lehe kujundust paremaks teha deep seekiga. Jõudsin järeldusele, et Claude Sonnet on ikka asjalikum, kuigi kiiremini saab limiit täis

    6. r2k-in-the-vortex on

      Töötab väga hästi, kipub jube pikalt küsimust lahkama, aga lõplik vastus mis kokku saab on üldjuhul enam vähem asjalik.

      Tsensoreeritud muidugi, aga mul ei olegi tahtmist chatbotiga poliitika, ideoloogia või ajaloo teemadel diskuteerida, ma lihtsalt tahan et ta minu eest töö ära teeks.

    7. USA tech firmad kaotasid nii palju väärtust, kuna hiinlased tõestasid, et suur keelemudelit on võimalik treenida ka palju vähema hulga GPUdega kui varem arvatud. Kuna USA kehtestas Hiinale chippide eksportide osas sanktsioonid, pidid sealsed helgemad pead ajutööd tegema, et kuidas vähemate vahenditega rohkem saavutada, ja seekord läks õnneks. Tegid 6 milliga mudelid mille treenimiseks USA firmadel on kulutanud paar suurusjärku enam raha, see ka tähendab, et tulevikus nõudlus NVIDIA riistavara järele ei pruugi olla nii suur kui varem arvatud. Kokkuvõttes on see maailmale siiski hea uudis, kuna sama hulga väärtuse jaoks on vaja tulevikus selles valdkonnas kulutada märkimisväärselt vähem ressursse. Muidugi kuna see on Hiina päritolu mudel, siis selle käest Hiina valitsusele mitte meeldivate asjade kohta selle käest küsida ei saa või annab nendel teemadel mittemidagiütlevaid vastuseid. Aga õnneks on mudel ja kood vabavaraline, seega kõik saavad seda näppida ja edasi arendada. Suurim ‚uus asi‘ on siis see Mixture of Experts lähenemine, mis vähendas oluliselt mudeli treenimisega seotud kulusid ja mis tähendab, et mudeli jooksutamine on ka kordades odavam kui nt OpenAI, Claude või Meta mudelite jooksutamine.

    8. Objective-Wheel-8925 on

      Suht game changer saab see olema. Pääsesin ligi, ilmselgelt on tsensuur peal, tegemist siiski Hiinaga ju aga mudel on ise on võrreldav 01-ga või kohati parem. Võimalus näha mudeli arutlust, kuidas ta jõuab teatud järelduseni jne.

      Eriti lahe on see, et kogu mudel on Open source ja selle loojad on detailselt ära seletanud, kuidas nad antud tulemuseni jõudsid. Kommenteerijad, kes ütlevad, et trash või ChatGPT temust ei tea, millest nad räägivad.

      Väidevalt saab vähendatud mudeleid lokaalselt ka jooksutada üsna mõistliku raua peal, mis pidi isegi üsna lähedal olema chatgpt-le. Ise pole veel olnud aega proovida seda.

    9. Such_Maintenance_541 on

      Täitsa adekvaatne. Teksti stiil on minu arust parem kui chat GPTl. See on normaalne, et pole vaja pappi köhida, et korraliku versiooni kasutada.

    10. Foreigncharazar on

      Küsisin mis Taiwani kohta arvab, väidab et on Hiina Rahvavabariigi osa, inimesed tahavad ühendada. Ütlesin et las USA vaatab valimisi pealt kui ühinevad ja kui midagi valesti on siis sekkub sõjaliselt. Vastust selle peale ei tulnud.

    11. MolassesFluffy8648 on

      Arvestades, et teistel suuri edasiminekuid pole olnud juba pikka aega, siis igati positiivne, et see on siin ilusti open source. Ehk toob need pooletoobised seal miljardiettevõtetes tagasi maa peale ja näitab, et open source on ainus tegelik viis edasi. Raha paneb asjad paika ja investorid näevad ka, et seda mida need Google, OpenAI/Microsoft jms teevad on lihtsalt pask ja enam raha ei anna. Positiivne. Akadeemiline lähenemine ongi kõige õigem AI ehitusel ja mitte mingi suletud kaka.

    12. Capable-Anything269 on

      Täna päeval kell 14.49 küsisin mõlema käest, et annaks mulle riikide listi, kus just praegusel ajahetkel on kell 17.49.

      ChatGpt sai sellega lõpuks hakkama, kui küsimuse kuuendat korda ümber sõnastasin, ehk et andis 5 vale vastust. Üritas pidevalt toppida Islandit, UK-d ja jahus ajavööndite ja UTC kohta üldist mula.

      Deepseek sai sama asjaga hakkama kolmandal katsel, ehk siis küsimust järgemööda ümber sõnastades andis enne õige vastuseni jõudmist kõigest 2 vale vastust.

      Kes ei viitsi googeldada, siis Eesti ajast 3h ees on näiteks Pakistan ja mitmed teised -stanid.

    Leave A Reply