Kad no 11. jūlija palaid ollama bez papildu argumentiem, terminālī vairs neparādās komandu saraksts. Tā vietā atveras interaktīvs aģents, kas piedāvā tērzēt ar modeli, rakstīt kodu, meklēt tīmeklī un deleģēt uzdevumus. To ievieš versija v0.32.0, un pēc dažām dienām sekoja v0.32.1 ar labojumiem.
Izmaiņa maina to, kā rīks izturas pret pašu ierastāko ievadi. Līdz šim ollama bija komandrindas palaidējs lokāliem modeļiem: ollama run llama3 lejupielādēja modeli un atvēra sarunu. Tagad tukša komanda ir ieeja aģentā, kas var sniegties ārpus tavas mašīnas.
Ko tieši dara jaunais aģents
Ollama savā v0.32.0 laidiena piezīmēs aģenta iespējas apraksta īsi: tērzēt ar modeļiem, kodēt, meklēt tīmeklī un deleģēt reālu darbu. Tērzēšana un koda palīdzība strādā lokāli ar modeli, ko esi palaidis. Tīmekļa meklēšana un lapu ielāde ir citāda: kad aģentam tās vajag, tas prasa palaist ollama signin un pieteikties Ollama kontā.
Tas ir pagrieziens rīkam, ko izstrādātāji pazina kā veidu, kā modeļus darbināt bez interneta un bez konta. Lokālā tērzēšana joprojām neprasa pierakstīšanos, taču tīmekļa funkcijas iet caur Ollama mākoni.
«Deleģēt reālu darbu» ir aģenta ceturtā funkcija, un tā ir arī nekonkrētākā. Praksē tas nozīmē, ka aģents var izsaukt rīkus un darbināt vairāku soļu uzdevumus, nevis tikai atbildēt uz vienu jautājumu. Tieši šai daļai v0.32.1 pievienoja labojumus: aģents tagad saņem pašreizējo darba mapi, tāpēc uz koda un failu uzdevumiem tas atbild ar reālu projekta kontekstu, nevis tukšā.
Laidiens pārsauc arī vienu integrāciju: agrākais «Codex App» tagad ir «ChatGPT», un to atver ar ollama launch chatgpt. Palaišanas izvēlnē Ollama izceļ populārākās iespējas.
Vecie modeļi dabū brīdinājumu
Kopā ar aģentu v0.32.0 sāk rādīt novecošanas brīdinājumus vairākiem modeļiem, ko aģents izmanto: CodeLlama, Qwen2.5, Llama 3.x, Mistral, StarCoder un bāzes DeepSeek-R1. Brīdinājums nozīmē, ka Ollama grib šos modeļus aģenta darbā aizstāt ar jaunākiem. Gemma 4 tas jau uzlaboja — v0.32.1 salaboja rīku izsaukšanu un vairāku soļu spriešanu, lai atbildes uz rīku izsaukumiem turpinātos uzticamāk.
Novecošanas brīdinājums pagaidām nenoņem modeļus. Tos joprojām var lejupielādēt un palaist ar ollama run, taču aģenta darbam Ollama iesaka pāriet uz jaunākiem modeļiem, kas rīku izsaukšanu apstrādā uzticamāk. Sarakstā ir tieši tie modeļi, kas divus gadus bija noklusējuma izvēle lokālam kodam un tērzēšanai, tāpēc daudzi to redzēs pirmajā palaišanā pēc atjaunināšanas.
v0.32.1 nāca 16. jūlijā ar tehniskiem labojumiem. Ollama aizvēra atmiņas noplūdi MLX modeļu kešatmiņā un paātrināja momentuzņēmumu veidošanu. MLX teksta modeļu ielāde tagad ievēro OLLAMA_LOAD_TIMEOUT. Interaktīvais aģents saņem pašreizējo darba mapi, lai labāk saprastu projekta kontekstu, un ollama launch modeļu izvēle atkal strādā ar novecojušiem modeļiem.
Aiz laidiena stāv 88 miljoni dolāru
Nedēļu pirms aģenta, 9. jūlijā, Ollama paziņoja, ka piesaistījusi 88 miljonus dolāru. Raundu vada Benchmark (Pīters Fentons), Theory Ventures (Tomašs Tungušs) un 8VC (Alekss Koļičičs). Starp eņģeļu investoriem ir Docker dibinātājs Solomons Haikss un ClickHouse vadītājs Ārons Katss.
Uzņēmums saka, ka to lieto 8,9 miljoni izstrādātāju un 85 % Fortune 500 uzņēmumu. Ollama mākoņa žetonu apjoms vidēji vairāk nekā divkāršojas katru mēnesi. Nākotnē uzņēmums grib likt uzsvaru uz hibrīda inferenci — lokālu un mākoņa modeļu apvienojumu vienā rīkā — un uz atbalstu jauniem atvērtajiem modeļiem tajā pašā dienā, kad tie iznāk.
Šie skaitļi izskaidro mākoņa funkciju parādīšanos. Lokāla modeļa darbināšana neko nemaksā un neražo žetonu apjomu, ko var pārdot. Mākoņa inference un tīmekļa meklēšana caur ollama signin ir tur, kur nauda un investoru piesaistītais raunds sāk atmaksāties. Aģents ir saskarne, kas šīs mākoņa funkcijas noliek izstrādātājam priekšā jau pirmajā komandā.
Mēs jau reiz stāvējām šāda pavērsiena sākumā, derot, ka atvērts un vienkāršs uzvarēs. Mēs deram uz to atkal, ar visu, kas mums ir.
Šī derība izskaidro, kāpēc tukšā ollama komanda tagad ved uz aģentu, nevis modeļu palaidēju. Rīks, kas sākās kā vietējs modeļu darbinātājs, kļūst par saskarni, kur lokālais modelis un mākoņa pakalpojumi satiekas vienā logā.
Ko tas nozīmē skriptiem
Ja tavos skriptos vai dokumentācijā ollama bez argumentiem tika izmantots, lai parādītu palīdzību vai pārbaudītu, vai rīks ir instalēts, jaunā uzvedība to lauž. Skaidrās apakškomandas — ollama run, ollama pull, ollama list, ollama serve — strādā tāpat kā agrāk. Mainījusies ir tikai tukšā izsaukuma nozīme.
Ollama arī atjaunoja dokumentāciju savai oficiālajai VS Code paplašinājumam. Kopā ar to un aģenta pievienošanu redzams, kurp uzņēmums virza rīku: no komandas, ar ko lejupielādē modeli, uz vidi, kurā izstrādātājs pavada darba sesiju. Kurš no diviem laukiem — lokālā privātā inference vai mākoņa aģents — nesīs vairāk lietotāju, izšķirs nākamās versijas.
Komentāri
Šim rakstam vēl nav komentāru. Esi pirmais, kurš dalās ar savu viedokli.