Ievadot termināļa komandu ollama bez papildu argumentiem, versijā 0.32.0 vairs neatveras īss lietošanas apraksts. Tā vietā palaižas interaktīvs AI aģents ar nosaukumu «Chat, Code, & Work», kas pēc noklusējuma strādā ar mākoņa modeli glm-5.2:cloud. Izmaiņa parādās 11. jūlijā publicētajā laidienā. Tā maina to, ko izstrādātājs redz pirmajā mirklī pēc rīka palaišanas.
Ollama līdz šim bija pazīstams kā rīks lokālu valodas modeļu palaišanai uz sava datora. Komanda ollama run joprojām lejupielādē modeli un palaiž to uz vietas, taču jaunā noklusētā saskarne pieprasījumus sūta uz mākoni. Tīmekļa meklēšanai un satura ielādei aģents prasa pieteikšanos ar ollama signin.
Ko dara «ollama» bez argumentiem
Aģents apvieno četras darbības vienā saskarnē: sarunu ar modeli, koda rakstīšanu, tīmekļa meklēšanu un darba deleģēšanu. Iepriekš tā pati komanda tikai izdrukāja pieejamo apakškomandu sarakstu. Tagad tā uzreiz atver darba vidi, kuras pamatā ir glm-5.2:cloud. Saskarne ir interaktīva, tāpēc lietotājs var pārslēgties starp šīm darbībām bez atsevišķām komandām.
Palaižot
ollama, startē aģents, kas palīdz rakstīt kodu un deleģēt darbu. Noklusētais modelis glm-5.2:cloud darbojas mākonī, tāpēc meklēšanai un ielādei vajadzīga pieteikšanās.
Deleģēšana ir jaunākā no četrām funkcijām. Tā ļauj aģentam sadalīt uzdevumu un izpildīt daļu darba patstāvīgi, piemēram, sameklēt informāciju tīmeklī un pēc tam uzrakstīt kodu, kas šo informāciju izmanto. Koda un sarunas režīmi bija pieejami arī agrāk atsevišķās komandās, bet tagad tie sabīdīti vienā logā.
Tas ir jūtams pavērsiens rīkam, kura reputācija balstās uz lokālu izpildi. Datora resursi vairs nav vienīgais darbības priekšnoteikums noklusētajā režīmā, jo aģents pēc kārtas var sūtīt kodu un vaicājumus uz ārēju serveri. Kas grib turpināt strādāt tikai lokāli, joprojām izmanto ollama pull un ollama run ar sava datora modeli. Šī darbplūsma laidienā nemainās.
Kāpēc noklusētais modelis strādā mākonī
Modelis glm-5.2:cloud ir pārāk liels, lai to ātri palaistu uz vidēja klēpjdatora. Novirzot to uz mākoni, Ollama panāk, ka pirmā palaišana nav atkarīga no lietotāja videokartes vai atmiņas apjoma. Datorā bez atsevišķas videokartes liels modelis vai nu ielādētos ļoti lēni, vai neielādētos vispār. Mākoņa modelis šo šķērsli apiet.
Šim risinājumam ir cena. Kods un vaicājumi, ko aģents apstrādā noklusētajā režīmā, aiziet uz ārēju serveri, tāpēc jāpiedomā, kādus datus tam nodod. Lietotājs, kas grib visu paturēt uz sava datora, pēc pieteikšanās var norādīt lokālu modeli, taču tas vairs nav noklusējums.
PromptQuorum apskatā minēts, ka lietotāji, kuriem svarīga lokāla palaišana, joprojām izvēlas modeļus kā Qwen 3.6 27B vai Kimi K2.6. Šo modeļu lejupielāde un izpilde caur ollama run laidienā nemainās, tāpēc esošie skripti darbojas tāpat kā līdz šim.
Codex integrāciju pārsauc par ChatGPT
Laidienā pārdēvēta Codex App integrācija. Tagad to atver ar ollama launch chatgpt. Karodziņš --restore atgriež lietotāju viņa parastajā ChatGPT profilā. Palaišanas izvēlni saīsināja tā, lai tajā redzamas tikai populārākās integrācijas.
Pārsaukšana skar integrācijas nosaukumu un palaišanas komandu. Pati funkcionalitāte paliek. Lietotājs to atrod saīsinātajā palaišanas izvēlnē starp populārākajām integrācijām.
Brīdinājumi par novecojušiem modeļiem
Vairāki vecāki modeļu tagi pirms palaišanas tagad izvada brīdinājumu par gaidāmo atbalsta pārtraukšanu. Sarakstā ir CodeLlama, Qwen2.5 un tā koda variants, Llama 3.x, Mistral, StarCoder, kā arī bāzes DeepSeek-R1 versijas. Modeļi joprojām palaižas, taču lietotājs redz paziņojumu par to statusu.
Praktiski tas nozīmē, ka skripti un dokumentācija, kas balstās uz šiem nosaukumiem, drīzumā var pārstāt darboties bez izmaiņām. Ollama šos tagus vēl nedzēš, bet brīdinājums ir pirmais solis to izņemšanai.
Šie modeļi bija populāri pirms diviem un trim gadiem, taču tos ir aizstājušas jaunākas paaudzes. CodeLlama un StarCoder savulaik bija starp pirmajiem plaši lietotajiem koda modeļiem. Pēc tam, kad tags būs izņemts, tā palaišana visticamāk atgriezīs kļūdu, tāpēc atsauces uz konkrētiem nosaukumiem labāk pārbaudīt jau tagad.
Ko labo 0.32.1
Piecas dienas vēlāk, 16. jūlijā, iznāca versija 0.32.1 ar vairākiem labojumiem. Uzlabota Gemma 4 rīku izsaukšana un vairāku soļu spriešana, tostarp uzticamāka rīku atbilžu turpināšana. Novērsta atkārtota MLX modeļa kešatmiņas noplūde, kas palielināja atmiņas patēriņu ar katru pieprasījumu. MLX ir Apple aparatūrai paredzēts izpildes dzinis, tāpēc šie labojumi galvenokārt skar Mac lietotājus.
MLX teksta modeļu ielāde tagad ievēro iestatījumu OLLAMA_LOAD_TIMEOUT. Aģenta tīmekļa meklēšana un ielāde parāda aicinājumu palaist ollama signin, ja nepieciešami pieteikšanās dati. Izlabota kļūda, kad ollama launch ar novecojušu modeli, kas nodots caur --model, tagad korekti atver modeļu izvēlni. Papildināta arī VS Code iestatīšanas dokumentācija oficiālajam Ollama paplašinājumam.
Pašlaik jaunākā stabilā versija ir 0.32.1. Aģenta saskarne šajā laidienā papildus saņem pašreizējo darba mapi, tāpēc tā labāk saprot konkrētā projekta kontekstu.
Komentāri
Šim rakstam vēl nav komentāru. Esi pirmais, kurš dalās ar savu viedokli.