Ollama 9. jūlijā paziņoja par $65 miljonu Series B kārtu, ko vadīja Theory Ventures. Ar to uzņēmuma kopējais piesaistītais finansējums sasniedz $88 miljonus. Interesantāks par summu ir cits skaitlis: rīku, kas ļauj palaist atvērto svaru modeļus uz sava datora, ik mēnesi lieto 8,9 miljoni izstrādātāju.
Janvārī to lietoja aptuveni 4,45 miljoni. Skaitlis pusgadā ir divkāršojies, un pēc TheNextWeb datiem katru nedēļu pievienojas gandrīz miljons jaunu instalāciju. Komandā ir 14 cilvēku.
Ko Ollama patiesībā dara
Ollama ir komandrindas rīks un darbvirsmas lietotne, kas lejupielādē un palaiž atvērto svaru valodas modeli ar vienu komandu. Nav jākonfigurē CUDA versijas, jāmeklē pareizie svaru faili vai jāraksta inferences kods — ollama run paņem modeli, sagatavo to un atver čatu vai API galapunktu uz localhost.
Modelis strādā uz lietotāja aparatūras, tāpēc dati nepamet datoru. Tas ir iemesls, kāpēc rīks iegājis regulētās nozarēs. Ollama, pēc paša datiem, tiek lietots 85% no Fortune 500 uzņēmumiem, tostarp valsts pārvaldē, veselības aprūpē un finanšu sektorā, kur teksta sūtīšana uz svešu mākoni ir problēma.
GitHub repozitorijam ir 176 000 zvaigžņu un gandrīz 17 000 atzarojumu, un ap projektu ir izveidojušies vairāk nekā 67 000 integrāciju — no VS Code paplašinājumiem līdz mājas automatizācijas sistēmām.
Nauda ir bezmaksas, mākonis maksā
Darbvirsmas lietotne paliek bez maksas. Ollama pelna no mākoņa: modeļiem, kas ir par lielu vietējai aparatūrai, tos var palaist uz uzņēmuma serveriem. Maksas plāni sākas no bezmaksas līmeņa un iet līdz $100 mēnesī.
Rēķins tiek skaitīts pēc GPU laika, nevis pēc marķieriem. Tas atšķiras no OpenAI un Anthropic pieejas, kur maksā par katru ievadīto un izvadīto marķieri. GPU laika modelis ir paredzams tiem, kas dzen garus uzdevumus paketēs, un dārgāks tiem, kas sūta retus, īsus pieprasījumus.
Peter Fentons no Benchmark, kas vadīja iepriekšējo Series A kārtu, savu likmi formulē tieši:
Atvērto svaru modeļi tuvākajos 18 līdz 24 mēnešos radīs lielāko daļu no visiem apstrādātajiem marķieriem.
Ja tā notiks, Ollama sēž pareizajā vietā — starp modeļu izstrādātājiem un cilvēkiem, kas modeļus palaiž.
Izplatīšanas kanāls modeļu laboratorijām
Ollama ir kļuvis par izplatīšanas kanālu jauniem atvērtajiem modeļiem. Nemotron, GLM, DeepSeek, Kimi un MiniMax laboratorijas savus svarus dabū pie lietotājiem caur Ollama, bieži tajā pašā dienā, kad modelis iznāk. Izstrādātājam tas nozīmē, ka jauns modelis ir pieejams ar vienu komandu, nevis pēc stundām ilgas svaru un formātu meklēšanas.
Otrā pusē ir čipu ražotāji. Nvidia, AMD, Intel un Qualcomm strādā ar Ollama, lai modeļi labi darbotos uz to aparatūras. Tas ir svarīgi, jo lokālas inferences ātrums lielā mērā ir atkarīgs no tā, cik labi rīks izmanto konkrēto GPU vai NPU.
Kas stāv aiz projekta
Ollama dibināja 2023. gadā Džefs Morgans un Maikls Čiangs. Abi pirms tam bija uzbūvējuši Kitematic — rīku, ko 2015. gadā nopirka Docker un kas kļuva par Docker Desktop. Tā pati doma pārceļas uz mākslīgo intelektu: paņemt sarežģītu tehnoloģiju un iesaiņot to komandā, ko var palaist minūtē.
Modelis, ko izvēlas Ollama, atkārto to, kas jau strādāja ar konteineriem. Docker nepārdeva Linux kodola funkcijas; tas pārdeva ērtu veidu, kā tās lietot. Ollama nepārdod modeļus — tie ir atvērti un bez maksas — bet pārdod veidu, kā tos dabūt darbam bez sāpēm. Kā šī likme atmaksāsies ar 14 cilvēku komandu un 8,9 miljoniem lietotāju, kuru lielākā daļa nemaksā neko, būs redzams pa nākamo gadu, kad piesaistītie $65 miljoni sāks aiziet mākoņa infrastruktūrā. Detaļas par raundu apraksta TechCrunch un AIwire.
Komentāri
Šim rakstam vēl nav komentāru. Esi pirmais, kurš dalās ar savu viedokli.