# llm
$ ls | wc -l → 20 raksti
Ollama piesaista 65 miljonus dolāru — 14 cilvēku komanda apkalpo 8,9 miljonus izstrādātāju
Atvērtā pirmkoda rīks lielo valodas modeļu palaišanai uz sava datora saņēma 65 miljonu B sēriju. Aiz skaitļiem stāv 14 cilvēku komanda un teju miljons instalāciju nedēļā.
HalluSquatting: uzbrucēji reģistrē pakotnes, ko AI izdomā, un tavs kodēšanas aģents tās palaiž
Jauns pētījums rāda, kā uzbrucēji piespiež AI kodēšanas aģentus izdomāt konkrētu pakotnes nosaukumu un pēc tam to lejupielādēt un palaist. Pārbaudītas Cursor, Copilot, Gemini CLI un citas.
Ollama piesaista $65 miljonus — lokālais modeļu dzinējs sasniedz 8,9 miljonus izstrādātāju
Rīku atvērto svaru modeļu palaišanai uz sava datora ik mēnesi lieto 8,9 miljoni izstrādātāju — divreiz vairāk nekā janvārī. Series B kārta ieved kopējo finansējumu $88 miljonos.
Tencent Hy3: 295 miljardu parametru atvērts kodēšanas modelis ar Apache 2.0 un bez ģeogrāfiskiem ierobežojumiem
Tencent 6. jūlijā izlaida Hy3 — 295B MoE modeli ar 21B aktīviem parametriem un 256K kontekstu, tagad ar Apache 2.0 licenci bez reģionu izņēmumiem.
Gemini 3.5 Pro nāk 17. jūlijā pēc pilnas arhitektūras pārbūves
Google DeepMind izmet Gemini 2.5 Pro bāzes arhitektūru un sāk jaunu apmācību no nulles. GA datums — 17. jūlijs, konteksta logs — 2 miljoni marķieru.
GPT-5.6 Sol, Terra, Luna — OpenAI trīs modeļu saime pieejama API ar 1,05 milj. žetonu kontekstu
OpenAI 9. jūlijā laiž GPT-5.6 vispārējai pieejamībai — Sol, Terra, Luna modeļi ar 1,05M žetonu kontekstu, cenas $1–$30 par miljonu žetonu un 750 žetoni/s uz Cerebras.
NVIDIA Nemotron-Labs-TwoTower ģenerē tekstu 2,42 reizes ātrāk — difūzijas LLM bez atkārtotas apmācīšanas
NVIDIA izlaida Nemotron-Labs-TwoTower — atvērtu difūzijas LLM, kas sasniedz 2,42 reizes lielāku caurlaidspēju nekā autoregresīvais pamats, saglabājot 98,7% kvalitātes.
Meta Muse Spark 1.1 atver pirmo maksas API — $1,25 par miljonu tokenu, MCP un computer use
Meta 9. jūlijā atvēra pirmo maksas modeļa API — Muse Spark 1.1 ar $1,25/$4,25 par miljonu tokenu, 1M tokenu kontekstu un MCP atbalstu.
Grok 4.5: SpaceXAI izlaiž kodēšanas modeli ar 4× zemāku marķieru patēriņu nekā Opus 4.8
SpaceXAI 8. jūlijā izlaida Grok 4.5 — pirmo modeli pēc Cursor iegādes. $2/$6 par miljonu marķieru un 4× mazāks marķieru patēriņš nekā Opus 4.8.
Apple atver Foundation Models jebkuram LLM — viens Swift API maršrutē uz Claude vai Gemini
Kopš WWDC izstrādātājs var likt aiz vienas Swift saskarnes stāvēt lokālam modelim, Apple mākonim vai Claude un Gemini — nemainot sesijas kodu.