{"id":157737,"date":"2026-04-20T04:23:08","date_gmt":"2026-04-20T04:23:08","guid":{"rendered":"https:\/\/www.europesays.com\/ee\/157737\/"},"modified":"2026-04-20T04:23:08","modified_gmt":"2026-04-20T04:23:08","slug":"nvidia-toob-turule-nemotron-3-superi-120-miljardi-parameetriga-openai-mudeli-mis-on-loodud-agendipohiste-tookoormuste-jaoks","status":"publish","type":"post","link":"https:\/\/www.europesays.com\/ee\/157737\/","title":{"rendered":"Nvidia toob turule Nemotron 3 Superi, 120 miljardi parameetriga OpenAI mudeli, mis on loodud agendip\u00f5histe t\u00f6\u00f6koormuste jaoks"},"content":{"rendered":"<p>Peamised j\u00e4reldused:<\/p>\n<ul>\n<li>Nvidia t\u00f5i turule Nemotron 3 Superi, 120 miljardi parameetriga avatud MoE-mudeli, mis aktiveerib \u00fche edasisuunalise l\u00e4biviimise jooksul vaid 12,7 miljardit parameetrit.<\/li>\n<li>Nemotron 3 Super pakub kuni 7,5 korda suuremat l\u00e4bilaskev\u00f5imet kui Qwen3.5-122B-A10B agendi t\u00f6\u00f6koormuste puhul 8k-in\/64k-out seadetel.<\/li>\n<li>Mudel on t\u00e4ielikult avatud Nvidia Nemotron Open Model License&#8217;i alusel, kontrollpunktid ja koolitusandmed on saadaval Hugging Face&#8217;is.<\/li>\n<\/ul>\n<p> Nvidia toob turule Nemotron 3 Superi, mille l\u00e4bilaskev\u00f5ime on 7,5 korda suurem kui Qwen3.5-122B-l <\/p>\n<p><a href=\"https:\/\/developer.nvidia.com\/blog\/introducing-nemotron-3-super-an-open-hybrid-mamba-transformer-moe-for-agentic-reasoning\/\" target=\"_blank\" rel=\"noopener noreferrer nofollow\">Nvidia uusim mudel<\/a> aktiveerib Mixture-of-Experts (MoE) arhitektuuri kasutades ainult 12,7 miljardit parameetrit \u00fche edasisuunalise l\u00e4biviimise kohta, mis t\u00e4hendab, et enamik selle kaalust j\u00e4\u00e4b j\u00e4reldamise ajal kasutamata. See disainivalik on suunatud otseselt kahele probleemile, millega arendajad mitmeastmeliste <a href=\"https:\/\/news.bitcoin.com\/et\/deepmindi-artikkel-ai-agent-traps-kirjeldab-kuidas-hakkerid-voivad-kasutada-tehisintellekti-agente-kasutajate-vastu\/\" rel=\"nofollow noopener\" target=\"_blank\">AI-agentide<\/a> kasutuselev\u00f5tul kokku puutuvad: pikendatud j\u00e4reldusahelate lisakulu ja tokenite kasutuse plahvatuslik kasv, mis v\u00f5ib mitmeagendilistes torudes mitmekordistuda kuni 15 korda.<\/p>\n<p>Nemotron 3 Super on Nvidia Nemotron 3 perekonna teine mudel, mis j\u00e4rgneb 2025. aasta detsembris ilmunud Nemotron 3 Nanole. Nvidia <a href=\"https:\/\/blogs.nvidia.com\/blog\/nemotron-3-super-agentic-ai\/\" target=\"_blank\" rel=\"noopener noreferrer nofollow\">teatas<\/a> mudeli v\u00e4ljalaskest umbes 10. m\u00e4rtsil 2026.<\/p>\n<p>Mudel kasutab 88 kihilist h\u00fcbriidset Mamba-Transformer-p\u00f5histruktuuri. Mamba-2-plokid t\u00f6\u00f6tlevad pikki jadasid lineaarselt t\u00f5husalt, samas kui Transformer-t\u00e4helepanukihid s\u00e4ilitavad t\u00e4pse meenutamise. See kombinatsioon annab mudelile natiivse toe kuni miljoni tokeni pikkustele kontekstiakendele ilma puhtalt t\u00e4helepanup\u00f5histe disainide t\u00fc\u00fcpiliste m\u00e4lukahjumiteta.<\/p>\n<p><a href=\"https:\/\/news.bitcoin.com\/et\/nvidia-kruptovaluuta-tuludega-seotud-kohtuasi-sai-kalifornia-foderaal-kohtult-kollektiivse-hagi-tunnustuse\/\" rel=\"nofollow noopener\" target=\"_blank\">Nvidia<\/a> lisas ka LatentMoE marsruutimiss\u00fcsteemi, mis pakub tokenite sissekanded madala rangusega ruumi enne nende saatmist 512 eksperdile kihi kohta, aktiveerides korraga 22. Ettev\u00f5tte s\u00f5nul v\u00f5imaldab see kasutada ligikaudu neli korda rohkem eksperte sama j\u00e4relduskuluga v\u00f5rreldes standardse MoE l\u00e4henemisviisiga ning v\u00f5imaldab t\u00e4psemat \u00fclesannete spetsialiseerumist, n\u00e4iteks Python-loogika eraldamist SQL-t\u00f6\u00f6tlemisest eksperdi tasandil.<\/p>\n<p> <img loading=\"lazy\" decoding=\"async\" class=\"wp-image-807443 size-full\" title=\"Nvidia Releases Nemotron 3 Super, a 120B Open AI Model Built for Agentic Workloads\" src=\"https:\/\/www.europesays.com\/ee\/wp-content\/uploads\/2026\/04\/screenshot-2026-04-19-at-1-27-52-pm_nwmk.png\" alt=\"Nvidia Releases Nemotron 3 Super, a 120B Open AI Model Built for Agentic Workloads\" width=\"2018\" height=\"458\"\/>Pildi allikas: Nvidia blogi. <\/p>\n<p>Multi-Token Prediction kihid, mis kasutavad kahte jagatud kaaluga pead, kiirendavad m\u00f5ttek\u00e4igu genereerimist ja v\u00f5imaldavad natiivset spekulatiivset dekodeerimist. Struktureeritud \u00fclesannete puhul teatab Nvidia kuni kolm korda kiiremast genereerimisest.<\/p>\n<p>Mudel oli eelnevalt treenitud 25 triljoni tokeniga kahes faasis. Esimeses faasis kasutati 20 triljonit laiaulatuslikku andmetokenit. Teises kasutati viit triljonit k\u00f5rgekvaliteedilist tokenit, mis olid h\u00e4\u00e4lestatud v\u00f5rdlusn\u00e4itajate saavutamiseks. L\u00f5plik laiendusfaas 51 miljardi tokeniga laiendas natiivset konteksti miljoni tokenini. P\u00e4rast treenimist toimus juhendatud peenh\u00e4\u00e4lestamine ligikaudu seitsme miljoni n\u00e4ite p\u00f5hjal ning tugevdus\u00f5pe 21 keskkonnas, kus toimus \u00fcle 1,2 miljoni k\u00e4ivituse.<\/p>\n<p>V\u00f5rdlustestides sai Nemotron 3 Super OpenHandsi abil MMLU-Pro-s 83,73, AIME25-s 90,21 ja SWE-Bench-is 60,47 punkti. PinchBench-is saavutas see 85,6 protsenti, mis on selle klassi avatud mudelite seas k\u00f5rgeim tulemus. Pika konteksti hindamisel sai see RULER 1M-il 91,64 punkti.<\/p>\n<p>V\u00f5rreldes GPT-OSS-120B-ga pakub Nemotron 3 Super 2,2 korda suuremat l\u00e4bilaskev\u00f5imet 8k sisendi ja 64k v\u00e4ljundi juures. V\u00f5rreldes Qwen3.5-122B-A10B-ga ulatub see n\u00e4itaja 7,5 korda. Nvidia teatab ka, et v\u00f5rreldes eelmise Nemotron Super p\u00f5lvkonnaga on l\u00e4bilaskev\u00f5ime \u00fcle viie korra suurem ja t\u00e4psus kuni kaks korda parem.<br \/>Nvidia treenis mudelit algusest l\u00f5puni oma NVFP4 neljabitises ujukomavormingus, mis on optimeeritud Blackwell GPU-dele. B200 riistvaral t\u00f6\u00f6tab j\u00e4reldamine Nvidia s\u00f5nul kuni neli korda kiiremini v\u00f5rreldes H100-l t\u00f6\u00f6tava FP8-ga, ilma et t\u00e4psus oleks v\u00e4henenud. Kvantiseeritud FP8 ja NVFP4 kontrollpunktid s\u00e4ilitavad 99,8 protsenti v\u00f5i enam t\u00e4is-t\u00e4psusest.<\/p>\n<p><a href=\"https:\/\/www.youtube.com\/watch?v=Y1ed7T7Vwdg\" target=\"_blank\" rel=\"noopener noreferrer nofollow\">Mudel<\/a> toetab ka Nvidia AI-Q uurimisagenti, mis j\u00f5udis Deepresearch Benchi edetabelis esikohale.<\/p>\n<p>Nemotron 3 Super on t\u00e4ielikult avatud Nvidia Nemotron Open Model License&#8217;i alusel. Kontrollpunktid BF16, FP8 ja NVFP4 formaatides, koos eel\u00f5ppe andmete, j\u00e4rel\u00f5ppe n\u00e4idiste ja tugevdatud \u00f5ppe keskkondadega, on saadaval Hugging Face&#8217;is. J\u00e4relduste tegemist toetavad <a href=\"https:\/\/news.bitcoin.com\/et\/bittensori-koolitusprogramm-on-aratanud-chamath-palihapitiya-ja-nvidia-tegevjuhi-jensen-huangi-tahelepanu\/\" rel=\"nofollow noopener\" target=\"_blank\">Nvidia<\/a> NIM, build.nvidia.com, Perplexity, Openrouter, Together AI, Google Cloud, AWS, Azure ja Coreweave, kohapealsed v\u00f5imalused on saadaval Dell Enterprise Hubi ja HPE kaudu.<\/p>\n<p>Arendajad saavad NeMo platvormi kaudu juurdep\u00e4\u00e4su koolitusretseptidele, t\u00e4psustamisjuhenditele ja j\u00e4relduste tegemise juhenditele, kasutades vLLM-i, SGLang-i ja TensorRT-LLM-i.<\/p>\n","protected":false},"excerpt":{"rendered":"Peamised j\u00e4reldused: Nvidia t\u00f5i turule Nemotron 3 Superi, 120 miljardi parameetriga avatud MoE-mudeli, mis aktiveerib \u00fche edasisuunalise l\u00e4biviimise&hellip;\n","protected":false},"author":2,"featured_media":157738,"comment_status":"","ping_status":"","sticky":false,"template":"","format":"standard","meta":{"footnotes":"","_share_on_mastodon":"0"},"categories":[14],"tags":[39032,131,21863,130,37,33,35,34,36,829],"class_list":["post-157737","post","type-post","status-publish","format-standard","has-post-thumbnail","category-ari","tag-ai-agents","tag-ari","tag-artificial-intelligence-ai","tag-business","tag-ee","tag-eesti","tag-eesti-keel","tag-estonia","tag-estonian","tag-nvidia"],"share_on_mastodon":{"url":"https:\/\/pubeurope.com\/@ee\/116435131090002798","error":""},"_links":{"self":[{"href":"https:\/\/www.europesays.com\/ee\/wp-json\/wp\/v2\/posts\/157737","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/www.europesays.com\/ee\/wp-json\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/www.europesays.com\/ee\/wp-json\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/www.europesays.com\/ee\/wp-json\/wp\/v2\/users\/2"}],"replies":[{"embeddable":true,"href":"https:\/\/www.europesays.com\/ee\/wp-json\/wp\/v2\/comments?post=157737"}],"version-history":[{"count":0,"href":"https:\/\/www.europesays.com\/ee\/wp-json\/wp\/v2\/posts\/157737\/revisions"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/www.europesays.com\/ee\/wp-json\/wp\/v2\/media\/157738"}],"wp:attachment":[{"href":"https:\/\/www.europesays.com\/ee\/wp-json\/wp\/v2\/media?parent=157737"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/www.europesays.com\/ee\/wp-json\/wp\/v2\/categories?post=157737"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/www.europesays.com\/ee\/wp-json\/wp\/v2\/tags?post=157737"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}