<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom" xmlns:content="http://purl.org/rss/1.0/modules/content/"><channel><title>Tensor-Parallel on kernelsparks</title><link>https://kernelsparks.ru/tags/tensor-parallel/</link><description>Recent content in Tensor-Parallel on kernelsparks</description><generator>Hugo</generator><language>ru</language><lastBuildDate>Tue, 22 Sep 2026 00:00:00 +0300</lastBuildDate><atom:link href="https://kernelsparks.ru/tags/tensor-parallel/index.xml" rel="self" type="application/rss+xml"/><item><title>Выбор агентской модели для кластеров из 2× DGX Spark (сентябрь 2026)</title><link>https://kernelsparks.ru/posts/two-dgx-spark-model-choice-sept-2026/</link><pubDate>Tue, 22 Sep 2026 00:00:00 +0300</pubDate><guid>https://kernelsparks.ru/posts/two-dgx-spark-model-choice-sept-2026/</guid><description>DeepSeek-V4.1-Flash на 552B, GLM-5.3-Flash на 320B, Qwen3.8-Flash-Next на 125B: что ставить на пару DGX Spark под Claude Code. Арифметика памяти решает раньше любого бенчмарка, 6 миллиардов активных параметров не дают 90 ток/с, а для агента решающим оказывается не скорость декода, а один флаг vLLM.</description></item></channel></rss>