<?xml version="1.0" encoding="UTF-8"?>
<rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom">
  <channel>
    <title>ProgrammingVideoTutorials AI &amp; Tech Wire</title>
    <link>https://programmingvideotutorials.com/news/</link>
    <description>Daily technical reporting on AI agents, LLMs, and developer tools.</description>
    <language>en-us</language>
    <lastBuildDate>Wed, 16 Sep 2026 07:36:11 GMT</lastBuildDate>
    <atom:link href="https://programmingvideotutorials.com/news/feed.xml" rel="self" type="application/rss+xml"/>
    
    <item>
      <title><![CDATA[System One Fast-Thinking LLMs & Jevons Paradox in Automated Software Engineering]]></title>
      <link>https://programmingvideotutorials.com/news/daily-ai-wire-introducing-system-one-models-and-jev-20260916/</link>
      <guid>https://programmingvideotutorials.com/news/daily-ai-wire-introducing-system-one-models-and-jev-20260916/</guid>
      <pubDate>Wed, 16 Sep 2026 00:00:00 GMT</pubDate>
      <description><![CDATA[How sub-5ms low-latency inference models and test-time compute scaling are proving Jevons paradox: cheaper, faster tokens lead to exponential software creation rather than reduced developer activity.]]></description>
      <author>Dr. Sarah Chen</author>
    </item>

    <item>
      <title><![CDATA[Slashing eBPF AI Gateway CPU Overhead by 90% via Deterministic Memoization]]></title>
      <link>https://programmingvideotutorials.com/news/daily-ai-wire-dropping-ebpf-cpu-cost-by-about-90-with-memoiz-20260915/</link>
      <guid>https://programmingvideotutorials.com/news/daily-ai-wire-dropping-ebpf-cpu-cost-by-about-90-with-memoiz-20260915/</guid>
      <pubDate>Tue, 15 Sep 2026 00:00:00 GMT</pubDate>
      <description><![CDATA[High-throughput inference routers and agent tool gateways reduce kernel-space CPU cycles by 90% using eBPF map memoization for token streams and routing topologies.]]></description>
      <author>Marcus Sterling</author>
    </item>

    <item>
      <title><![CDATA[Open-Source AI Foundation Models 2026: Full Architectural Evaluation & MoE Benchmarks]]></title>
      <link>https://programmingvideotutorials.com/news/daily-ai-wire-open-source-ai-and-open-models-reading-list-20260914/</link>
      <guid>https://programmingvideotutorials.com/news/daily-ai-wire-open-source-ai-and-open-models-reading-list-20260914/</guid>
      <pubDate>Mon, 14 Sep 2026 00:00:00 GMT</pubDate>
      <description><![CDATA[Comprehensive evaluation of 2026 open-weight architectures: comparing DeepSeek-V4, Qwen3.8-Max, Kimi K3, and Llama 4 on reasoning tokens, routing sparsity, and memory footprints.]]></description>
      <author>Elena Rostova</author>
    </item>

    <item>
      <title><![CDATA[Anthropic Releases Claude 3.7 Sonnet: Hybrid Thinking and Autonomous Tool Execution]]></title>
      <link>https://programmingvideotutorials.com/news/claude-37-sonnet-hybrid-reasoning-and-autonomous-coding-loops/</link>
      <guid>https://programmingvideotutorials.com/news/claude-37-sonnet-hybrid-reasoning-and-autonomous-coding-loops/</guid>
      <pubDate>Sun, 13 Sep 2026 00:00:00 GMT</pubDate>
      <description><![CDATA[Anthropic introduces Claude 3.7 Sonnet with dynamic test-time reasoning control, sub-agent tool chaining, and state-of-the-art SWE-bench results for autonomous developer environments.]]></description>
      <author>Dr. Sarah Chen</author>
    </item>

    <item>
      <title><![CDATA[DeepSeek Releases DeepSeek-V4.1-Flash: 552B Multimodal MoE with Causal Encoder-Decoder Architecture and 1M Context]]></title>
      <link>https://programmingvideotutorials.com/news/deepseek-v41-flash-ced-moe-kv-cache-compression/</link>
      <guid>https://programmingvideotutorials.com/news/deepseek-v41-flash-ced-moe-kv-cache-compression/</guid>
      <pubDate>Sat, 12 Sep 2026 00:00:00 GMT</pubDate>
      <description><![CDATA[DeepSeek introduces a 552B backbone MoE activating only 8B prefill and 16B decode parameters via Causal Encoder-Decoder (CED) architecture, cutting persistent KV cache footprints with SWA Bounded Replay under an MIT license.]]></description>
      <author>Dr. Sarah Chen</author>
    </item>

    <item>
      <title><![CDATA[Alibaba Cloud Releases Qwen3.8-2.4T-A95B and Qwen3.8-Max: 2.4-Trillion Parameter Open MoE with Gated DeltaNet Linear Attention]]></title>
      <link>https://programmingvideotutorials.com/news/alibaba-qwen38-max-24t-moe-gated-deltanet/</link>
      <guid>https://programmingvideotutorials.com/news/alibaba-qwen38-max-24t-moe-gated-deltanet/</guid>
      <pubDate>Sat, 12 Sep 2026 00:00:00 GMT</pubDate>
      <description><![CDATA[Alibaba brings a Qwen-Max-class model to open release, pairing 92 Transformer layers with Gated DeltaNet linear attention and 95B activated parameters across 1M default context length.]]></description>
      <author>Marcus Sterling</author>
    </item>

    <item>
      <title><![CDATA[Moonshot AI Unveils Kimi K3: World's First Open 2.8T Parameter Multimodal Model with Kimi Delta Attention]]></title>
      <link>https://programmingvideotutorials.com/news/moonshot-ai-kimi-k3-28t-parameter-open-model/</link>
      <guid>https://programmingvideotutorials.com/news/moonshot-ai-kimi-k3-28t-parameter-open-model/</guid>
      <pubDate>Fri, 11 Sep 2026 00:00:00 GMT</pubDate>
      <description><![CDATA[Moonshot AI launches Kimi K3, a 2.8-trillion parameter multimodal model utilizing Stable LatentMoE with 16-of-896 expert activation, Attention Residuals, and a 1M token context window.]]></description>
      <author>Elena Rostova</author>
    </item>

    <item>
      <title><![CDATA[Zhipu AI Launches GLM-5.3: Sweeping Terminal Bench 3.0, CyberGym (84.5%), and AutomationBench]]></title>
      <link>https://programmingvideotutorials.com/news/zhipu-ai-glm-53-terminal-bench-sota-cybergym/</link>
      <guid>https://programmingvideotutorials.com/news/zhipu-ai-glm-53-terminal-bench-sota-cybergym/</guid>
      <pubDate>Fri, 11 Sep 2026 00:00:00 GMT</pubDate>
      <description><![CDATA[GLM-5.3 achieves open-source SOTA on Terminal Bench 3.0 (28.3%) and scores 84.5% on CyberGym vulnerability discovery, establishing a new bar for autonomous terminal coding and cyber engineering.]]></description>
      <author>Dr. Erik Vandeberg</author>
    </item>

    <item>
      <title><![CDATA[Shanghai AI Lab Releases Intern-S2-Mobius and 397B MoE Architecture with Memory-Decoupled Attention]]></title>
      <link>https://programmingvideotutorials.com/news/internlm-intern-s2-mobius-397b-moe-shanghai-ai-lab/</link>
      <guid>https://programmingvideotutorials.com/news/internlm-intern-s2-mobius-397b-moe-shanghai-ai-lab/</guid>
      <pubDate>Thu, 10 Sep 2026 00:00:00 GMT</pubDate>
      <description><![CDATA[Shanghai AI Lab details Intern-S2-Mobius, combining 397B MoE parameters with Intern-MemDec-4B memory decoders and InternLumina-U2 for complex scientific reasoning and mathematics.]]></description>
      <author>Dr. Sarah Chen</author>
    </item>

    <item>
      <title><![CDATA[OpenAI Announces GPT-5.6 Sol: Dominating Terminal Bench 3.0 (34.6%) and DeepSWE (72.7%) with Sol Architecture]]></title>
      <link>https://programmingvideotutorials.com/news/openai-gpt-56-sol-swe-bench-terminal-bench/</link>
      <guid>https://programmingvideotutorials.com/news/openai-gpt-56-sol-swe-bench-terminal-bench/</guid>
      <pubDate>Thu, 10 Sep 2026 00:00:00 GMT</pubDate>
      <description><![CDATA[OpenAI unveils GPT-5.6 Sol, featuring autonomous agent test-time compute, setting all-time highs across SWE-Bench Verified, DeepSWE, and Terminal Bench 3.0.]]></description>
      <author>Sarah Lin</author>
    </item>

    <item>
      <title><![CDATA[Anthropic Deploys Claude Opus 4.8: Setting New Records on NL2Repo (69.7%) and Multi-Hour SWE-Marathon]]></title>
      <link>https://programmingvideotutorials.com/news/anthropic-claude-opus-48-nl2repo-swe-marathon/</link>
      <guid>https://programmingvideotutorials.com/news/anthropic-claude-opus-48-nl2repo-swe-marathon/</guid>
      <pubDate>Wed, 09 Sep 2026 00:00:00 GMT</pubDate>
      <description><![CDATA[Anthropic introduces Claude Opus 4.8, specialized in sustained repository-level code synthesis and complex architectural refactoring across multi-hour autonomous SWE-Marathon sessions.]]></description>
      <author>Marcus Sterling</author>
    </item>

    <item>
      <title><![CDATA[ByteDance Open-Sources deer-flow: Long-Horizon SuperAgent Harness for Sandboxed Research & Coding]]></title>
      <link>https://programmingvideotutorials.com/news/bytedance-deer-flow-superagent-harness/</link>
      <guid>https://programmingvideotutorials.com/news/bytedance-deer-flow-superagent-harness/</guid>
      <pubDate>Wed, 09 Sep 2026 00:00:00 GMT</pubDate>
      <description><![CDATA[ByteDance releases deer-flow, an open-source multi-agent harness providing isolated Docker sandboxes and asynchronous tool loops for long-horizon engineering tasks.]]></description>
      <author>Dr. Sarah Chen</author>
    </item>

    <item>
      <title><![CDATA[DeepSeek Open-Sources deepseek-harness & DeepSelect: DSA Sparse Attention and DeepGEMM for High-Throughput Inference]]></title>
      <link>https://programmingvideotutorials.com/news/deepseek-harness-deepselect-sparse-attention-blas/</link>
      <guid>https://programmingvideotutorials.com/news/deepseek-harness-deepselect-sparse-attention-blas/</guid>
      <pubDate>Tue, 08 Sep 2026 00:00:00 GMT</pubDate>
      <description><![CDATA[DeepSeek open-sources its core production runtime 'deepseek-harness', combining Dynamic Sparse Attention (DSA) Top-K selection with custom FP8 DeepGEMM matrix kernels.]]></description>
      <author>Dr. Erik Vandeberg</author>
    </item>

    <item>
      <title><![CDATA[Tencent Unveils WeKnora: Autonomous LLM Knowledge Platform Turning Raw Docs into Self-Maintaining Wikis]]></title>
      <link>https://programmingvideotutorials.com/news/tencent-weknora-autonomous-llm-knowledge-wiki/</link>
      <guid>https://programmingvideotutorials.com/news/tencent-weknora-autonomous-llm-knowledge-wiki/</guid>
      <pubDate>Tue, 08 Sep 2026 00:00:00 GMT</pubDate>
      <description><![CDATA[Tencent open-sources WeKnora, an autonomous enterprise knowledge engine that synthesizes fragmented repos, PDFs, and API schemas into living, validated knowledge graphs.]]></description>
      <author>Elena Rostova</author>
    </item>

    <item>
      <title><![CDATA[MiniMax Launches MiniMax-M3 and H3: MXFP8 8-bit Microscaling and Music3 Multimodal Generation]]></title>
      <link>https://programmingvideotutorials.com/news/minimax-m3-h3-mxfp8-linear-attention/</link>
      <guid>https://programmingvideotutorials.com/news/minimax-m3-h3-mxfp8-linear-attention/</guid>
      <pubDate>Mon, 07 Sep 2026 00:00:00 GMT</pubDate>
      <description><![CDATA[MiniMax releases MiniMax-M3 in hardware-accelerated MXFP8 format, delivering lightning-fast inference for conversational agents and high-fidelity audio synthesis.]]></description>
      <author>Dr. Sarah Chen</author>
    </item>

    <item>
      <title><![CDATA[StepFun Releases Step-3.7-Flash in NVFP4: Sub-10ms Time-to-First-Token for Real-Time Voice and Agents]]></title>
      <link>https://programmingvideotutorials.com/news/stepfun-step-37-flash-sub-10ms-nvfp4/</link>
      <guid>https://programmingvideotutorials.com/news/stepfun-step-37-flash-sub-10ms-nvfp4/</guid>
      <pubDate>Mon, 07 Sep 2026 00:00:00 GMT</pubDate>
      <description><![CDATA[StepFun collaborates with NVIDIA to release Step-3.7-Flash in native NVFP4 quantization, achieving sub-10ms TTFT for conversational agent workflows.]]></description>
      <author>Marcus Sterling</author>
    </item>

    <item>
      <title><![CDATA[OpenClaw Crosses 389,000 GitHub Stars: The Rise of Sovereign Local Agents with Docker Sandboxing]]></title>
      <link>https://programmingvideotutorials.com/news/openclaw-crosses-389k-stars-autonomous-desktop-agent/</link>
      <guid>https://programmingvideotutorials.com/news/openclaw-crosses-389k-stars-autonomous-desktop-agent/</guid>
      <pubDate>Sun, 06 Sep 2026 00:00:00 GMT</pubDate>
      <description><![CDATA[OpenClaw cements its position as the fastest-growing open-source AI assistant in history, bridging personal computers with Discord, Telegram, and isolated Docker execution runtimes.]]></description>
      <author>Marcus Sterling</author>
    </item>

    <item>
      <title><![CDATA[Affaan ECC Agent Harness Reaches 257k GitHub Stars: Standardizing Skills, Instincts & Memory for AI Coding]]></title>
      <link>https://programmingvideotutorials.com/news/affaan-ecc-agent-harness-surpasses-250k-stars/</link>
      <guid>https://programmingvideotutorials.com/news/affaan-ecc-agent-harness-surpasses-250k-stars/</guid>
      <pubDate>Sun, 06 Sep 2026 00:00:00 GMT</pubDate>
      <description><![CDATA[The open-source community rallies behind the Affaan ECC harness as a universal runtime for multi-agent workflows, featuring native support for DeepSeek-V4.1 and Qwen3.8.]]></description>
      <author>Sarah Lin</author>
    </item>

    <item>
      <title><![CDATA[The Economist: Nvidia Has Become the 'Central Bank of AI' Dictating Tech Capital and Compute]]></title>
      <link>https://programmingvideotutorials.com/news/the-economist-nvidia-central-bank-of-ai/</link>
      <guid>https://programmingvideotutorials.com/news/the-economist-nvidia-central-bank-of-ai/</guid>
      <pubDate>Sat, 05 Sep 2026 00:00:00 GMT</pubDate>
      <description><![CDATA[With trillion-parameter MoE architectures demanding NVLink 5 and Blackwell clusters, Nvidia's hardware allocations now exert macroeconomic influence rivaling sovereign monetary policy.]]></description>
      <author>Dr. Erik Vandeberg</author>
    </item>
  </channel>
</rss>