<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom"><channel><title>Nvidia on Kuldeep Pisda</title><link>https://kdpisda.in/tag/nvidia/</link><description>Recent content in Nvidia on Kuldeep Pisda</description><generator>Hugo</generator><language>en-us</language><lastBuildDate>Tue, 25 Aug 2026 09:00:00 +0530</lastBuildDate><atom:link href="https://kdpisda.in/tag/nvidia/index.xml" rel="self" type="application/rss+xml"/><item><title>Nvidia's Groq 3 LPX Enters Full Production, and Inference Speed Becomes a Silicon Choice</title><link>https://kdpisda.in/nvidia-groq-3-lpx-inference-full-production/</link><pubDate>Tue, 25 Aug 2026 09:00:00 +0530</pubDate><guid>https://kdpisda.in/nvidia-groq-3-lpx-inference-full-production/</guid><description>&lt;p&gt;Yesterday Nvidia announced that Groq 3 LPX, the first chip to ship from its $20 billion acquisition of Groq&amp;rsquo;s LPU technology, has entered full production. Nebius signed on as the first cloud to deploy it, and SpaceX confirmed it is pairing Nvidia&amp;rsquo;s new Vera CPUs with the same racks for its own agentic workloads. The headline number is 3,400 tokens per second running Google&amp;rsquo;s Gemma 4 31B at a 100,000 token input context, a benchmark Nvidia says is roughly 4x the nearest publicly available alternative.&lt;/p&gt;</description></item></channel></rss>