<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom" xmlns:content="http://purl.org/rss/1.0/modules/content/"><channel><title>Building &amp; Running AI on Coursiv Blog</title><link>https://coursiv.io/blog/tags/building--running-ai</link><description>Recent content in Building &amp; Running AI on Coursiv Blog</description><generator>Hugo -- 0.147.0</generator><language>en-US</language><atom:link href="https://coursiv.io/blog/tags/building--running-ai/index.xml" rel="self" type="application/rss+xml"/><item><title>API</title><link>https://coursiv.io/blog/glossary/api</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://coursiv.io/blog/glossary/api</guid><description>The interface your code uses to send a prompt to a model and get a response back.</description></item><item><title>API Key</title><link>https://coursiv.io/blog/glossary/api-key</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://coursiv.io/blog/glossary/api-key</guid><description>The secret credential that authenticates and bills your API calls — and must never reach a browser.</description></item><item><title>Batch Inference</title><link>https://coursiv.io/blog/glossary/batch-inference</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://coursiv.io/blog/glossary/batch-inference</guid><description>Running many predictions together as a job instead of one at a time in real time.</description></item><item><title>Chunking</title><link>https://coursiv.io/blog/glossary/chunking</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://coursiv.io/blog/glossary/chunking</guid><description>Splitting documents into passages small enough to embed and retrieve usefully.</description></item><item><title>GPU</title><link>https://coursiv.io/blog/glossary/gpu</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://coursiv.io/blog/glossary/gpu</guid><description>The parallel processor that made deep learning practical, and the scarcest resource in the industry.</description></item><item><title>Hybrid Search</title><link>https://coursiv.io/blog/glossary/hybrid-search</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://coursiv.io/blog/glossary/hybrid-search</guid><description>Combining keyword and vector search, because each fails where the other works.</description></item><item><title>Inference Cost</title><link>https://coursiv.io/blog/glossary/inference-cost</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://coursiv.io/blog/glossary/inference-cost</guid><description>What it costs to run a model in production, billed per token in and per token out.</description></item><item><title>Latency</title><link>https://coursiv.io/blog/glossary/latency</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://coursiv.io/blog/glossary/latency</guid><description>How long a request takes — the difference between an assistant that feels alive and one that feels broken.</description></item><item><title>LLMOps</title><link>https://coursiv.io/blog/glossary/llmops</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://coursiv.io/blog/glossary/llmops</guid><description>MLOps for systems built on language models — prompts, evals, cost, and safety instead of training runs.</description></item><item><title>MLOps</title><link>https://coursiv.io/blog/glossary/mlops</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://coursiv.io/blog/glossary/mlops</guid><description>The practices for getting machine learning models into production and keeping them working.</description></item><item><title>On-Device AI</title><link>https://coursiv.io/blog/glossary/on-device-ai</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://coursiv.io/blog/glossary/on-device-ai</guid><description>Running a model on a phone or laptop instead of sending data to a server.</description></item><item><title>Prompt Caching</title><link>https://coursiv.io/blog/glossary/prompt-caching</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://coursiv.io/blog/glossary/prompt-caching</guid><description>Reusing the processed form of a repeated prompt prefix so you do not pay full price for it again.</description></item><item><title>Rate Limit</title><link>https://coursiv.io/blog/glossary/rate-limit</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://coursiv.io/blog/glossary/rate-limit</guid><description>The cap a provider puts on how many requests or tokens you can use per interval.</description></item><item><title>SDK</title><link>https://coursiv.io/blog/glossary/sdk</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://coursiv.io/blog/glossary/sdk</guid><description>An official library that wraps a provider&amp;#39;s API in your programming language.</description></item><item><title>Throughput</title><link>https://coursiv.io/blog/glossary/throughput</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://coursiv.io/blog/glossary/throughput</guid><description>How much work a system handles per unit of time — tokens per second, requests per minute.</description></item><item><title>TPU</title><link>https://coursiv.io/blog/glossary/tpu</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://coursiv.io/blog/glossary/tpu</guid><description>Google&amp;#39;s custom accelerator chip, purpose-built for machine learning workloads.</description></item><item><title>Vector Search</title><link>https://coursiv.io/blog/glossary/vector-search</link><pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate><guid>https://coursiv.io/blog/glossary/vector-search</guid><description>Finding content by meaning rather than by matching keywords.</description></item></channel></rss>