The Inference Report

July 29, 2026
AI Labs — News

The lab announcements today reveal a shift in competitive focus from model capability to deployment infrastructure and applied use cases. OpenAI and Anthropic are publishing work on agentic systems and security testing rather than raw benchmark improvements, signaling confidence in their existing model capabilities and a pivot toward demonstrating practical value to enterprise buyers. Meanwhile, infrastructure layers are consolidating around Kubernetes orchestration and edge compute. NVIDIA's Jetson framing positions edge AI not as a technical capability but as a consumer lifestyle choice, while AMD's GPU Operator v1.5.0 targets the same infrastructure pain point with explicit Kubernetes integration and automated node recovery. Hugging Face is publishing work across three distinct vectors: planetary-scale geospatial inference, CPU-efficient long-context encoding, and a technical postmortem on agent security, suggesting the organization is hedging across inference scale, efficiency, and safety validation simultaneously. The absence of new foundational models from any lab today, paired with heavy emphasis on deployment tooling and field applications, indicates the competitive frontier has shifted from who builds the biggest model to who can operationalize AI most reliably in production environments where customers actually pay.

Sloane Duvall

AI Labs — Models

A curated reference of models from major AI labs, with open/closed weight status, input modalities, and context window size. American labs tend towards closed weights models and Chinese labs tend toward open weights models.

usAmazon
Closed Weights
  • Amazon: Nova 2 Lite
    TextVisionVideoFiles1M
  • Amazon: Nova Premier 1.0
    TextVision1M
Open Weights

None

usAnthropic
Closed Weights
  • Anthropic: Claude Fable 5
    TextVisionFiles1M
  • Anthropic: Claude Fable 5 (batch)
    TextVisionFiles1M
  • Anthropic: Claude Haiku 4.5
    TextVisionFiles200K
  • Anthropic: Claude Haiku 4.5 (batch)
    TextVisionFiles200K
  • Anthropic: Claude Opus 4.1
    VisionTextFiles200K
  • Anthropic: Claude Opus 4.1 (batch)
    VisionTextFiles200K
  • Anthropic: Claude Opus 4.5
    FilesVisionText200K
  • Anthropic: Claude Opus 4.5 (batch)
    FilesVisionText200K
  • Anthropic: Claude Opus 4.6
    TextVisionFiles1M
  • Anthropic: Claude Opus 4.6 (batch)
    TextVisionFiles1M
  • Anthropic: Claude Opus 4.7
    TextVisionFiles1M
  • Anthropic: Claude Opus 4.7 (batch)
    TextVisionFiles1M
  • Anthropic: Claude Opus 4.7 (Fast)
    TextVisionFiles1M
  • Anthropic: Claude Opus 4.8
    TextVisionFiles1M
  • Anthropic: Claude Opus 4.8 (batch)
    TextVisionFiles1M
  • Anthropic: Claude Opus 4.8 (Fast)
    TextVisionFiles1M
  • Anthropic: Claude Sonnet 4.5
    TextVisionFiles1M
  • Anthropic: Claude Sonnet 4.5 (batch)
    TextVisionFiles1M
  • Anthropic: Claude Sonnet 4.6
    TextVisionFiles1M
  • Anthropic: Claude Sonnet 5
    TextVisionFiles1M
  • Anthropic: Claude Sonnet 5 (batch)
    TextVisionFiles1M
  • Claude Opus 5
    TextVisionFiles1M
  • Claude Opus 5 (Fast)
    TextVisionFiles1M
Open Weights

None

usGoogle DeepMind
Closed Weights
  • Google: Gemini 3 Flash Preview
    TextVisionFilesAudioVideo1M
  • Google: Gemini 3 Flash Preview (batch)
    TextVisionFilesAudioVideo1M
  • Google: Gemini 3.1 Flash Lite
    TextVisionVideoFilesAudio1M
  • Google: Gemini 3.1 Flash Lite (batch)
    TextVisionVideoFilesAudio1M
  • Google: Gemini 3.1 Flash Lite Preview
    TextVisionVideoFilesAudio1M
  • Google: Gemini 3.1 Pro Preview
    AudioFilesVisionTextVideo1M
  • Google: Gemini 3.1 Pro Preview (batch)
    AudioFilesVisionTextVideo1M
  • Google: Gemini 3.1 Pro Preview Custom Tools
    TextAudioVisionVideoFiles1M
  • Google: Gemini 3.5 Flash
    TextVisionVideoFilesAudio1M
  • Google: Gemini 3.5 Flash (batch)
    TextVisionVideoFilesAudio1M
  • Google: Gemini 3.5 Flash Lite
    TextVisionVideoFilesAudio1M
  • Google: Gemini 3.5 Flash Lite (batch)
    TextVisionVideoFilesAudio1M
  • Google: Gemini 3.6 Flash
    TextVisionVideoFilesAudio1M
  • Google: Gemini 3.6 Flash (batch)
    TextVisionVideoFilesAudio1M
  • Google: Lyria 3 Clip Preview
    TextVision1M
  • Google: Lyria 3 Pro Preview
    TextVision1M
  • Google: Nano Banana (Gemini 2.5 Flash Image)
    VisionText33K
  • Google: Nano Banana 2 (Gemini 3.1 Flash Image Preview)
    VisionText66K
  • Google: Nano Banana 2 (Gemini 3.1 Flash Image)
    VisionText131K
  • Google: Nano Banana 2 Lite (Gemini 3.1 Flash Lite Image)
    VisionText66K
  • Google: Nano Banana Pro (Gemini 3 Pro Image Preview)
    VisionText66K
  • Google: Nano Banana Pro (Gemini 3 Pro Image)
    VisionText131K
Open Weights
  • Google: Gemma 4 26B A4B
    VisionTextVideo262K
  • Google: Gemma 4 31B
    VisionTextVideo262K
usOpenAI
Closed Weights
  • OpenAI: GPT Audio
    TextAudio128K
  • OpenAI: GPT Audio Mini
    TextAudio128K
  • OpenAI: GPT Chat Latest
    TextVisionFiles400K
  • OpenAI: GPT-5
    TextVisionFiles400K
  • OpenAI: GPT-5 (batch)
    TextVisionFiles400K
  • OpenAI: GPT-5 Codex
    TextVision400K
  • OpenAI: GPT-5 Image
    VisionTextFiles400K
  • OpenAI: GPT-5 Image Mini
    FilesVisionText400K
  • OpenAI: GPT-5 Mini
    TextVisionFiles400K
  • OpenAI: GPT-5 Mini (batch)
    TextVisionFiles400K
  • OpenAI: GPT-5 Nano
    TextVisionFiles400K
  • OpenAI: GPT-5 Nano (batch)
    TextVisionFiles400K
  • OpenAI: GPT-5 Pro
    VisionTextFiles400K
  • OpenAI: GPT-5.1
    VisionTextFiles400K
  • OpenAI: GPT-5.1 (batch)
    VisionTextFiles400K
  • OpenAI: GPT-5.1 Chat
    FilesVisionText128K
  • OpenAI: GPT-5.1-Codex
    TextVision400K
  • OpenAI: GPT-5.1-Codex-Max
    TextVision400K
  • OpenAI: GPT-5.1-Codex-Mini
    VisionText400K
  • OpenAI: GPT-5.2
    FilesVisionText400K
  • OpenAI: GPT-5.2 (batch)
    FilesVisionText400K
  • OpenAI: GPT-5.2 Chat
    FilesVisionText128K
  • OpenAI: GPT-5.2 Pro
    VisionTextFiles400K
  • OpenAI: GPT-5.2-Codex
    TextVision400K
  • OpenAI: GPT-5.3 Chat
    TextVisionFiles128K
  • OpenAI: GPT-5.3-Codex
    TextVisionFiles400K
  • OpenAI: GPT-5.4
    TextVisionFiles1M
  • OpenAI: GPT-5.4 (batch)
    TextVisionFiles1M
  • OpenAI: GPT-5.4 Image 2
    VisionTextFiles272K
  • OpenAI: GPT-5.4 Mini
    FilesVisionText400K
  • OpenAI: GPT-5.4 Mini (batch)
    FilesVisionText400K
  • OpenAI: GPT-5.4 Nano
    FilesVisionText400K
  • OpenAI: GPT-5.4 Nano (batch)
    FilesVisionText400K
  • OpenAI: GPT-5.4 Pro
    TextVisionFiles1M
  • OpenAI: GPT-5.5
    FilesVisionText1M
  • OpenAI: GPT-5.5 (batch)
    FilesVisionText1M
  • OpenAI: GPT-5.5 Pro
    FilesVisionText1M
  • OpenAI: GPT-5.6 Luna
    FilesVisionText1M
  • OpenAI: GPT-5.6 Luna Pro
    FilesVisionText1M
  • OpenAI: GPT-5.6 Sol
    FilesVisionText1M
  • OpenAI: GPT-5.6 Sol Pro
    FilesVisionText1M
  • OpenAI: GPT-5.6 Terra
    FilesVisionText1M
  • OpenAI: GPT-5.6 Terra Pro
    FilesVisionText1M
  • OpenAI: o3 Deep Research
    VisionTextFiles200K
  • OpenAI: o4 Mini Deep Research
    FilesVisionText200K
Open Weights
  • OpenAI: gpt-oss-120b
    Text131K
  • OpenAI: gpt-oss-20b
    Text131K
  • OpenAI: gpt-oss-safeguard-20b
    Text131K
usxAI
Closed Weights
  • xAI: Grok 4.20
    TextVisionFiles2M
  • xAI: Grok 4.20 Multi-Agent
    TextVisionFiles2M
  • xAI: Grok 4.3
    TextVisionFiles1M
  • xAI: Grok 4.5
    TextVisionFiles500K
  • xAI: Grok Build 0.1
    TextVisionFiles256K
Open Weights

None

frMistral AI
Closed Weights
  • Mistral: Codestral 2508
    TextFiles256K
  • Mistral: Mistral Large 3 2512
    TextVisionFiles262K
  • Mistral: Mistral Medium 3.1
    TextVisionFiles131K
  • Mistral: Mistral Medium 3.5
    TextVisionFiles262K
Open Weights
  • Mistral: Devstral 2 2512
    TextFiles262K
  • Mistral: Ministral 3 14B 2512
    TextVision262K
  • Mistral: Ministral 3 3B 2512
    TextVision131K
  • Mistral: Ministral 3 8B 2512
    TextVision262K
  • Mistral: Mistral Small 4
    TextVision262K
  • Mistral: Voxtral Small 24B 2507
    TextAudioFiles32K
ilAI21 Labs
Closed Weights

None

Open Weights
  • AI21: Jamba Large 1.7
    Text256K
cnAlibaba (Qwen)
Closed Weights
  • Qwen: Qwen Plus 0728
    Text1M
  • Qwen: Qwen Plus 0728 (thinking)
    Text1M
  • Qwen: Qwen3 Coder Flash
    Text1M
  • Qwen: Qwen3 Coder Plus
    Text1M
  • Qwen: Qwen3 Max
    Text262K
  • Qwen: Qwen3 Max Thinking
    Text262K
  • Qwen: Qwen3.5 Plus 2026-02-15
    TextVisionVideo1M
  • Qwen: Qwen3.5 Plus 2026-04-20
    TextVisionVideo1M
  • Qwen: Qwen3.5-Flash
    TextVisionVideo1M
  • Qwen: Qwen3.6 Flash
    TextVisionVideo1M
  • Qwen: Qwen3.6 Max Preview
    Text262K
  • Qwen: Qwen3.6 Plus
    TextVisionVideo1M
  • Qwen: Qwen3.7 Flash
    TextVisionVideo1M
  • Qwen: Qwen3.7 Max
    Text1M
  • Qwen: Qwen3.7 Plus
    TextVision1M
Open Weights
  • Qwen: Qwen3 30B A3B Instruct 2507
    Text262K
  • Qwen: Qwen3 30B A3B Thinking 2507
    Text82K
  • Qwen: Qwen3 Coder 30B A3B Instruct
    Text262K
  • Qwen: Qwen3 Coder Next
    Text262K
  • Qwen: Qwen3 Next 80B A3B Instruct
    Text262K
  • Qwen: Qwen3 Next 80B A3B Thinking
    Text262K
  • Qwen: Qwen3 VL 235B A22B Instruct
    TextVision262K
  • Qwen: Qwen3 VL 235B A22B Thinking
    TextVision131K
  • Qwen: Qwen3 VL 30B A3B Instruct
    TextVision262K
  • Qwen: Qwen3 VL 30B A3B Thinking
    TextVision262K
  • Qwen: Qwen3 VL 32B Instruct
    TextVision131K
  • Qwen: Qwen3 VL 8B Instruct
    VisionText262K
  • Qwen: Qwen3 VL 8B Thinking
    VisionText131K
  • Qwen: Qwen3.5 397B A17B
    TextVisionVideo262K
  • Qwen: Qwen3.5-122B-A10B
    TextVisionVideo262K
  • Qwen: Qwen3.5-27B
    TextVisionVideo262K
  • Qwen: Qwen3.5-35B-A3B
    TextVisionVideo262K
  • Qwen: Qwen3.5-9B
    TextVisionVideo262K
  • Qwen: Qwen3.6 27B
    TextVisionVideo262K
  • Qwen: Qwen3.6 35B A3B
    TextVisionVideo262K
cnByteDance
Closed Weights
  • Seed: Seed 1.6
    VisionTextVideo262K
  • Seed: Seed 1.6 Flash
    VisionTextVideo262K
  • Seed: Seed-2.0-Lite
    TextVisionVideo262K
  • Seed: Seed-2.0-Mini
    TextVisionVideo262K
Open Weights

None

cnDeepSeek
Closed Weights

None

Open Weights
  • DeepSeek: DeepSeek V3.1
    Text164K
  • DeepSeek: DeepSeek V3.1 Terminus
    Text164K
  • DeepSeek: DeepSeek V3.2
    Text164K
  • DeepSeek: DeepSeek V3.2 Exp
    Text164K
  • DeepSeek: DeepSeek V4 Flash
    Text1M
  • DeepSeek: DeepSeek V4 Pro
    Text1M
cnMiniMax
Closed Weights
  • MiniMax: MiniMax M2-her
    Text66K
Open Weights
  • MiniMax: MiniMax M2
    Text205K
  • MiniMax: MiniMax M2.1
    Text205K
  • MiniMax: MiniMax M2.5
    Text205K
  • MiniMax: MiniMax M2.7
    Text205K
  • MiniMax: MiniMax M3
    TextVisionVideo1M
  • MiniMax: MiniMax M3 (batch)
    TextVisionVideo524K