Vision
Image understanding, OCR, and screenshot tooling.
148 packages · auto-seeded from the “vision” category.
A persistent, policy-guarded Playwright browser for AI agents with network controls, trusted credential filling, proof screenshots, and CAPTCHA helpers.
browservision$ pi install npm:betterwrightPi extension for image generation via OpenAI gpt-image, Google Nano Banana (Gemini), Alibaba Qwen-Image, OpenRouter, and custom providers.
vision$ pi install npm:@amaster.ai/pi-image-genHound web research for Pi agent - keyless search, anti-bot fetch, deep crawl, screenshot, Internet Archive dead-link recovery. Free, MIT, no API key.
mcpwebvision$ pi install npm:@houndmcp/hound-mcp-piRun AI coding agents in pi TUI overlays with interactive, hands-free, and dispatch supervision
vision$ pi install npm:pi-interactive-shellCapability-aware vision + paste extension for the pi coding agent. Delegates image analysis to a vision model only when the active primary model is text-only; passes images through natively for multimodal models (zero delegation).
subagentvision$ pi install npm:@getpipher/visionPi extension for staging browser images and attaching them to the next message.
browservision$ pi install npm:@narumitw/pi-image-dropPi package that adds document_parse, document_search, document_screenshot, and a companion skill for local document understanding with LiteParse v2.
visionskill$ pi install npm:pi-docparserGive text-only pi models vision — describe images with a vision model you pick via an interactive picker, then hand off the text description to non-vision models
vision$ pi install npm:pi-vision-handoffBrowser control extension for pi — navigate, click, type, screenshot, and extract data from real Chrome via CDP
browservision$ pi install npm:pi-browser-harnessMCP vision bridge for text-only coding agents
mcpvision$ pi install npm:atlas-vision-mcp- @owlburtoe/pi-claudifyextension
Claude Code-style tool rows for pi with Ctrl+O image previews and consistent built-in, MCP, and custom tool rendering
mcpvision$ pi install npm:@owlburtoe/pi-claudify Image generation for Pi using the ChatGPT Images 2.0 model.
vision$ pi install npm:pi-codex-image-genUnofficial pi package that exposes Z.ai MCP server tools for web search, URL reading, repository reading, and vision workflows.
mcpwebvision$ pi install npm:pi-zai-mcpTyped Pi tools for browser automation, rendered-page context extraction, screenshots, and saved session state via agent-browser.
browservision$ pi install npm:@53able/pi-agent-browserQwenCloud provider for pi — access Qwen3.8, DeepSeek V4, GLM-5.2, Wan image generation, and HappyHorse video generation through QwenCloud's OpenAI-compatible API
vision$ pi install npm:pi-qwencloud-providerImage generation and image recognition tools for the Pi coding agent
vision$ pi install npm:@pi-unipi/imagePi extension for AI video generation plus local video composition: lossless clip concat and mixed image/video timelines with overlays, TTS, soft or burned subtitles, source audio, BGM, and bundled LGPL/GPL FFmpeg runtimes.
vision$ pi install npm:@amaster.ai/pi-video-gen- intent-petriextension
A Pi coding-agent extension for a certain current execution stack, provisional future paths, and a multi-session local web hub viewer.
webvision$ pi install npm:intent-petri Temporary pasted-image cache with compact placeholders for the pi coding agent.
vision$ pi install npm:pi-tian-image-cachePi extension that turns pasted image paths into first-class image attachments.
vision$ pi install npm:pi-pasterTypeScript port of the nano-banana-imagegen pi skill. Generate and edit images with Google Gemini image models via the @the-focus-ai/nano-banana CLI, with GEMINI_API_KEY resolution, output-path handling and batch generation. Exposed as a pi skill and the
visionskill$ pi install npm:@blackbelt-technology/pi-dashboard-nano-bananaPi quality-of-life extension: compact statusline/π prompt, reliable multiline input, styled pasted-image chips, session naming/search/context import, scheduled prompts, handoff, permission prompts, notifications, custom compaction, and a collapsed-thinkin
visionpromptsecurity$ pi install npm:@vanillagreen/pi-qol- pi-agent-browserextension
Browser automation tool for pi — interactive browsing, screenshots with inline vision, and session cleanup via agent-browser CLI
browservision$ pi install npm:pi-agent-browser DeepInfra provider for pi: dynamic model catalog, reasoning-effort thinking levels, vision, session usage + monthly billing footer
vision$ pi install npm:pi-deepinfraTerminal visual polish for pi coding agent: natural multi-level headings, tool-panel code blocks, user message accent bar, clipboard image chips
vision$ pi install npm:pi-agent-beautify- pi-image-pasteextension
Pi extension that turns pasted image paths into first-class image attachments with automatic optimization.
vision$ pi install npm:pi-image-paste Pi extension + skill for a ground→contract→mockup→test→fix→learn frontend design loop. Ships a live mockup server tool, a Playwright breakpoint-screenshot tool, and a design-contract scaffolder. Works in any React/Tailwind/shadcn project.
browservisionskill$ pi install npm:@blackbelt-technology/frontend-mockup-loopPi extension: review and test JS frontends headlessly — open dev-server pages in Playwright Chromium, interact with them, capture screenshots the model can see, and collect console/network errors.
browservision$ pi install npm:pi-frontend-checkStrict Plan Mode for Pi with revdiff review, immutable revisions, and explicit lifecycle completion.
visionplan$ pi install npm:@zhcsyncer/pi-plan-modeGenerate or edit PNG images in Pi using a ChatGPT Plus/Pro Codex subscription.
vision$ pi install npm:@crazygit/pi-codex-image-genComfyUI image/video generation extension for pi coding agent
vision$ pi install npm:pi-comfyui-paintpi extension that registers your llama.cpp server as a provider and auto-discovers every model it exposes at /v1/models — context size, vision and thinking support included
vision$ pi install npm:pi-llamacpp-providerLocal-first macOS screenshot optimizer for AI coding agents.
vision$ pi install npm:@marttinn/screenshotterPi extension exposing a gpt-5.5+ image generation tool backed by gpt-image-2.
vision$ pi install npm:pi-codex-image-toolBrowser automation and web research tools for pi — search, visit, screenshot, interact, and inspect console output
webbrowservision$ pi install npm:@dreki-gg/pi-browser-toolsVision agents for pi — forward images to a vision model (pimage) and YouTube/TikTok videos to a video analyst (pideo) from any non-vision model.
vision$ pi install npm:pi-vision-agentsPi Coding Agent extension for OmniRoute — view combos, browse providers, and sync models with enriched metadata (context windows, max tokens, reasoning, and vision) to the Ctrl+P picker
contextvision$ pi install npm:omniroute-pi-ext-integrationPi extension that turns terminal-dropped image paths into inline image attachments
vision$ pi install npm:pi-image-dropBrowser automation skill for pi — drive your real Chrome via the browser-use CDP CLI (navigate, screenshot, coordinate-click, extract, tabs). Penetrates closed shadow-DOM & cross-origin iframes via compositor-level coordinate clicks where js selectors fai
browservisionskill$ pi install npm:@getpipher/browserPi extension that gives non-vision GLM models (z.ai) image understanding via GLM-4.6V
vision$ pi install npm:glm-visionImprove OpenAI in pi with fast mode, usage stats, realtime voice, image generation, and footer polish.
vision$ pi install npm:@monotykamary/pi-better-openaiPi extension: Zero-setup multi-backend OCR — MinerU (free cloud), Ollama (local GPU, LaTeX formulas), Pix2Text (local Python). Extract text, formulas, and tables from images and PDFs. Default: zero config, works out of the box.
vision$ pi install npm:pi-ocr- @zhushanwen/pi-visionextension
Image analysis tool using multimodal vision models with memory sessions.
memoryvision$ pi install npm:@zhushanwen/pi-vision Pi Agent extension that adds a describe_image tool, letting non-multimodal models delegate image analysis to a vision-capable model (like Qwen VL)
subagentvision$ pi install npm:pi-vision-tool- pi-agent-pi-markitdownextension
Convert any document to Markdown with Microsoft's markitdown CLI — PDF, DOCX, PPTX, XLSX, images (OCR), audio (transcription), YouTube, HTML, CSV, JSON, XML, EPUB, ZIP
vision$ pi install npm:pi-agent-pi-markitdown Socratic planning and shared-understanding sessions for pi.
vision$ pi install npm:@majorgilles/pi-grill-meAgents should invoke this skill for Docker Compose deployments, container updates, stack health checks, rollbacks, compose-file changes, image upgrades, failed deploys, or service restart planning. Provides safe deployment and rollback workflows.
browservisionskill$ pi install npm:@firstpick/pi-skill-deployment-automationSlack read tools for pi — messages, threads, channels, search, and file/image downloads with Effect-powered client
vision$ pi install npm:@dreki-gg/pi-slackPDF manipulation, processing, and management toolkit for Pi coding agent — extract text/tables, merge/split, fill forms, create PDFs, OCR, watermark, encrypt/decrypt, and more
vision$ pi install npm:@joemccann/pi-pdfA cute, colorful pet companion for the pi coding agent. Use classic ASCII pets or Petdex image pets that live below your editor and react to tools, tests, commits, PRs, reviews, subagents, model swaps and more.
subagentvisiongit$ pi install npm:pi-pokepetCode Reasoning tools for pi and MCP — reflective sequential thinking with branching and revision support
mcpvisiongit$ pi install npm:@feniix/pi-code-reasoningStandalone Pi extension for OpenAI fast mode and image generation/editing.
vision$ pi install npm:@tryinget/pi-better-openaiPi TUI configuration and an on-demand Skill/CLI for image generation.
visionskill$ pi install npm:@bytetrue/pi-image-genAgents should invoke this skill when checking CVEs or known vulnerabilities in installed packages, dependencies, Docker images, OS packages, exposed services, or software versions. Produces severity-rated scan reports.
visionskillsecurity$ pi install npm:@firstpick/pi-skill-vulnerability-scannerScreenshot picker extension for pi coding agent - quickly select and attach screenshots to your prompts
vision$ pi install npm:pi-screenshots-pickerEssential extensions for pi — auto session naming, compact header, clipboard images, image pruning, markdown viewer, screenshots, and subagents.
subagentvision$ pi install npm:@samfp/pi-essentialsDeprecated Google Antigravity image generation extension for pi
vision$ pi install npm:@benvargas/pi-antigravity-image-genCommon pi-coding-agent extensions: web search (mmx) and MCP server bridge. NOTE: 0.3.0 removed spawn_subagent (→ @shog-lab/pi-subagent); 0.4.0 removed understand_image (models have native vision now); cron scheduling moved to @shog-lab/pi-bus; browser aut
mcpwebbrowsersubagentvision$ pi install npm:@shog-lab/pi-toolkit- pi-ui-hephaestusextension
Muted thinking blocks, framed editor, animated header, response time, rich footer, and clipboard image paste for pi
vision$ pi install npm:pi-ui-hephaestus Pi extension that registers an inspect_image tool — analyzes local image files using a configurable vision-capable model via OpenAI-compatible API
vision$ pi install npm:pi-inspect-imageImage-to-base64 tool for pi — lets image-capable models see local image files
vision$ pi install npm:@dougbots/pi-image-loaderVega-Lite chart extension for pi coding agent - render data visualizations as inline images
vision$ pi install npm:@walterra/pi-chartspi extension: convert a written prompt into an image and send it to the chat model
visionprompt$ pi install npm:imgify-piPi package for OpenAI/Codex image generation with a local browser studio.
browservision$ pi install npm:pi-imagegenImage preview extension for pi coding agent — renders inline image thumbnails above the editor using kitty graphics protocol with tmux support
vision$ pi install npm:pi-image-preview- end-piextension
Use Pi providers in Codex Desktop with seamless history switching, image input, and a local OpenAI-compatible proxy.
vision$ pi install npm:end-pi MiniMax MCP tools for pi - Web search and image understanding via MiniMax's Model Context Protocol
mcpwebvision$ pi install npm:@jayjanii/pi-minimax-mcpGLSL fragment shader viewer for Pi Agent — live WebGL preview, Tweakpane uniform controls, presets, probe sheets & video export
vision$ pi install npm:@gogomi/pi-glsl-shader-visionOpenCode-grade clipboard paste for pi on Windows: instant Ctrl+V image attachments, Explorer file drops as collapsible blocks, large-text collapsing, persistent clipboard helper
vision$ pi install npm:pi-power-paste- @ghoulm370/pi-zai-visionextension
Pi extension: Z.AI GLM-4.6V vision tools — image analysis, OCR, error diagnosis, diagram reading, UI diff, UI-to-code, video analysis
vision$ pi install npm:@ghoulm370/pi-zai-vision Pi extension: open files in $EDITOR via herdr, with per-extension openers (pdf, images, …)
vision$ pi install npm:pi-openerpi-web plugin that browses and previews screenshots saved by pi-web into .pi-web/paste/ — gallery panel, lightbox, and chat-inline previews for folder-mode attachments.
webvision$ pi install npm:@yieldcraft/screenshot-pastePi extension that renders LaTeX formulas as terminal images while preserving original LLM context.
vision$ pi install npm:pi-rich-rendererPi package that exposes Z.AI Web Search, Web Reader, Zread, and Vision MCP tools.
mcpwebvision$ pi install npm:pi-zai-toolsPi-first QA pack: scans real codebases, infers test surfaces, ranks risk, runs evidence-based checks, captures screenshots, and writes .qa/* reports.
vision$ pi install npm:@justynclark/project-aware-qaRestart llama-server with different model configurations. For single-model setups where models need different flags (context size, vision projector, sampling params).
vision$ pi install npm:pi-llama-switch- @cluski/pi-inspect-imageextension
Pi extension that exposes an inspect_image tool backed by a configurable VLM.
vision$ pi install npm:@cluski/pi-inspect-image Headless browser for Pi — browse the web with DOM + OCR text maps. No image tokens, 10-50x cheaper than screenshot-based browsing.
webbrowservision$ pi install npm:@bytesbrains/pi-textbrowser- pi-image-gen-togetherextension
Pi image generation tool powered by Together AI (Flux, Ideogram, and more)
vision$ pi install npm:pi-image-gen-together - pi-image-gen-openaiextension
Pi image generation tool powered by OpenAI (GPT Image, DALL-E)
vision$ pi install npm:pi-image-gen-openai - @hhyy668/pi-skills-libraryextension
Curated Pi skills for lookfor.cc image generation and Tavily search guidance
vision$ pi install npm:@hhyy668/pi-skills-library JSON-first CLI for Linear. Wraps every authenticated Linear MCP tool: projects, issues, comments, attachments, cycles, documents, milestones, teams, users, labels, statuses, images, and docs search.
mcpvision$ pi install npm:@ruminaider/linear-cliMiniMax image understanding — pi extension and standalone CLI
vision$ pi install npm:@rwese/minimax-image-understandingOCR image-to-text tool for Pi — extracts text from screenshots, terminal output, and code images using Tesseract + ImageMagick
vision$ pi install npm:@k3_2o/pi-read-image- pi-accurate-visionextension
Accurate spatial reasoning over images — vision model extracts bounding boxes, LLM calculates exact distances
vision$ pi install npm:pi-accurate-vision - pi-image-gen-xaiextension
Pi image generation tool powered by xAI (Grok Imagine / Aurora)
vision$ pi install npm:pi-image-gen-xai Read GitHub issues, PRs, diffs, checks & code from inside Pi — via the gh CLI. Chronological markdown, image extraction, PR review workflows.
visiongit$ pi install npm:@gwynnnplaine/pi-github- @ssweens/pi-image-genextension
Provider-agnostic image generation for Pi coding agent
vision$ pi install npm:@ssweens/pi-image-gen - pi-image-gen-routerextension
Pi image generation tool that auto-detects available API keys
vision$ pi install npm:pi-image-gen-router - pi-image-gen-replicateextension
Pi image generation tool powered by Replicate (Flux, SD, and more)
vision$ pi install npm:pi-image-gen-replicate - pi-githubextension
GitHub tool extension for Pi: format threads, list issues/PRs, and inspect PR diffs/images.
visiongitlinter$ pi install npm:pi-github Screenshot skill and inline screenshot extension for pi
visionskill$ pi install npm:@m64/pi-screenshot-toolsUmans provider extension for pi coding agent. (No extra tools, no vision proxy, just the provider.)
vision$ pi install npm:@czottmann/pi-umans- pi-image-gen-recraftextension
Pi image generation tool powered by Recraft (V3, V4)
vision$ pi install npm:pi-image-gen-recraft Pi extension that gives non-vision models the ability to analyze images via a vision-capable subagent
subagentvision$ pi install npm:pi-image-subagent- @lokiyou/modelscope-visionextension
Simple image understanding for Pi Coding Agent. Install it, set your API key, and ask normal questions about images.
vision$ pi install npm:@lokiyou/modelscope-vision Fallback image understanding for models without native vision support - provides understand_image tool via MiniMax API
vision$ pi install npm:@zgltyq/pi-minimax-imageCHOICES.md management — clarify project vision, mission, UX, operations, architectural decisions with cascading impact review. Includes replan skill for gap analysis and PLAN.md generation.
visionplanskill$ pi install npm:@a-canary/pi-choose-wiselyDisplay images from inside the pi coding agent: imgcat-style inline rendering in supported terminals, and one-click open in the system browser.
browservision$ pi install npm:@gregjohnso/pi-imgviewScreenshot picker for pi — browse, select, and attach screenshots to your prompts
vision$ pi install npm:pi-screenshots- pi-xai-imagineextension
Pi extension for xAI image, video, and vision workflows
vision$ pi install npm:pi-xai-imagine Pi extension that resizes oversize images at Read-time so they fit model byte and pixel ceilings.
vision$ pi install npm:@blackbelt-technology/pi-image-fitPi package that exposes Codex-style image_generation and view_image tools with dynamic model routing.
vision$ pi install npm:@capyup/pi-codex-imageLinux desktop-control MCP server: AT-SPI accessibility trees, Wayland/X11 input, screenshots, and compositor window targeting.
mcpvision$ pi install npm:@agent-sh/computer-use-linuxPi extension that resizes oversize images at Read-time so they fit model byte and pixel ceilings.
vision$ pi install npm:@blackbelt-technology/pi-image-fit-extensionPi skill — a mechanical, countable anti-slop checklist for AI-generated frontend. Catches the specific tells an undirected model defaults to (AI-purple, Inter-everywhere, em-dashes, div-based fake screenshots, eyebrow-per-section, Jane Doe / Acme data). A
visionskill$ pi install npm:@blackbelt-technology/anti-slop-frontendSynthetic (synthetic.new) model provider for pi - Dynamic model fetching with reasoning, vision, and tools support
vision$ pi install npm:@benvargas/pi-synthetic-providerMinimal Codex/OpenAI native tools for Pi: Codex image_generation, view_image, apply_patch
vision$ pi install npm:@vanillagreen/pi-codex-minimal-toolsImage attachment and rendering extension for Pi TUI
vision$ pi install npm:pi-image-toolsGraphviz chart extension for pi coding agent - render DOT diagrams as inline images
vision$ pi install npm:@walterra/pi-graphvizLocal hybrid RAG pipeline for the Pi coding agent. SQLite FTS5 + sqlite-vec, ONNX embeddings via Transformers.js, PDF/DOCX/HTML extraction (with OCR fallback), per-project storage, auto-injection. Zero cloud dependency.
vision$ pi install npm:pi-local-ragAutomatic image, video and audio description for any model in Pi. Routes media to a multimodal model and injects descriptions into context.
vision$ pi install npm:pi-multimodal-proxyMiniMax Coding Plan extension for pi coding agent - provides web_search and understand_image tools
mcpvisionplan$ pi install npm:@imsus/pi-extension-minimax-coding-plan-mcpPi extension package for direct HTTP GET plus web_search, web_fetch, and web_image via Firecrawl, Exa, Tavily, and Brave.
webvision$ pi install npm:@xl0/pi-lovely-webPi-native ralph loop — autonomous coding iterations with mid-turn supervision
vision$ pi install npm:@lnilluv/pi-ralph-loopExpose Codex subscription image, search, Fast, and usage APIs as native Pi tools and commands
vision$ pi install npm:@99percentpeople/pi-codex-apipi package adding a describe_image tool that lets non-multimodal models delegate image analysis to a vision model
subagentvision$ pi install npm:@yandy0725/pi-vision-toolsMetabase CLI with full read/write access: cards, dashboards, databases, tables, queries, collections, search, and revisions from the terminal. Token-efficient JSON output.
vision$ pi install npm:@ruminaider/metabase-cliPi skill for browser automation via Chrome DevTools Protocol — navigate, evaluate JS, screenshot, pick elements, dismiss cookies, and monitor console/network logs.
browservisionskill$ pi install npm:pi-skill-agent-browserPi extension: load a Simocracy sim into your chat — see its pixel-art sprite render inline in the terminal and roleplay with it.
vision$ pi install npm:pi-simocracyMiniMax web_search and understand_image tools for pi
vision$ pi install npm:pi-minimax-toolsOpenRouter multimodal tools for Pi — search, fetch, image gen, vision, video, PDF, TTS, STT
vision$ pi install npm:@dtmirizzi/pi-openrouter-multimodalGenerate, edit, and analyze images in pi using Google Nano Banana (image gen) and Gemini Vision (analysis). Inline terminal preview, reference-image editing, auto-save.
vision$ pi install npm:pi-bananaLocal RapidOCR tools and slash commands for Pi, with a configurable backend adapter layer.
visionprompt$ pi install npm:@zegging/pi-ocr-local- @ameno/pi-minimax-mcpextension
MiniMax MCP tools for pi - Web search and image understanding via MiniMax's Model Context Protocol
mcpwebvision$ pi install npm:@ameno/pi-minimax-mcp Run anything long-lived under babysit — one supervision substrate for processes and pi subagents, surfaced to the agent as babysit_run/check/send/wait/kill.
subagentvision$ pi install npm:pi-babysitConnect pi to 9Router — multi-provider chat models plus image, speech, search, and fetch tools
vision$ pi install npm:@qmahyar/pi-9routerPi package for agent-assisted electronics/PCB image inventory with Cloudflare Workers AI vision and datasheet enrichment.
vision$ pi install npm:vision-electronic-indexing-piRender LaTeX as terminal images in Pi's TUI.
vision$ pi install npm:@fadouse/pi-mathPi extension that generates images via 9router's Codex image_generation tool (gpt-image-2).
vision$ pi install npm:pi-9router-imagegen[Alt+V] WSL image paste support for pi using the Windows clipboard
vision$ pi install npm:@lumendigitaldev/pi-wsl-imagesPi image generation tool backed by local CLI providers: Codex or Agy.
vision$ pi install npm:@smoose/pi-image-genIsolate and cache images so repeated payloads stay out of pi's main LLM context.
vision$ pi install npm:@yusukeshib/pi-image-context-cache- @pi-archimedes/image-pasteextension
Clipboard image paste for pi-archimedes
vision$ pi install npm:@pi-archimedes/image-paste - @earendil-works/pi-radius-workextension
Radius Google Workspace and image generation extensions for Pi
vision$ pi install npm:@earendil-works/pi-radius-work Pi extension that gives text-only models media understanding — describes images, transcribes local audio, routes local videos through native understanding for what-questions or frames+local ASR for when-questions, then feeds text to the active model
vision$ pi install npm:pi-sense- @cynos-ai/toolsextension
Cynos universal search, vision, and browser tools for the pi coding agent.
browservision$ pi install npm:@cynos-ai/tools Pi extension: [image n] placeholders + SIXEL thumbnails for paste and tool screenshots (Windows Terminal + zentui). Supports agent_browser / agent-browser / Playwright. Switches: wrap/thumbs.
browservision$ pi install npm:@zichuanlan/pi-image-placeholderLog in to the airpx LLM proxy (https://airpx.cc) with an sk-proxy API key and auto-import its model catalog (prices, context windows, reasoning, vision) into the pi coding agent.
webcontextvision$ pi install npm:pi-airpxMinimal Ctrl+V image attachments with atomic [Image #01] placeholders for Pi.
vision$ pi install npm:pi-atomic-imagesLayout-aware PDF parsing, search, and screenshots using vision models already authenticated in Pi.
vision$ pi install npm:@okrapdf/piPi image recognition tool: lets text-only models see images via local CLI providers (Codex or Agy).
vision$ pi install npm:@smoose/pi-visionGive text-only Pi and OMP models vision by handing images to a vision-capable model and returning text descriptions
vision$ pi install npm:@hazrid1993/pi-vision-handoff- @lalalic/local-vision-audioextension
Local vision (describe images), STT (speech-to-text), and TTS (text-to-speech). macOS uses MLX (Apple Silicon GPU). Windows/Linux use whisper, edge-tts, and transformers.
vision$ pi install npm:@lalalic/local-vision-audio Pi extension — describe images via vision model when your active model cannot see images directly
vision$ pi install npm:describe-image-agent- pi-image-gen-googleextension
Pi image generation tool powered by Google (Nano Banana, Imagen)
vision$ pi install npm:pi-image-gen-google Pi extension that powers native Pi @file picking with background television-style search
vision$ pi install npm:@ramarivera/pi-televisionFlicker-free inline images for Pi on Wayland + Ghostty, using Kitty Unicode placeholders.
vision$ pi install npm:@itc-steve/pi-wl-images