Ibland är det snabbaste sättet att fråga om något att ta en bild på det. Skicka ett foto till den här Telegram-boten så kör den en vision-modell och svarar sedan med en strukturerad uppdelning av vad den ser.
Ibland är det snabbaste sättet att fråga om något att ta en bild på det. Skicka ett foto till den här Telegram-boten så kör den en vision-modell och svarar sedan med en strukturerad uppdelning av vad den ser.
Du får tillbaka detekterade objekt, eventuell läsbar text och en bildtext snarare än en vag gissning. Bilden och dess analys sparas, så att du kan söka i tidigare foton i stället för att scrolla chatten efter just den skärmdumpen.
Så kör den
Used at step 01 to kick off the pipeline.
Write
Used at step 01 to kick off the pipeline.
WebFetch
Used at step 01 to kick off the pipeline.
WebSearch
Used at step 01 to kick off the pipeline.
Skicka bilden till en vision-modell med en prompt för den sorts analys du behöver.
pending
Returnera strukturerade fält som detekterade objekt, text och en kort beskrivning.
pending
Lagra bildreferensen och dess analys så att resultaten kan slås upp senare.
pending
Exempel på output
json
// Sample output
// (generated when the pipeline finishes)
Analyze the attached image and return JSON with objects, any readable text, and a one-line caption.
Unlock the rest
The full agent definition, install snippet, and starter task are gated for community members.
Members get the full `.md` agent file, the npm / pnpm install one-liners, a starter prompt that we've tuned against real runs, and the open-source repo when this automation ships there. One email, magic link, done.