Noen ganger er den raskeste måten å spørre om noe på å ta et bilde av det. Send et bilde til denne Telegram-boten, så kjører den en visjonsmodell og svarer med en strukturert oppdeling av hva den ser.
Noen ganger er den raskeste måten å spørre om noe på å ta et bilde av det. Send et bilde til denne Telegram-boten, så kjører den en visjonsmodell og svarer med en strukturert oppdeling av hva den ser.
Du får tilbake oppdagede objekter, eventuell lesbar tekst og en bildetekst i stedet for en vag gjetning. Bildet og analysen lagres, så du kan søke i tidligere bilder i stedet for å scrolle gjennom chatten for å finne det ene skjermbildet.
Slik kjører den
Used at step 01 to kick off the pipeline.
Write
Used at step 01 to kick off the pipeline.
WebFetch
Used at step 01 to kick off the pipeline.
WebSearch
Used at step 01 to kick off the pipeline.
Sender bildet til en visjonsmodell med en instruks om hvilken type analyse du trenger.
pending
Returnerer strukturerte felter som oppdagede objekter, tekst og en kort beskrivelse.
pending
Lagrer bildereferansen og analysen, så resultatene kan slås opp senere.
pending
Eksempel på output
json
// Sample output
// (generated when the pipeline finishes)
Analyze the attached image and return JSON with objects, any readable text, and a one-line caption.
Unlock the rest
The full agent definition, install snippet, and starter task are gated for community members.
Members get the full `.md` agent file, the npm / pnpm install one-liners, a starter prompt that we've tuned against real runs, and the open-source repo when this automation ships there. One email, magic link, done.