Manchmal ist der schnellste Weg, nach etwas zu fragen, ein Foto davon zu machen. Schicken Sie ein Foto an diesen Telegram-Bot, und er führt ein Vision-Modell aus und antwortet dann mit einer strukturierten Aufschlüsselung dessen, was er sieht.
sonnet3 TageTelegram Bot APIClaude VisionSupabase
Claude
65ROI
75Scale
$4.3k94Saved
ROI for
README.md
Warum dieser Subagent
Manchmal ist der schnellste Weg, nach etwas zu fragen, ein Foto davon zu machen. Schicken Sie ein Foto an diesen Telegram-Bot, und er führt ein Vision-Modell aus und antwortet dann mit einer strukturierten Aufschlüsselung dessen, was er sieht.
Sie bekommen erkannte Objekte, jeden lesbaren Text und eine Bildunterschrift zurück statt einer vagen Vermutung. Das Bild und seine Analyse werden gespeichert, sodass Sie frühere Fotos durchsuchen können, statt den Chat nach diesem einen Screenshot zu durchscrollen.
So läuft er
Used at step 01 to kick off the pipeline.
Write
Used at step 01 to kick off the pipeline.
WebFetch
Used at step 01 to kick off the pipeline.
WebSearch
Used at step 01 to kick off the pipeline.
Das Bild an ein Vision-Modell übergeben, mit einem Prompt für die Art der Analyse, die Sie brauchen.
pending
Strukturierte Felder zurückgeben, etwa erkannte Objekte, Text und eine kurze Beschreibung.
pending
Die Bildreferenz und ihre Analyse speichern, sodass Ergebnisse später nachschlagbar sind.
pending
Beispiel-Output
json
// Sample output
// (generated when the pipeline finishes)
Analyze the attached image and return JSON with objects, any readable text, and a one-line caption.
Unlock the rest
The full agent definition, install snippet, and starter task are gated for community members.
Members get the full `.md` agent file, the npm / pnpm install one-liners, a starter prompt that we've tuned against real runs, and the open-source repo when this automation ships there. One email, magic link, done.