Βοηθοί που ενεργούν: ασφαλείς ενσωματώσεις ημερολογίου και Gmail
Από Win.AI Editorial

Η θέση μου: η κατασκευή ασφαλών, χρηστικών βοηθών που ενεργούν σε ημερολόγια, Gmail και συνδεδεμένες εφαρμογές απαιτεί την σχεδίαση μιας διαδικασίας πρώτης άδειας, τη διαχωρισμό του σχεδιασμού από τη δράση και την ενσωμάτωση ροών ελέγχου και ανατροπής στο επίπεδο εκτέλεσης από την πρώτη μέρα. Αυτό το άρθρο παρέχει μια συνοπτική λίστα ελέγχου μηχανικής και εκτελέσιμες προτροπές για να φτάσετε εκεί.
ΣΧΕΔΙΑΣΜΟΣ ΑΔΕΙΑΣ ΓΙΑ ΒΟΗΘΟΥΣ ΠΟΥ ΕΝΕΡΓΟΥΝ
Ξεκινήστε με OAuth ανά χρήστη και ελάχιστες άδειες. Χρησιμοποιήστε OAuth που είναι συνδεδεμένο με τον χρήστη αντί για έναν κοινόχρηστο λογαριασμό υπηρεσίας, εκτός αν ο διαχειριστής απαιτεί ρητά την αντιπροσώπευση τομέα. Η τεκμηρίωση της Google σχετικά με τις λεπτομερείς άδειες είναι η βάση: αντιστοιχίστε κάθε δυνατότητα του βοηθού σε μια μόνο άδεια OAuth και τεκμηριώστε την κατανοητή πρόθεση για αυτήν την άδεια. Κρατήστε τους κωδικούς εκτός από τις προτροπές. Αποθηκεύστε τους σε μια θυρίδα και εισάγετε τα διαπιστευτήρια μόνο κατά τον χρόνο κλήσης μέσα σε μια υπηρεσία εκτέλεσης που επιβάλλει την πολιτική.
Παρατηρήσαμε ότι οι ομάδες που θεωρούν τις άδειες ως εμπειρία προϊόντος, με καθαρές οθόνες συναίνεσης και προεπισκοπήσεις αδειών, έχουν πολύ λιγότερα εισιτήρια υποστήριξης. Ένα θέμα που συναντήσαμε είναι η διάδοση των κωδικών λόγω ανόητης λογικής ανανέωσης. Κεντρικοποιήστε την ανανέωση και περιστρέφονται οι κωδικοί ανανέωσης τακτικά.
ΣΧΕΔΙΑΣΜΟΣ ΑΥΤΙΣΜΟΥ
Διαχωρίστε τον βοηθό σε έναν σχεδιαστή και έναν εκτελεστή. Ο σχεδιαστής παράγει ένα διακριτό σχέδιο δράσης: διαβάστε πρόσφατες συνομιλίες, προτείνετε δύο ώρες συνάντησης, συντάξτε ένα προσχέδιο email. Ο εκτελεστής εκτελεί μόνο μετά από έλεγχο πολιτικής και, για ευαίσθητες δράσεις, ένα βήμα επιβεβαίωσης από άνθρωπο. Αυτό το μοτίβο εμποδίζει το μοντέλο να αυτοσχεδιάσει σε προνομιακές λειτουργίες και καθιστά την έγκριση ελέγξιμη.
Πρακτικός συμβιβασμός: μεγαλύτερη καθυστέρηση για ανθρώπινη έγκριση έναντι χαμηλότερου κινδύνου. Για πολλές δράσεις ημερολογίου και email, μια παύση 30 έως 60 δευτερολέπτων με άνθρωπο στη διαδικασία είναι αποδεκτή. Για εργασίες υψηλής συχνότητας, οι ομαδικές εγκρίσεις λειτουργούν καλύτερα από τις εγκρίσεις ανά δράση.
ΔΟΚΙΜΕΣ, ΛΟΓΑΡΙΑΣΜΟΙ ΚΑΙ ΑΝΑΚΑΜΨΗ
Κάθε δράση πρέπει να παράγει μια αμετάβλητη καταχώριση ελέγχου που να περιέχει την ζητούμενη πρόθεση, την έξοδο του σχεδιαστή, την απόφαση πολιτικής, την κλήση του εκτελεστή και την απάντηση API που επιστράφηκε. Κρατήστε μια επαναπαράγable μορφή εντολών ώστε να μπορείτε να επαναπαράγετε και να ανατρέψετε. Παρέχετε μια δυνατότητα ανάκλησης με ένα κλικ για τις τελευταίες Ν δράσεις και μια διαδικασία αποκατάστασης που δημιουργεί συμβατές εκδηλώσεις, για παράδειγμα ακυρώνοντας μια εκδήλωση και στέλνοντας μια διορθωτική παρακολούθηση.
Παρατηρήσαμε ότι οι φρουροί σε επίπεδο προτροπής αποτυγχάνουν χωρίς μια εξωτερική μηχανή πολιτικής. Στην πράξη, τα μοντέλα θα προτείνουν αλλαγές που φαίνονται πειστικές αλλά παραβιάζουν την πολιτική. Μια πύλη εκτέλεσης που αρνείται οποιαδήποτε γραφή όταν η εμπιστοσύνη είναι κάτω από ένα βαθμονομημένο κατώφλι μειώνει αυτά τα περιστατικά.
ΛΙΣΤΑ ΕΛΕΓΧΟΥ ΓΙΑ ΠΡΟΪΟΝ ΚΑΙ ΜΗΧΑΝΙΚΗ
- OAuth ανά χρήστη με ελάχιστες άδειες και ρητό κείμενο συναίνεσης. 2. Θυρίδα κωδικών και υπηρεσία εκτέλεσης που εισάγει διαπιστευτήρια σε πραγματικό χρόνο. 3. Διαχωρισμός σχεδιαστή/εκτελεστή με ελέγχους πολιτικής. 4. Ανάδειξη ανθρώπου στη διαδικασία για ευαίσθητες δράσεις. 5. Αμετάβλητα αρχεία καταγραφής ελέγχου και επαναπαραγώγιμη μορφή δράσης. 6. Ροές ανατροπής και αντισταθμιστικών με σαφείς ευκολίες UI.
Συνδέστε την εμπειρία προϊόντος με τα μοτίβα ροής εργασίας που περιγράφονται στο Σχεδιάζοντας ροές εργασίας ανθρώπων-ΑΙ και χρησιμοποιήστε την εισαγωγή για τις διαφορές των βοηθών στο AI agents vs chatbots για να δικαιολογήσετε τον διαχωρισμό σχεδιαστή/εκτελεστή.
Δοκιμάστε το μόνοι σας. Οι παρακάτω προτροπές δείχνουν την έξοδο του σχεδιαστή σε σύγκριση με τις ασφαλείς οδηγίες του εκτελεστή. Αναμείνατε συνοπτικά σχέδια τύπου JSON από τον σχεδιαστή και σύντομες επιβεβαιώσεις από τον εκτελεστή.
Αυτή η προτροπή ζητά από το μοντέλο να παραγάγει ένα περιορισμένο σχέδιο πιθανών χρόνων συνάντησης και μια εξήγηση. Χρησιμοποιήστε το ως τον σχεδιαστή. Αναμείνατε 2 έως 3 υποψήφια χρονικά slots και μία πρόταση αιτιολογίας.
Είστε σχεδιαστής συναντήσεων. Ο χρήστης έχει 3 ελεύθερες θέσεις σήμερα: 10:00 π.μ., 2:30 μ.μ., 4:00 μ.μ. Επιστρέψτε ακριβώς τρία υποψήφια χρονικά για συνάντηση σε μορφή ISO με μία πρόταση αιτιολογίας για καθένα, και μία πρόταση ιδιωτικότητας που να λέει αν η πρόσκληση αγγίζει εξωτερικά emails.
Αυτή η προτροπή είναι για τον εκτελεστή. Αναμένει έναν κωδικό επιβεβαίωσης ανθρώπου και μια ρητή επιτυχία ελέγχου πολιτικής πριν δημιουργήσει την εκδήλωση.
Εκτελεστής: δεδομένου του κωδικού επιβεβαίωσης χρήστη X και του σχεδίου του σχεδιαστή Y, καλέστε Calendar.CreateEvent με τα πεδία {start,end,attendees,summary} μόνο εάν το policy_check(policy_id:calendar_write) επιστρέφει pass. Εάν αποτύχει ο έλεγχος πολιτικής, επιστρέψτε τον κωδικό αποτυχίας και την ανθρώπινη ενέργεια που απαιτείται.
Μια αντίκρουση είναι ότι οι αυστηροί έλεγχοι επιβραδύνουν την υιοθέτηση. Η εκτίμησή μου είναι ότι όταν οι ομάδες επιβάλλουν αυτά τα μοτίβα, η αρχική διατήρηση χρηστών βελτιώνεται επειδή η εμπιστοσύνη μεγαλώνει, ακόμη και αν η αρχική ενεργοποίηση είναι πιο αργή. Ο συμβιβασμός είναι σαφής: ταχύτερη ανάπτυξη χωρίς αυτούς τους ελέγχους δημιουργεί μετρήσιμο κίνδυνο και υψηλότερα κόστη αποκατάστασης.




