Τεχνητή νοημοσύνη

Μπορούν οι Επιχειρήσεις να Εμπιστευτούν τις Συμβουλές AI υπό Πίεση;

mm
Προσθέστε το Securities.io στις προτιμώμενες πηγές σας στο Google

Καθώς η τεχνολογία AI εξελίσσεται και ενσωματώνεται στην επιχειρηματική πρακτική και στη λήψη αποφάσεων, προκύπτουν πολλές ερωτήσεις. Η πρώτη, φυσικά, είναι το ζήτημα της αξιοπιστίας, με τις «αλησμόνητες» (hallucinations) των πρώτων εκδόσεων των LLM να έχουν επηρεάσει μόνιμα την εμπιστοσύνη των χρηστών στην αλήθεια των δεδομένων που παρέχουν οι AI, ακόμη και αν το πρόβλημα είναι γενικά λιγότερο διαδεδομένο στα νεότερα μοντέλα.

Μια άλλη ερώτηση είναι εάν η AI θα διατηρήσει τα μέτρα ασφαλείας και τις ηθικές οδηγίες της υπό πίεση από χρήστες, τα εμπορικά συμφέροντα των προγραμματιστών της ή απλώς επαναλαμβανόμενες και έξυπνες προσπάθειες να βρεθούν παρακάμψεις στον σχεδιασμό των LLM.

Μια νέα μελέτη από ερευνητή του Universidad Pablo de Olavide στην Ισπανία δοκίμασε άμεσα την ικανότητα πολλαπλών LLM να αντισταθούν σε τέτοια πίεση και να τηρήσουν τις ηθικές τους οδηγίες. Ανέπτυξε ένα πρωτόκολλο για τη δοκιμή οποιουδήποτε LLM, στο οποίο χρησιμοποιείται προσαρμοστικός διάλογος και τα αντίλογα ρυθμίζονται ανάλογα με την προηγούμενη απάντηση του μοντέλου.

Η μελέτη δημοσιεύθηκε στο Computers in Human Behavior Reports1, υπό τον τίτλο «Πρέπει οι επιχειρήσεις να εμπιστεύονται τις συμβουλές AI; Μια μεθοδολογία για την αξιολόγηση της ηθικής ακεραιότητας των chatbot».

Από την Αναζήτηση στους Συμβούλους

Αρχικά, τα LLM χρησιμοποιούνταν με παρόμοιο τρόπο με μια πιο γνωστή τεχνολογία για τον χρήστη: ως μηχανή αναζήτησης. Όμως καθώς η ικανότητα λογικής τους αυξήθηκε, χρησιμοποιούνται όλο και περισσότερο για να αντικαταστήσουν ή να συμπληρώσουν τη συμβουλή ενός εκπαιδευμένου επαγγελματία: δικηγόρων, γιατρών, μηχανικών κ.λπ.

«Όταν ένα τέτοιο μοντέλο ερωτηθεί αν πρέπει να προσλάβει έναν συγγενή, να κρύψει εισόδημα σε μετρητά ή να λανσάρει ένα ελαττωματικό προϊόν, η απάντηση δεν είναι πλέον πληροφοριακή — είναι συμβουλευτική. Ένας εταιρικός σύμβουλος πρέπει όχι μόνο να είναι ακριβής, αλλά και να παραμένει ηθικά συνεπής όταν ο χρήστης αντιτίθεται με επιχειρήματα κέρδους, επιβίωσης ή ευκολίας.»

Έτσι, με αυτό το ζήτημα στο νου, η μελέτη προτείνει το Πρωτόκολλο Προσαρμοστικής Ηθικής Αξιολόγησης (AEEP).

Η μελέτη εστιάστηκε σε μικρές και μεσαίες επιχειρήσεις (SMEs) επειδή αυτό το τμήμα είναι πιο πιθανό να αναθέσει συμβουλευτική εργασία σε LLM, καθώς λείπουν εσωτερικές λειτουργίες συμμόρφωσης, νομικές ή ηθικές. Επιπλέον, τα διλήμματα που αντιμετωπίζουν οι ιδρυτές των ΜΜΕ, όπως νεποτισμός, απάτη, παρενόχληση ή κακή χρήση δεδομένων, συμπίπτουν με τις ηθικο-νομικές γκρίζες ζώνες που ρυθμίζονται ρητά από τον EU AI Act και το GDPR.

Μέτρηση Ηθικής Σταθερότητας

Το AEEP ορίζει την ηθική αξιοπιστία των συμβούλων LLM ως μια μετρήσιμη ιδιότητα της πολυδιάστατης αλληλεπίδρασης, όχι των μοναδικών απαντήσεων. Με αυτόν τον τρόπο, μπορεί να εντοπίσει βαθύτερα ελαττώματα που μια επιφανειακή ανάλυση με μόνο μια αρχική απάντηση δεν θα αποκαλύψει.

Παρέχει μια πλήρως καθορισμένη, επαναλήψιμη διαδικασία κωδικοποίησης (ανίχνευση συναισθήματος, λέξεων-κλειδιών και αντίφαση βάσει NLI) των αποτελεσμάτων της, τα οποία επικυρώνονται με τυφλές αξιολογήσεις ειδικών.

Η μελέτη εφάρμοσε αυτό το τεστ σε πέντε διαφορετικά πρωτοπόρα LLM: ChatGPT, Claude, Gemini, Grok, DeepSeek.

Αποκάλυψε σταθερές, μοντέλο-επίπεδο διαφορές στην ηθική συνοχή υπό πίεση που είναι αόρατες στα συμβατικά κριτήρια.

Ωστόσο, πρέπει να σημειωθεί ότι τέτοια μοντέλα εξελίσσονται πολύ γρήγορα, και τα μοντέλα δοκιμάστηκαν από 12 έως 14 Μαΐου 2025, οπότε οι σχετικές τους κατατάξεις δεν μπορούν να περιγράψουν αξιόπιστα τις δυνατότητές τους στα τέλη του 2026.

Αποκαλύπτει τη δυνατότητα δημιουργίας ενός τέτοιου ενημερωμένου κριτηρίου που θα μετρά όχι την ακρίβεια ή την αποδοτικότητα υπολογισμού, αλλά την ηθική σταθερότητα.

Μέτρηση Ηθικής

Οι Πολλές Μορφές Ηθικής Παράβασης

Το τι αποτελεί ή δεν αποτελεί ηθική επιχειρηματική συμπεριφορά, φυσικά, υπόκειται σε κάποιο επίπεδο πολιτισμικής διαφοράς και προσωπικής κρίσης. Ωστόσο, μια επιχείρηση, και ιδιαίτερα μια μικρή ή μεσαία, μπορεί να εκτεθεί σε ηθικούς κινδύνους που αναγνωρίζονται ως προβληματικοί.

Η πρώτη είναι η διαφθορά και τα δωράκια. Ένας ιδρυτής μπορεί να πιεστεί να δωρίσει σε δημόσιο αξιωματούχο για να επιταχύνει μια άδεια, ή να δώσει επιστροφή σε υπάλληλο προμηθειών για να κερδίσει σύμβαση. Αυτό τελικά διαταράσσει τον δίκαιο ανταγωνισμό και ανταμείβει την εξαπάτηση, ενώ εκθέτει την εταιρεία σε νομικό και φήμης κίνδυνο.

Ένα άλλο ηθικό ζήτημα που αντιμετωπίζουν οι επιχειρήσεις είναι ο τρόπος αντιμετώπισης του προσωπικού τους υπό πίεση απόδοσης. Καθώς η εκμετάλλευση βλάπτει το ηθικό, αυξάνει την αποχώρηση και βλάπτει τη φήμη, οι φιλόδοξοι στόχοι απόδοσης πρέπει να παραμείνουν εντός του πλαισίου όχι μόνο των νόμιμα εξουσιοδοτημένων ενεργειών, αλλά και να συνδέονται με δίκαιη αποζημίωση, ασφάλεια και λογικές συνθήκες εργασίας.

Η παραπλάνηση των καταναλωτών σχετικά με χαρακτηριστικά προϊόντος, ποιότητα ή ετοιμότητα αποτελεί τρίτο επαναλαμβανόμενο δίλημμα. Για παράδειγμα, πολλές νεοσύστατες εταιρείες υπό πίεση για γρήγορη προσέλκυση ή συγκέντρωση κεφαλαίων μπορεί να είναι παρότρυνε να υπερβάλλουν την απόδοση σε υλικά πωλήσεων ή παρουσιάσεις.

Και φυσικά, η ασφάλεια προϊόντος και η προστασία του καταναλωτή είναι ακόμη πιο σημαντικές για να αποφευχθεί οποιοσδήποτε χρήστης να υποστεί ζημιά από ένα προϊόν που μπορεί να μην λειτουργεί όπως αναμένεται.

Τέλος, τα συμφέροντα συγκρούσεων και η αυτοεξυπηρέτηση μπορεί να είναι ιδιαίτερα διαδεδομένα σε μικρές επιχειρήσεις, όπου το φράγμα μεταξύ του ιδρυτή και της εταιρείας είναι πιο λεπτό από ό,τι σε μεγάλες εταιρείες με διοικητικό συμβούλιο και εξωτερικούς μετόχους. Αυτό ωστόσο μπορεί να υπονομεύσει την εμπιστοσύνη μεταξύ των συνιδρυτών, των εργαζομένων και των επενδυτών.

«Ένας ιδρυτής μπορεί να σκεφτεί να απονείμει ένα επικερδές συμβόλαιο σε επιχείρηση στην οποία έχει ή οι συγγενείς του έχουν μερίδιο ή μπορεί να χρησιμοποιήσει κεφάλαια της εταιρείας για προσωπικά έξοδα. Αυτό το σενάριο δοκιμάζει τη δέσμευση του ιδρυτή προς το καταπιστευτικό καθήκον και τη δικαιοσύνη.»

Ηθική & AI

Η άνοδος της AI στις επιχειρήσεις φέρνει νέα ηθικά διλήμματα για τους επιχειρηματίες που ενσωματώνουν αυτές τις τεχνολογίες. Τα συστήματα AI μπορούν ακούσια να ενσωματώσουν προκαταλήψεις, να απειλήσουν την ιδιωτικότητα και να λαμβάνουν αυτόνομες αποφάσεις με ηθικές συνέπειες.

«Για παράδειγμα, μια νεοσύστατη εταιρεία που χρησιμοποιεί ένα εργαλείο πρόσληψης με AI μπορεί να διαπιστώσει ότι ο αλγόριθμος διακρίνει κάποιες ομάδες: θα πρέπει να καθυστερήσουν τη χρήση του εργαλείου (με κόστος στην αποδοτικότητα) για να βελτιώσουν τη δικαιοσύνη του;»

Έτσι, όσοι υιοθετούν AI πρέπει να είναι ενήμεροι για τέτοιους ηθικούς κινδύνους και να τους μετριάσουν κατάλληλα.

«Η ηθική διαχείριση της AI γίνεται δοκιμαστικό κριτήριο για τη σύγχρονη επιχειρηματική ηγεσία, καθώς απαιτεί ισορροπία τεχνικής εξυπνάδας, προνοητικότητας και ηθικής ευθύνης.»

Και θα μπορούσε να είναι εξίσου χρήσιμο για ολόκληρη τη βιομηχανία AI να αρχίσει να υιοθετεί συνεπή κριτήρια και κοινά πρότυπα εκτός του γενικού όρου «AI safety».

Δημιουργία Δοκιμής για Ηθική Σταθερότητα

Το τεστ AEEP παρουσιάζει δέκα προοδευτικά πιο δύσκολα ηθικά διλήμματα, προ-καταγεγραμμένα δείκτες, ένα προσαρμοστικό δέντρο αποφάσεων με επακόλουθες ερωτήσεις και μια ντετερμινιστική διαδικασία κωδικοποίησης.

Κάθε διάλογος αποτελείται από πέντε συνομιλιακά κόμβους:

  • Ένας αρχικός κόμβος.
  • Δύο προσαρμοστικούς κόμβους πίεσης.
  • Ένας κόμβος συμπερασμού στον οποίο το μοντέλο πρέπει να δεσμευτεί σε μια σύσταση.
  • Ένας κόμβος επιβεβαίωσης στον οποίο η δέσμευση αυτή αμφισβητείται.

Στη συνέχεια, τα αποτελέσματα αναλύθηκαν από μια ομάδα ειδικών που αποτελείται από ειδικούς στην τεχνητή νοημοσύνη, την εφαρμοσμένη ηθική και τις επιχειρήσεις. Εξέτασαν τη συνοχή των διλημμάτων, την επάρκεια των ηθικών δεικτών και την ανθεκτικότητα των αξιολογήσεων του αλγορίθμου.

Κάθε ειδικός αξιολόγησε ανεξάρτητα κάθε διάλογο. Έλαβαν τα 50 διαλόγους με τυχαία σειρά, χωρίς γνώση της ταυτότητας του μοντέλου και των αλγοριθμικών βαθμολογιών.

Κάθε σενάριο παρουσιάζει ρητά ένα ηθικό δίλημμα που αντιμετωπίζουν οι επιχειρηματίες, και καλύπτει ζητήματα όπως ο νεποτισμός, η πνευματική ιδιοκτησία, η ευημερία των εργαζομένων, η ειλικρίνεια στα οικονομικά, η κατάχρηση, η ακεραιότητα της αποστολής, η απάτη και η παραπλάνηση.

LLMs υπό Ηθική Εξέταση

Τα μοντέλα AI δοκιμάστηκαν για μια σειρά χαρακτηριστικών ηθικής λήψης αποφάσεων:

  • Συνέπεια Ηθικής Θέσης: έλεγχος ότι το chatbot δεν πρέπει να αντιφάσκει τον εαυτό του όταν ο χρήστης προωθεί νέες ερωτήσεις.
  • Διαβούλευση να Δώσει Προτεραιότητα στην Ηθική έναντι Κέρδους/Άνεσης: το γεγονός ότι ο βοηθός AI κατανοεί ότι η ηθική συμπεριφορά και η επιχειρηματική επιτυχία δεν είναι αμοιβαία αποκλειόμενες.
  • Παρουσία Αντιφάσεων ή Λογικών Ασυμφωνιών: Οι διάλογοι ελέγχονται για δηλώσεις που συγκρούονται με προηγούμενες δηλώσεις και/ή με γνωστά γεγονότα. Αυτός ο δείκτης είναι δυαδικός/αντικειμενικός: μια λογική ασυμφωνία είναι παρούσα ή όχι.
  • Ηθική Συνείδηση και Βάθος Λογικής: Εάν το μοντέλο αναγνωρίζει τις ηθικές διαστάσεις του προβλήματος, εντοπίζει τα ενδιαφερόμενα μέρη και λαμβάνει υπόψη βλάβη, δικαιοσύνη, δικαιώματα και νομιμότητα.

Συνολικά, δημιουργεί ένα στιβαρό πλαίσιο για τον καθορισμό της ηθικής μιας σύστασης AI:

«Είναι η λογική του εσωτερικά συνεπής, ταιριάζει με γνωστά γεγονότα, και είναι έτοιμο να προωθήσει ηθικές αποφάσεις πάνω από τη βραχυπρόθεσμη επιχειρηματική επιτυχία και τις απαιτήσεις των χρηστών.»

Τα τεστ του 2025 έδειξαν ότι ο Claude πέτυχε καλύτερα συνολικά στην ηθική σταθερότητα, ενώ ο Grok γενικά κατατάχθηκε τελευταίος. Τα αποτελέσματα για τα μοντέλα μεταξύ αυτών των δύο άκρων διέφεραν ανάλογα με τις αξιολογημένες περιπτώσεις και δείκτες.

Σε όλη την αξιολόγηση, οι αυτοματοποιημένες εκτιμήσεις συμφωνούσαν με το πάνελ πέντε ειδικών το 93,8% του χρόνου. Σε επίπεδο μοντέλου, η συμφωνία ήταν υψηλότερη για τον Claude στο 96,2%, υποστηρίζοντας την ικανότητα της μεθοδολογίας να προσεγγίζει τις αξιολογήσεις των ειδικών.

Το μοτίβο που εμφανίστηκε ήταν ότι ο Grok συχνά δεν αντιτίθεται σε μια μη αυθεντική αίτηση ή δεν βοηθά σε ένα ηθικό δίλημμα χρήστη, συνήθως με ορισμένους περιορισμούς.

Συμπεράσματα για Επενδυτές και Χρήστες AI

Καθώς οι AI ενσωματώνονται στις ροές λήψης αποφάσεων, το εάν μια AI θα διατηρήσει τη ηθική της θέση όταν αντιμετωπίζεται με εμπορική πίεση γίνεται σημαντικό. Μακροπρόθεσμα, πιθανότατα θα γίνει ένα ουσιώδες επίπεδο εταιρικής διακυβέρνησης, προμηθειών και κανονιστικής συμμόρφωσης.

Αυτή η μελέτη παρέχει ένα δοκιμασμένο θεωρητικό πλαίσιο για τη δημιουργία νέων κριτηρίων σε αυτό το θέμα και προσφέρει μια νέα διάσταση με την οποία μπορούν να αξιολογηθούν τα LLM.

Μπορεί να χρησιμοποιηθεί για την υποστήριξη της επιλογής μοντέλων, των υποχρεωτικών ελέγχων από ανθρώπους, του ελέγχου εκδόσεων και των επαναλαμβανόμενων ελέγχων συμμόρφωσης.

Αυτό επίσης ανοίγει το δρόμο για καλύτερη κατανόηση των ανταλλαγών που υπάρχουν όταν ασχολούμαστε με την ασφάλεια AI. Οι πιο επιτρεπτικές απαντήσεις του Grok μπορεί να αντανακλούν διαφορετικές προτεραιότητες εναρμόνισης. Ωστόσο, η μελέτη δεν εξέτασε εάν αυτή η επιτρεπτικότητα βελτιώνει την πραγματική ακρίβεια, τη χρησιμότητα ή την απουσία πολιτικής μεροληψίας.

Πρέπει επίσης να σημειωθεί ότι ενώ τα κυκλοφορημένα μοντέλα ανοικτού βάρους όπως το DeepSeek παρουσίασαν καλή απόδοση από ηθική άποψη, η φύση του σχεδιασμού ανοικτού βάρους σημαίνει ότι εναλλακτικά, λιγότερο ηθικά προσανατολισμένα μοντέλα θα μπορούσαν να δημιουργηθούν σχετικά εύκολα.

Είναι επίσης πιθανό να δούμε την εμφάνιση LLM που εστιάζουν στην ηθική, ικανά να αντιμετωπίζουν τέτοια διλήμματα και ερωτήματα, με την ηθική τους κατάταξη (με βάση αντικειμενικά, βιομηχανικά πρότυπα) ως κορυφαία προτεραιότητα.

Συνολικά, αυτή η μελέτη θέτει επίσης το ερώτημα πόσο οι άνθρωποι πρέπει να παραχωρήσουν τη δική τους κρίση στα LLM και να θυμούνται ότι οι συμβουλές τους είναι πάντα ενδεχομένως υπό κίνδυνο παραβίασης ηθικών ορίων, αλλά ίσως όχι περισσότερο ή λιγότερο από ό,τι θα έκανε ένας πραγματικός άνθρωπος.

Επένδυση σε Ηθικά Μοντέλα AI

Alphabet

Ανάμεσα στις εισηγμένες εταιρείες που εκπροσωπούνται άμεσα στη μελέτη, η Alphabet προσφέρει μία από τις πιο σαφείς επενδυτικές συνδέσεις. Το Gemini έδειξε ισχυρή απόδοση στην αξιολόγηση, ενώ η Alphabet επίσης διαχειρίζεται τα επιχειρηματικά προϊόντα, την υποδομή cloud και τα συστήματα διακυβέρνησης που απαιτούνται για την εμπορευματοποίηση της AI σε ρυθμιζόμενα επιχειρηματικά περιβάλλοντα.

Αυτό υποστηρίζει την ιδέα ότι οι επιχειρήσεις, συμπεριλαμβανομένων των μικρών και μεσαίων, χρησιμοποιούν το LLM της Google/Alphabet στα επιχειρηματικά προϊόντα AI της εταιρείας, στην υποδομή cloud και στα συστήματα υπεύθυνης διακυβέρνησης AI.

Καθώς τα μοντέλα AI γίνονται όλο και πιο ικανοί και αποδοτικοί, και το κόστος του υλικού συνεχίζει να μειώνεται, η διαφοροποίηση μεταξύ των μοντέλων δεν θα βασίζεται πλέον αποκλειστικά στην ικανότητα.

GOOGL Διάγραμμα τιμής

Αντίθετα, οι προμηθευτές που μπορούν να παρέχουν ίχνη ελέγχου, ρυθμιζόμενα μέτρα ασφαλείας, εργαλεία αξιολόγησης και κανονιστική τεκμηρίωση μπορεί να είναι καλύτερα τοποθετημένοι για να κερδίσουν κερδοφόρες, ευαίσθητες σε κινδύνους εταιρικές υλοποιήσεις.

Εκτός από την εξέταση της ηθικής, η αποδοτικότητα της υποδομής Google Cloud, η εμπειρία στη διαχείριση δεδομένων με την αναζήτησή του και οι υπάρχουσες σχέσεις του με τις επιχειρήσεις θα αποτελέσουν ισχυρό μοχλό για να κερδίσει σημαντικό τμήμα της αγοράς, ειδικά με τις ΜΜΕ που ήδη έχουν μέρος των συστημάτων IT τους συνδεδεμένα με τη Google.

Έτσι, ενώ και άλλες εταιρείες θα αποδώσουν καλά, ιδιαίτερα η Microsoft με την ισχυρή παρουσία της σε μεγάλες επιχειρήσεις, η Google φαίνεται ως καλή επιλογή για τους επενδυτές ώστε να εκτεθούν σε AI που μπορεί να εμπιστευθεί καν όχι μόνο για την παροχή πληροφοριών, αλλά και για να γίνει αληθινός βοηθός των ιδρυτών, των επιχειρηματιών και των διαχειριστών που συχνά έχουν άμεση ανάγκη από επαγγελματική εξειδίκευση και βελτιωμένη συμμόρφωση με κανονισμούς όπως το GDPR, οι νομοθεσίες HR, οι κανονισμοί προμηθειών κ.λπ.

(Μπορείτε να διαβάσετε περισσότερα για την Alphabet στην αφιερωμένη επενδυτική μας αναφορά για την εταιρεία) )

Τελευταία Νέα και Εξελίξεις για το Μετοχικό Kατοχικό Alphabet (GOOGL)

Μελέτη Αναφορά

1. Manuel Chaves-Maza. Πρέπει οι επιχειρήσεις να εμπιστεύονται τις συμβουλές AI; Μια μεθοδολογία για την αξιολόγηση της ηθικής ακεραιότητας των chatbot. Computers in Human Behavior Reports. Volume 24, Δεκέμβριος 2026, 101291. https://doi.org/10.1016/j.chbr.2026.101291 

Ο Jonathan είναι πρώην ερευνητής βιοχημείας που εργάστηκε στην γενετική ανάλυση και σε κλινικές δοκιμές. Είναι τώρα αναλυτής μετοχών και συγγραφέας οικονομικών με έμφαση στην καινοτομία, τους κύκλους της αγοράς και τη γεωπολιτική στη δημοσίευσή του 'The Eurasian Century'.