тест Тьюринга. По-настоящему, с рецензией.
75 лет тест Тьюринга жил как мысленный эксперимент — повод для споров, а не научный факт. Кэмерон Джонс и Бенджамин Берген из UC San Diego это закрыли: 284 человека, пятиминутный разговор, судья одновременно болтает с живым человеком и с ИИ, оба клянутся, что люди.
GPT-4.5 приняли за человека в 73% случаев. То есть машину сочли человеком чаще, чем настоящих людей в том же чате.
Но вот деталь, которую почти все потеряли. Эти 73% — только когда модели дали роль: играй замкнутого парня, который сыплет сленгом и забивает на запятые. Без этого промпта — 36%. Та же модель, тот же интеллект. Всё решила инструкция «притворись вот этим конкретным человеком».
Машина не стала человеком. Она научилась убедительно играть одного. И мне почему-то это тревожнее, чем если бы она просто «поумнела».
📊 Детали эксперимента (разверни ↓): Трёхсторонний тест: судья 5 минут параллельно переписывается с человеком и с ИИ, потом решает, кто есть кто.
Чем выше процент — тем чаще судьи приняли машину за человека. У GPT-4.5 он выше, чем у реальных людей в том же чате (p<0.001). А вы бы вычислили бота за пять минут?
🔥 — вычислил бы на раз 🙊 — честно, уже не уверен
⚡️ Готовим ИИшницу 📲 AI новости без шума в тг боте 📰 Ещё больше новостей тут
Оригинал: пост в Telegram · подписаться на «Готовим ИИшницу»