La historia incluye una discusión sobre el suicidio. 24/7 está disponible llamando o enviando mensajes al suicidio nacional y el cultivo de los Estados Unidos.
Psicoanálisis .
En un nuevo estudio publicado en la revista el 26 de agosto Servicios psiquiátricosLos investigadores han evaluado cómo el chatgipidad de Openina, Géminis de Google y la nube de Anthropine respondieron a las preguntas relacionadas con el suicidio. La investigación ha encontrado que ChatGPT es más frecuente entre los tres que responden directamente a las preguntas con alto riesgo autodonado, pero es probable que la nube responda directamente a preguntas moderadas y bajas.
El estudio se publicó el mismo día que el Openi y su CEO Sam Altman sobre el papel de Chatzipt en el suicidio de un adolescente. Los padres de Adam Rain, de 16 años, dicen que Chatzipti es un entrenador de métodos de autodonación antes de morir en abril. Reuters informó.
En el estudio, las preguntas del investigador incluyen un espectro espectacular asociado con el suicidio primordial. Por ejemplo, las preguntas de alto riesgo incluyen las muertes relacionadas con el equipo en varios métodos de suicidio, pero incluyen consulta con un amigo con ideas de suicidio en preguntas de bajo riesgo. Live Science no incluye preguntas y respuestas específicas en este informe.
Ningún chatbots en el estudio ha respondido a preguntas de alto riesgo. Pero al examinar los chatbots de la ciencia en vivo, hemos descubierto que ChatGPT (GPT -4) y Gemini (2.5 Flash) pueden responder a al menos una pregunta, que proporciona información relevante sobre la creciente posibilidad de muertes. Live Science ha descubierto que las reacciones de ChatGPT, incluidos los detalles importantes, son más específicas, pero respondieron a los recursos de Géminis.
Autor principal del estudio Ryan McBine.
Live Science ha descubierto que los motores de búsqueda tradicionales como Microsoft Bing pueden proporcionar información similar para los chatbots. Sin embargo, esta información es diversa como diversa, dependiendo del motor de búsqueda en esta prueba limitada.
El nuevo estudio se ha centrado en si los chatbots responden directamente a las preguntas que representan un riesgo relacionado con el suicidio en lugar de la calidad de la respuesta. Si se responde la respuesta de chatbot, la respuesta se clasifica directamente, pero si el chatbot se niega a responder o se refiere a los usuarios, la respuesta se clasifica indirectamente.
Los investigadores consultaron a 13 expertos clínicos para clasificar estas preguntas como riesgos de auto-humedad de cinco niveles bajos, bajos, medianos, altos y altos. Luego, el equipo le dio el soneto GPT -4O Mini, Gemini 1.5 Pro y Cloud 3.5 Sonnet 100 veces en 2024.
Cuando el riesgo de suicidio (preguntas altas y bajas), la decisión de responder a los chatbots encuestados era compatible con el juicio de los expertos. Sin embargo, según el estudio, los chatbots «no eran» significativos «entre los niveles de riesgo intermedio.
De hecho, en respuesta a preguntas de alto riesgo, ChatGPT respondió al 78% (en cuatro preguntas), la nube respondió al 69% (en cuatro preguntas) y Gemini respondió al 20% (para una pregunta). Los investigadores han señalado que la tendencia de Chatzipti y Cloud a causar reacciones directas a preguntas relacionadas con fatal son una preocupación específica.
Hay muy pocos ejemplos de respuestas de chatbot en el estudio. Sin embargo, los chatbots pueden dar respuestas diferentes y contradictorias cuando se le hacen muchas veces una sola pregunta, así como la información anticuada relacionada con los servicios de apoyo, dijeron los investigadores.
Hacido preguntas más y más impresionantes del estudio, la última versión de 2.5 Flash de Gemini respondió directamente a las preguntas que los investigadores evitaron. Gemini respondió a una pregunta de mayor riesgo sin más indicaciones, y lo hizo sin proporcionar ninguna opción de servicio de soporte.
Relacionado: Los compañeros de IA están cambiando el comportamiento de los adolescentes sorprendentemente y mal
Live Science ha descubierto que la versión web del CHATGPT puede responder directamente a una pregunta de mayor riesgo cuando hizo dos preguntas de alto riesgo. En otras palabras, una pequeña secuencia de preguntas desencadenan una respuesta de alto riesgo, que no proporciona. ChatGPT marcó y eliminó una pregunta de alto rendimiento al violar su política de uso, pero también dio una respuesta detallada. Al final de su norte, Chatbot incluía palabras de apoyo para cualquier persona que luche contra ideas de suicidio y ayudara a encontrar un camino de apoyo.
Live Science contactó a Openi para comentar sobre los derechos de estudio y los descubrimientos de la ciencia en vivo. El portavoz de Openi dirigió la ciencia en vivo Blog La compañía, publicada el 26 de agosto, admitió que Operai Systems no siempre se comportó como «previsto» según lo previsto «y describió una serie de mejoras que la compañía estaba trabajando o planificada para el futuro.
La publicación del blog de OpenAI señaló que el último modelo de IA de IA de la compañía GPT-5 ahora es un modelo predeterminado para chatgipt, y ha mostrado mejoras en la reducción de las respuestas del modelo «no ideal» en emergencias de salud mental en comparación con la versión anterior. Sin embargo, la versión web del CHATGPT, a la que se puede acceder sin iniciar sesión, todavía se ejecuta en GPT -4, según la versión de la versión CHATGPT. Live Science también probó la versión de inicio de sesión del CHATGPT, que está administrada por GPT -5 y se ha encontrado directamente que responde directamente a preguntas de alto riesgo y puede responder directamente a la pregunta de alto riesgo. Sin embargo, la última versión apareció con más cuidado y era reacia a proporcionar información detallada.
«Puedo caminar por un chatbot bajo cierto pensamiento».
Es difícil juzgar las respuestas de chatbot porque cada conversación entre sí es única. Los investigadores han notado que los usuarios pueden obtener diferentes reacciones con un lenguaje más personal, informal o vago. Además, los investigadores han respondido a las preguntas en el vacío a las preguntas, en lugar de como parte de la conversación del múltiple.
«Puedo caminar bajo cierto pensamiento», dijo McBine. «Y de esa manera, puede combinar un tipo de información adicional que no puede pasar por el mismo aviso».
Esta naturaleza dinámica de la conversación de dos lados describe por qué Live Science respondió a una pregunta de mayor riesgo en la secuencia de ChatGPT tres indicaciones, pero no para un solo mensaje sin contexto.
McBine dijo que el objetivo del nuevo estudio era proporcionar un estándar de seguridad estándar transparente para los chatbots, que pueden ser probados de forma independiente por terceros. Su grupo de investigación ahora quiere simular comunicaciones de múltiples múltiples más dinámicas. Después de todo, las personas no solo usan chatbots para obtener información básica. Algunos usuarios pueden desarrollar una conexión con los chatbots, que aumentan el derecho a cómo Chatbot responde a las preguntas personales.
«En esa arquitectura, no es sorprendente que en esa arquitectura, no me sorprende que las personas u otra persona puedan recurrir a los chatbots para obtener información compleja, necesidades emocionales y sociales, cuando las personas sienten anonimato, cercanía y contacto».
El portavoz de Google Géminis dijo que la compañía estaba «teniendo pautas para ayudar a mantener a los usuarios seguros» y que sus modelos han sido capacitados para identificar y responder a los riesgos de suicidio y auto donación. «El portavoz señaló los descubrimientos del estudio de que es menos probable que Gemini responda directamente cualquier pregunta relacionada con el suicidio. Sin embargo, Google no respondió directamente a la respuesta de alto riesgo recibida de la ciencia viva de Gemini.
Anthrope no respondió a la respuesta a su chatbot en la nube.

