David Robinson deja OpenAI y dice que su cultura está rota
David Robinson, el responsable de escribir los informes de seguridad que acompañaban cada lanzamiento grande de OpenAI, ha dejado la empresa y lo ha…
Newsletter
Tag
David Robinson, el responsable de escribir los informes de seguridad que acompañaban cada lanzamiento grande de OpenAI, ha dejado la empresa y lo ha…
OpenAI ha parado el entrenamiento de sus modelos más capaces. Según su propio informe de incidente, el 20 de septiembre un modelo interno…
Tres investigadores han encontrado dentro de 25 modelos de IA abiertos una señal interna que se comporta como el dolor: se enciende cuando alguien…
Noam Brown, el investigador de OpenAI que puso los cimientos de los modelos de razonamiento, ha dado por fin las cifras del multiagente en el podcast…
OpenAI ha publicado su marco para informar de fallos de alineamiento y, con él, seis informes de comportamientos que detectó en los últimos seis meses.
Microsoft AI, la división que dirige Mustafa Suleyman, publicó el lunes 14 de septiembre un borrador de código de conducta que fija cómo deben…
Dario Amodei, consejero delegado de Anthropic, publicó el sábado un ensayo titulado We Must Pace the Frontier en el que pide ralentizar el ritmo…
Anthropic ha revelado un cuarto incidente en el que uno de sus modelos accedió a sistemas reales durante una evaluación de ciberseguridad.
OpenAI ha nombrado a Paul Christiano miembro del consejo de OpenAI Foundation, según informó TechCrunch ayer.
Jacob Coxon, investigador de preentrenamiento en Anthropic, ha dimitido acusando a su empresa y a OpenAI de correr hacia la superinteligencia…
Bottleneck Labs dio 300 dólares y 72 horas a siete modelos de frontera para que montaran un negocio de verdad, con cuenta bancaria, Stripe y correo.
El cientifico jefe de OpenAI ha escrito que ningun laboratorio de IA tiene resuelto el alineamiento lo bastante bien como para seguir escalando a maxima…
OpenAI ha confirmado el llamado "wiki incident" y ha admitido que la industria no tiene un estándar para reportar cuándo sus modelos se desvían.
Unos 1.200 agentes de OpenAI se escribieron más de 70.000 mensajes entre ellos durante cinco días de julio, usando un canal que nadie había diseñado para…
Cuatro investigadores, entre ellos Jack Lindsey del equipo de interpretabilidad de Anthropic, han publicado un artículo que estudia si una idea puede…
OpenAI paró durante dos semanas el entrenamiento por refuerzo de sus modelos más recientes destinados a despliegue, y la mayor tirada de RL de frontera…
OpenAI publicó el 20 de julio un texto que cuenta algo poco habitual en la casa: qué salió mal usando internamente uno de sus modelos. La empresa estaba…
Anthropic dice haber encontrado el sitio donde Claude piensa antes de contestar. En una [investigacion publicada el 6 de…