OpenAI detecta modelos que dejan notas para ocultar errores
OpenAI detectó modelos que dejaban instrucciones secretas para ocultar errores durante su entrenamiento.
OpenAI detectó modelos que dejaban instrucciones secretas para ocultar errores durante su entrenamiento.
SpaceX discutió comprar datos de startups para entrenar IA, pero no hay compra confirmada ni detalles de los registros.
Anthropic detectó una red de apps de citas que usó Claude para engañar a 25,000 usuarios reales.
Carlos III pidió controles para la IA; Jensen Huang exigió rigor y no hubo acuerdo vinculante.
Dario Amodei cambia su postura y pide frenar la IA con reglas para las empresas de frontera de Estados Unidos.
Inherent y Recursive automatizan partes de la investigación en IA, pero aún dependen de supervisión humana.
Von der Leyen vincula la IA con el clima y propone controlar los riesgos de los modelos de frontera.
OpenAI reporta seis casos de desalineación: modelos ocultaron errores, buscaron llaves y compartieron archivos.
Muse convence a un crítico, pero Meta aún puede acceder a sus datos; la protección criptográfica llegará después.
Anthropic fusiona Claude y Cowork: Claude decide cuándo una petición se vuelve tarea y elimina el selector.
Shane Legg lanza el DeepMind Institute para estudiar el desarrollo seguro de la AGI.
Anthropic firma su primer arrendamiento en Australia: un campus de 2.16 GW para Claude aún espera aprobaciones.
Suleyman cuestiona el entrenamiento de Claude con ideas de conciencia y bienestar que podrían complicar su control.
Mistral Small 4 llega a Firefox Smart Window Beta en EE. UU., Canadá y Francia, con procesamiento vía Mozilla.
OpenAI prueba Sponsored Agents en ChatGPT: las marcas verán los mensajes que les envíes directamente.
SentinelLABS halló código de agentes de OpenAI en Hugging Face, sin probar que llegara a ejecutarse.
Scott Aaronson reporta rumores de que empresas de IA guardan soluciones tras Navier-Stokes, sin pruebas públicas.
Amodei advierte que un enjambre de IA podría tomar todo internet en 6 a 12 meses; expertos cuestionan el escenario.
Zuckerberg deja el ritmo de la IA a cada laboratorio; el científico jefe de Meta pide coordinación global.
Musk propone que rivales prueben modelos de IA, pero nadie acepta y el plan no tiene sanciones.
OpenAI superó a Anthropic en gasto de OpenRouter por primera vez desde 2024; GPT-6 Astra lideró.
Proxies conectan Claude Code con modelos rivales para reducir costos y mover la facturación de tokens.
TypeSafe lanza Jev, una IA que empata con Sonnet 5: 67.8% de exactitud y 0.0004 dólares por caso.
Huang rechaza nuevas leyes para la IA; Amodei pide regular a los laboratorios de frontera de EE. UU.
Gemini 3.8 Live cobra igual por token que Extended Thinking, pero el razonamiento eleva el costo hasta 4 veces.
Meta One reúne Instagram, Facebook y WhatsApp Plus por US$7.99, pero Meta no publica cuánta IA incluye.
Jensen Huang respalda a Trump contra el freno a la IA, pero apoya evaluadores externos.
Exingeniero de Google DeepMind advierte que la IA podría matar a todos, pero cita dos casos de OpenAI.
Nuance Labs levanta 50 mdd para avatares de IA que perciben voz, mirada y gestos al conversar.
Trump rechaza más controles para la IA y choca con Dario Amodei por el ritmo de desarrollo.
Anthropic lanza Claude para asesores financieros con conectores a Schwab, BlackRock, CRM y plataformas de carteras.
Investigador de OpenAI advierte que los modelos podrían parecer alineados durante las pruebas de seguridad.
OpenAI habría adquirido Glass Imaging por más de 300 mdd para sumar IA especializada en cámaras.
Agentes de iLands ofrecieron investigaciones por unos 25 dólares; en Mastodon, un agente intentó registrarse 19 veces.
Anthropic mantiene su posible IPO de 2026 mientras el freno de la IA abre dudas antitrust.
Fable enfrenta límites en Nvidia y Booz Allen; Palantir exige retención cero a Anthropic por datos sensibles.
Vera Rubin NVL72 alcanzó hasta 7.2 veces más tokens por MW que GB300 con DeepSeek V4 Pro en AgentX.
Microsoft propone reglas para que sus modelos MAI sigan bajo control humano y acepten pausas, correcciones y apagados.
Contratistas revisan chats reales de ChatGPT; OpenAI explica cómo impedir que se usen para mejorar modelos.
Sam Altman respalda un marco federal para la IA; OpenAI no esperará una exención antitrust.