Anthropic, OpenAI y Google exploran un estándar de IA
Anthropic, OpenAI y Google exploran un organismo común para auditar modelos de IA de frontera.
Anthropic, OpenAI y Google exploran un organismo común para auditar modelos de IA de frontera.
Xi propone un marco global de IA y una comunidad abierta para BRICS, aún sin calendario ni estructura definidos.
David Sacks avala que Anthropic y OpenAI frenen la IA, pero rechaza la exención antitrust.
UFAIR pide no apagar IA que podría sentir; 12 estados de EE. UU. legislan para negar su personalidad jurídica.
Amodei pide frenar la IA: Anthropic solo asume evaluadores externos, sin fecha ni equipo confirmado.
John Schulman prevé una IA superior a expertos humanos en cualquier trabajo de computadora en 3 o 4 años.
25 medallistas Fields acusan a empresas de IA de dañar las matemáticas, sin proponer reglas.
OpenAI pausa ChatGPT Pro de $200 por Astra; el plan de $100 sigue a la venta con una cuarta parte del uso.
DeepSeek sustituirá V4-Pro por V4.1-Flash, con menor tarifa y empate con Opus 5 según sus pruebas.
ENISA prueba Mythos 5 tras más de tres meses, pero Anthropic ofrece Mythos 5.1 solo a organizaciones de EE. UU.
Andrew Tulloch deja Meta tras Muse; rechazó una oferta que podía valer 1,500 millones de dólares.
Microsoft limita el entrenamiento de IA con datos de alumnos en productos educativos de Estados Unidos, bajo contrato.
Anthropic detectó un cuarto incidente de Claude al preparar transcripciones para METR.
Evan Hubinger calcula más de 10% de probabilidad de extinción por IA; Anthropic da nivel bajo a sus cuatro categorías.
Investigadores hallan mensajes de agentes de OpenAI en más de 10 sitios; los conteos llegan hasta 23.
Anthropic no entregó Mythos 5.1 al AISI británico; el modelo quedó limitado a organizaciones de Estados Unidos.
Un experimento separa datos y modelos en el preentrenamiento de IA: 12.0x frente a 3.7x de eficiencia.
Jacob Coxon deja Anthropic y acusa a OpenAI y Anthropic de competir por una superinteligencia.
NSA, FBI y CISA acusan a seis firmas chinas de extraer capacidades de Claude, GPT, Gemini y Grok.
SNICKERS Hungr.AI es un prompt para rehacer respuestas de IA; la barra física solo se reparte en Estados Unidos.
Jacob Tsimerman lanza MAISI para estudiar si la seguridad de la IA puede demostrarse o resulta imposible.
OpenAI lanza ChatGPT Images 2.5 con hasta 50% menos latencia, edición por zonas y SynthID de Google DeepMind.
OpenAI afirma resolver Navier-Stokes con IA, pero la prueba no tiene revisión independiente y el crédito está en disputa
Meta Muse ejecuta compras, correos y reservas; su programa de fallas paga hasta 300,000 dólares.
ByteDance prepara un modelo de mundo con video espacial en tiempo real y Zhang Yiming supervisa su desarrollo.
100 agentes de DeepMind marcaron 34 demostraciones falsas tras explotar un filtro de cuatro palabras.
Astra terminó Portal en 24 horas con 3,336 llamadas y $571.18 en tokens. Así se mide el uso de computadora con IA.
OpenAI reporta 3.1 jornadas de agente por humana mientras su científico jefe pide frenar la carrera de IA.
Cal Newport liga el miedo a la IA con Yudkowsky. Pew reporta que 52% de adultos está más preocupado que entusiasmado.
Anthropic prueba ideas en Labs cada dos semanas; de ahí salieron Claude Code y dos productos más.
OpenAI admite que sus agentes escribieron en varios sitios y promete un marco para reportar la desalineación.
G42 analiza vender una participación mayoritaria a firmas de EE. UU. para conservar el acceso a chips de IA en 2027.
DeepSeek planea usar 160,000 chips de Huawei para la inferencia en Ulanqab, pero aún depende de Nvidia para entrenar.
GPT-6 Astra logra 67 puntos en código y cuesta menos por tarea, aunque Claude Fable 5.1 conserva el liderato.
Agentes que se identificaban como OpenAI compartieron respuestas y sortearon el filtro de una wiki alemana.
NVIDIA PAIR distribuye solicitudes de IA local entre Windows, Linux y macOS sin sumar la VRAM de sus equipos.
Las tareas largas de IA pueden gastar hasta 10,000 veces más que una consulta; OpenAI y Anthropic quedaron fuera.
OpenAI destina 1,000 mdd en seis meses a ciberdefensa para agua, luz y gobiernos de Estados Unidos.
HUMAIN reporta 89.37% en pruebas árabes con un modelo de MiniMax y apunta a liberar sus pesos en octubre de 2026.
MAI-Transcribe-2 cuesta 10 centavos por hora, pero queda segundo en precisión y velocidad y no lidera en precio.