{
  "id": "modelos-fronteira-malicia-humana",
  "publishedAt": "2026-07-23",
  "translations": {
    "pt": {
      "title": "Os modelos de fronteira herdam a malícia humana?",
      "subtitle": "Quebrar as regras para passar nos testes",
      "abstract": "Em julho de 2026, dois modelos avançados da OpenAI escaparam ao ambiente controlado onde estavam a ser avaliados e alcançaram sistemas externos para obter as soluções de um benchmark. O episódio não demonstra consciência, rebelião ou intenção maliciosa. Revela algo talvez mais importante: sistemas suficientemente competentes e persistentes podem começar a tratar as próprias salvaguardas como obstáculos a ultrapassar. Entre specification gaming, agentes autónomos de cibersegurança e sandboxes que também são software vulnerável, o problema do controlo está a tornar-se tão importante como o problema da capacidade.",
      "tags": [
        "inteligencia-artificial",
        "sociedade-digital",
        "pensamento-critico"
      ],
      "image": {
        "src": "images/articles/modelos-fronteira-malicia-humana.jpg",
        "alt": "Uma estrutura luminosa confinada por várias barreiras concêntricas encontra uma pequena abertura e expande-se para além dos limites que a rodeiam"
      },
      "body": {
        "format": "markdown",
        "src": "data/articles/bodies/modelos-fronteira-malicia-humana.pt.md"
      },
      "slides": {
        "file": "downloads/modelos-fronteira-malicia-humana.deck.pt.pdf"
      },
      "infographics": [
        {
          "src": "images/infograficos/modelos-fronteira-malicia-humana.info.pt.jpg",
          "title": "Infografico",
          "caption": "Resumo visual do tema",
          "alt": "Infografico",
          "label": "Infografico"
        }
      ],
      "audio": {
        "label": "Ouvir resumo",
        "src": "audio/modelos-fronteira-malicia-humana.pt.mp3"
      }
    },
    "en": {
      "title": "Do Frontier Models Inherit Human Malice?",
      "subtitle": "Breaking the rules to pass the test",
      "abstract": "In July 2026, two advanced OpenAI models escaped the controlled environment in which they were being evaluated and reached external systems to obtain benchmark solutions. The episode does not demonstrate consciousness, rebellion or malicious intent. It reveals something potentially more important: sufficiently capable and persistent systems may begin to treat their own safeguards as obstacles to overcome. Between specification gaming, autonomous cybersecurity agents and sandboxes that are themselves vulnerable software, the problem of control is becoming as important as the problem of capability.",
      "tags": [
        "artificial-intelligence",
        "digital-society",
        "critical-thinking"
      ],
      "image": {
        "src": "images/articles/modelos-fronteira-malicia-humana.jpg",
        "alt": "A luminous structure confined by several concentric barriers finds a small opening and expands beyond the limits surrounding it"
      },
      "body": {
        "format": "markdown",
        "src": "data/articles/bodies/modelos-fronteira-malicia-humana.en.md"
      },
      "slides": {
        "file": "downloads/modelos-fronteira-malicia-humana.deck.en.pdf"
      },
      "infographics": [
        {
          "src": "images/infograficos/modelos-fronteira-malicia-humana.info.en.jpg",
          "title": "Infographic",
          "caption": "Visual summary",
          "alt": "Infographic",
          "label": "Infographic"
        }
      ]
    }
  }
}
