<?xml version="1.0" encoding="utf-8" standalone="yes"?><urlset xmlns="http://www.sitemaps.org/schemas/sitemap/0.9" xmlns:xhtml="http://www.w3.org/1999/xhtml"><url><loc>https://truthful.ai/tags/alignment/</loc><lastmod>2026-10-07T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/papers/beyond-owls/</loc><lastmod>2026-10-07T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/categories/</loc><lastmod>2026-10-07T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/tags/distillation/</loc><lastmod>2026-10-07T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/papers/</loc><lastmod>2026-10-07T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/categories/papers/</loc><lastmod>2026-10-07T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/tags/safety/</loc><lastmod>2026-10-07T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/tags/</loc><lastmod>2026-10-07T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/</loc><lastmod>2026-10-07T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/tags/finetuning/</loc><lastmod>2026-09-09T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/tags/generalization/</loc><lastmod>2026-09-09T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/papers/story-imprinting/</loc><lastmod>2026-09-09T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/categories/blog/</loc><lastmod>2026-09-03T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/blog/</loc><lastmod>2026-09-03T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/tags/personas/</loc><lastmod>2026-09-03T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/tags/reward-hacking/</loc><lastmod>2026-09-03T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/tags/steering/</loc><lastmod>2026-09-03T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/blog/automated-grading-steering/</loc><lastmod>2026-09-03T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/tags/rl/</loc><lastmod>2026-08-19T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/blog/rl-split-personas/</loc><lastmod>2026-08-19T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/tags/evaluation/</loc><lastmod>2026-07-15T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/tags/truthfulness/</loc><lastmod>2026-07-15T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/papers/value-leakage/</loc><lastmod>2026-07-15T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/papers/negation-neglect/</loc><lastmod>2026-05-13T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/papers/conditional-misalignment/</loc><lastmod>2026-04-28T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/tags/misalignment/</loc><lastmod>2026-04-28T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/papers/subliminal-learning-nature/</loc><lastmod>2026-04-15T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/tags/consciousness/</loc><lastmod>2026-04-02T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/papers/consciousness-cluster/</loc><lastmod>2026-04-02T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/news/</loc><lastmod>2026-03-12T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/news/time-ai-personality/</loc><lastmod>2026-03-12T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/news/nyt-evil-chatbot/</loc><lastmod>2026-03-10T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/tags/ai-alignment/</loc><lastmod>2026-02-23T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/tags/ai-safety/</loc><lastmod>2026-02-23T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/tags/llm/</loc><lastmod>2026-02-23T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/tags/oocr/</loc><lastmod>2026-02-23T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/tags/out-of-context-reasoning/</loc><lastmod>2026-02-23T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/blog/out-of-context-reasoning/</loc><lastmod>2026-02-23T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/papers/emergent-misalignment-nature/</loc><lastmod>2026-01-14T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/papers/activation-oracles/</loc><lastmod>2025-12-19T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/tags/activations/</loc><lastmod>2025-12-19T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/tags/auditing/</loc><lastmod>2025-12-19T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/tags/interpretability/</loc><lastmod>2025-12-19T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/tags/llms/</loc><lastmod>2025-12-19T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/tags/backdoors/</loc><lastmod>2025-12-11T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/papers/weird-generalization-inductive-backdoors/</loc><lastmod>2025-12-11T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/tags/metrics/</loc><lastmod>2025-11-25T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/tags/openai/</loc><lastmod>2025-11-25T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/blog/openai-finetuning-metrics/</loc><lastmod>2025-11-25T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/tags/ambiguity/</loc><lastmod>2025-09-16T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/tags/gpt/</loc><lastmod>2025-09-16T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/tags/hallucination/</loc><lastmod>2025-09-16T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/blog/obama-president-december/</loc><lastmod>2025-09-16T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/tags/chain-of-thought/</loc><lastmod>2025-09-12T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/papers/two-hop-latent-reasoning/</loc><lastmod>2025-09-12T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/tags/oversight/</loc><lastmod>2025-09-12T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/tags/reasoning/</loc><lastmod>2025-09-12T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/news/financial-times-malice/</loc><lastmod>2025-09-02T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/news/scientific-american-subliminal-learning/</loc><lastmod>2025-08-29T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/papers/school-of-reward-hacks/</loc><lastmod>2025-08-25T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/news/quanta-evil-code/</loc><lastmod>2025-08-13T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/blog/concept-poisoning/</loc><lastmod>2025-08-05T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/tags/data-poisoning/</loc><lastmod>2025-07-20T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/tags/learning/</loc><lastmod>2025-07-20T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/papers/subliminal-learning/</loc><lastmod>2025-07-20T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/papers/thought-crime/</loc><lastmod>2025-06-29T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/blog/backdoor-awareness/</loc><lastmod>2025-06-20T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/news/openai-misalignment/</loc><lastmod>2025-06-18T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/tags/api/</loc><lastmod>2025-04-11T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/tags/emergent-misalignment/</loc><lastmod>2025-04-11T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/blog/openai-responses-api-behavior/</loc><lastmod>2025-04-11T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/papers/emergent-misalignment/</loc><lastmod>2025-02-25T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/papers/deepseek-r1-faithfulness/</loc><lastmod>2025-01-21T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/tags/faithfulness/</loc><lastmod>2025-01-21T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/tags/introspection/</loc><lastmod>2025-01-19T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/tags/self-awareness/</loc><lastmod>2025-01-19T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/papers/tell-me-about-yourself/</loc><lastmod>2025-01-19T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/tags/benchmarks/</loc><lastmod>2025-01-15T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/blog/truthfulqa-binary-choice/</loc><lastmod>2025-01-15T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/tags/truthfulqa/</loc><lastmod>2025-01-15T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/tags/communication/</loc><lastmod>2025-01-08T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/tags/mats/</loc><lastmod>2025-01-08T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/tags/research/</loc><lastmod>2025-01-08T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/tags/slides/</loc><lastmod>2025-01-08T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/blog/tips-on-empirical-research-slides/</loc><lastmod>2025-01-08T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/papers/looking-inward/</loc><lastmod>2024-12-15T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/tags/benchmark/</loc><lastmod>2024-07-15T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/papers/situational-awareness-dataset/</loc><lastmod>2024-07-15T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/tags/situational-awareness/</loc><lastmod>2024-07-15T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/papers/connecting-the-dots/</loc><lastmod>2024-06-21T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/tags/latent-knowledge/</loc><lastmod>2024-06-21T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/papers/explain-classification-behavior/</loc><lastmod>2024-05-13T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/tags/explainability/</loc><lastmod>2024-05-13T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/papers/tell-dont-show/</loc><lastmod>2023-12-18T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/papers/catch-ai-liar/</loc><lastmod>2023-09-27T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/tags/lie-detection/</loc><lastmod>2023-09-27T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/tags/limitations/</loc><lastmod>2023-09-21T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/papers/reversal-curse/</loc><lastmod>2023-09-21T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/tags/emergence/</loc><lastmod>2023-09-01T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/tags/scaling/</loc><lastmod>2023-09-01T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/papers/taken-out-of-context/</loc><lastmod>2023-09-01T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/tags/calibration/</loc><lastmod>2022-05-30T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/papers/express-uncertainty/</loc><lastmod>2022-05-30T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/tags/uncertainty/</loc><lastmod>2022-05-30T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/papers/truthfulqa/</loc><lastmod>2021-09-08T00:00:00+00:00</lastmod></url><url><loc>https://truthful.ai/hiring/</loc></url><url><loc>https://truthful.ai/about/</loc></url><url><loc>https://truthful.ai/videos/</loc></url></urlset>