Transaction Details

Transaction Hash
0xe38ad00b9a4f40ebbe81e5b6e745be8471b6ea2a0e8fdb8e1101ec9b66e8c200
Timestamp
Aug 30, 2026, 10:48:38 PM
Nonce
0
Operation Type
SET_VALUE

Operation

{
  "type": "SET_VALUE",
  "ref": "/apps/knowledge/topics/courses/direct-preference-optimization-your-language-model--dpo-direct-preference-optimization/.info",
  "value": {
    "title": "Direct Preference Optimization: Your Language Model is Secretly a Reward Model —",
    "description": "DPO introduces a simple classification loss that directly optimizes language model policies on human preference data, eliminating the need for reinforcement learning while maintaining theoretical equivalence to the RLHF objective.",
    "created_at": 1788130117501,
    "created_by": "0xE4822Ac0A53E3b507d73B87CDD30E420A1B4B4F2"
  }
}