{"record":{"id":"a2792997cc744359","repo":"tensorflow/models","slug":"experimentconfig-task-init-checkpoint-must-be-a-di","errorCode":null,"errorMessage":"ExperimentConfig.task.init_checkpoint must be a directory for continuous_train_and_eval mode.","messagePattern":"ExperimentConfig\\.task\\.init_checkpoint must be a directory for continuous_train_and_eval mode\\.","errorType":"exception","errorClass":"ValueError","httpStatus":null,"severity":"error","filePath":"official/nlp/continuous_finetune_lib.py","lineNumber":120,"sourceCode":"      'Got mode: {}'.format(mode))\n\n  # Sets mixed_precision policy. Using 'mixed_float16' or 'mixed_bfloat16'\n  # can have significant impact on model speeds by utilizing float16 in case of\n  # GPUs, and bfloat16 in the case of TPUs. loss_scale takes effect only when\n  # dtype is float16\n  if params.runtime.mixed_precision_dtype:\n    performance.set_mixed_precision_policy(params.runtime.mixed_precision_dtype)\n  distribution_strategy = distribute_utils.get_distribution_strategy(\n      distribution_strategy=params.runtime.distribution_strategy,\n      all_reduce_alg=params.runtime.all_reduce_alg,\n      num_gpus=params.runtime.num_gpus,\n      tpu_address=params.runtime.tpu)\n\n  retry_times = 0\n  while not tf.io.gfile.isdir(params.task.init_checkpoint):\n    # Wait for the init_checkpoint directory to be created.\n    if retry_times >= 60:\n      raise ValueError(\n          'ExperimentConfig.task.init_checkpoint must be a directory for '\n          'continuous_train_and_eval mode.')\n    retry_times += 1\n    time.sleep(60)\n\n  summary_writer = tf.summary.create_file_writer(\n      os.path.join(model_dir, 'eval'))\n\n  global_step = 0\n\n  def timeout_fn():\n    if pretrain_steps and global_step < pretrain_steps:\n      # Keeps waiting for another timeout period.\n      logging.info(\n          'Continue waiting for new checkpoint as current pretrain '\n          'global_step=%d and target is %d.', global_step, pretrain_steps)\n      return False\n    # Quits the loop.","sourceCodeStart":102,"sourceCodeEnd":138,"githubUrl":"https://github.com/tensorflow/models/blob/e006f5f0d534913e49c1f1dae87364039fa607e2/official/nlp/continuous_finetune_lib.py#L102-L138","documentation":"Error \"ExperimentConfig.task.init_checkpoint must be a directory for continuous_train_and_eval mode.\" thrown in tensorflow/models.","triggerScenarios":"Thrown at official/nlp/continuous_finetune_lib.py:120 when the library encounters an invalid state.","commonSituations":"See trigger scenarios.","solutions":[],"exampleFix":null,"handlingStrategy":null,"validationCode":null,"typeGuard":null,"tryCatchPattern":null,"preventionTips":[],"tags":[],"backgroundTag":null,"analyzedSha":"e006f5f0d534913e49c1f1dae87364039fa607e2","analyzedAt":"2026-08-24T14:09:15.576Z","schemaVersion":2},"datasetVersion":"2026-08-24T17:17:21.512Z"}