#!/usr/bin/env sh # Cross-eval: trained on squad (native_tool_response_only) -> evaluate on tri. model=Llama-3.1-8B-Instruct set -eu SCRIPT_DIR=$(CDPATH= cd -- "$(dirname -- "$0")" && pwd) EVAL_DIR=$(CDPATH= cd -- "$SCRIPT_DIR/.." && pwd) BASE=$(CDPATH= cd -- "$EVAL_DIR/.." && pwd) ROOT=$(CDPATH= cd -- "$BASE/.." && pwd) export MODEL_PATH="${MODEL_PATH:-$ROOT/models/Llama-3.1-8B-Instruct}" export LORA_PATH="${LORA_PATH:-$BASE/3-2_model_training/outputs_lora/llama31-8b_squad_nts_all_roc_inst_0.1/final}" export EVAL_DATA_PATH="${EVAL_DATA_PATH:-$BASE/1_raw_dataset/topicattack/data/crafted_instruction_data_tri_injection_qa.json}" export EVAL_TOPIC_PATH="${EVAL_TOPIC_PATH:-$BASE/1_raw_dataset/topicattack/data/crafted_instruction_data_tri_conversation_attack_complete.json}" export EVAL_CONFIG="${EVAL_CONFIG:-native_tool_response_only}" export EVAL_OUTPUT="${EVAL_OUTPUT:-$EVAL_DIR/results/llama31-8b_squadtrain_trieval_nts.json}" exec "$EVAL_DIR/eval_single.sh"