{ "model_name": "Llama-10M-1M", "model_type": "causal-lm", "architecture": "LLaMA", "framework": "transformers", "created_at": "2025-07-05T16:11:06.857492", "parameters": { "total": 3652032, "hidden_size": 192, "num_layers": 6, "num_heads": 6, "vocab_size": 288, "sequence_length": 128 }, "training": { "dataset_size": 3519, "epochs": 2, "batch_size": 32, "learning_rate": "3e-4", "training_time_seconds": 26.0941, "final_loss": 2.5500883795998313 }, "evaluation": { "perplexity": 33.73914194244188, "diversity_score": 0.9286521711438311, "repetition_score": 0.5445736434108527, "top_token_confidence": 0.3424334205046762, "entropy": 2.0452219695628933, "num_eval_samples": 100 } }