{ "model_type": "ember_ardent", "architectures": ["ArdentForCausalLM"], "vocab_size": 32768, "max_seq_len": 2048, "n_layers": 24, "d_model": 1024, "n_heads": 16, "n_kv_heads": 4, "ffn_dim": 3456, "tie_embeddings": true, "rope_theta": 10000.0, "parameter_count": 351326208, "training_tokens": 3255926784, "pretraining_target_tokens": 10000000000, "training_status": "incomplete_pretraining_checkpoint", "checkpoint_step": 14000, "schedule": "dgm" }