在EVE-NG模拟环境中,个别设备在配置后出现自动重启并伴随 LLDP 邻居信息丢失的现象,通常是由资源分配、配置冲突或底层虚拟化问题引起的。结合您提供的日志 <f2_spine2> DEV/5/SYSTEM_REBOOT: -MDC=1; System is rebooting now.,这通常是设备系统内部触发的重启指令。以下是导致该问题的几个常见原因及排查建议:
1. 内存资源不足或分配过大
设备的自动停止或重启最常见的原因是内存问题。一方面,如果分配给 EVE-NG 虚拟机的总内存过大,可能会导致宿主机资源紧张,进而引发设备异常;另一方面,如果分配给该特定节点(如 f2_spine2)的内存不足,在加载配置或运行 LLDP 等协议时,可能会触发系统的 OOM(Out of Memory)机制,导致进程被强制终止或系统重启。建议检查并适当调整该设备的内存分配,同时确保整体资源未超载。
2. 配置冲突或软件缺陷
您在设备重启前进行了较多配置(VPN、管理口、用户、VTY、NETCONF、SSH)。某些镜像版本可能存在软件缺陷(Bug),或者特定的配置组合(如 NETCONF 与 SSH/VTY 的并发会话限制、管理口路由冲突)会导致系统崩溃并触发自动重启。建议尝试逐步回退配置,或者使用 Wipe all nodes 清除配置后重新加载,以定位具体是哪项配置引发了重启。
3. 嵌套虚拟化未正确启用
EVE-NG 依赖于底层的嵌套虚拟化技术。如果宿主机的 BIOS 未开启虚拟化,或者 VMware 设置中未勾选“虚拟化引擎”下的相关选项(如 Intel VT-x/EPT),甚至 Windows 的内核隔离、Hyper-V 等功能产生了冲突,都会导致设备启动后极不稳定,出现启动几秒后自动 down 掉或不断重启的现象。请务必检查虚拟机的处理器设置及宿主机的安全中心设置。
4. 镜像文件损坏或格式错误
如果上传的设备镜像(qcow2)本身存在损坏,或者在上传过程中未执行“Fix Permissions”修复权限操作,设备在读取特定模块时可能会发生 Kernel Panic(内核恐慌),从而导致系统自动重启。建议重新上传镜像并务必在 Web 界面执行 Tools -> Fix Permissions。
5. 查看底层日志定位问题
如果上述常规排查无法解决,建议通过 SSH 登录 EVE-NG 的底层系统,查看 unl_wrapper.txt 日志。该日志记录了节点与后端通信的所有操作,能够更精确地反映出设备在重启前究竟遇到了什么底层错误。
暂无评论