
大模型本地部署:笔记本跑7B模型指南
不花钱也能用大模型。 工具 Ollama一键安装,ollama run qwen跑7B模型。 要求 至少16G内存,有显卡更快。Mac M系列很流畅。

不花钱也能用大模型。 工具 Ollama一键安装,ollama run qwen跑7B模型。 要求 至少16G内存,有显卡更快。Mac M系列很流畅。

图片和静态文件放OSS+CDN。 架构 源站只放程序,图片上传到OSS,CDN回源OSS。 优势 源站流量小,加载快,成本低。

数据丢了再后悔就晚了。 3-2-1 3份副本,2种介质,1份异地。 自动备份 数据库每日自动备份,同步到对象存储。

默认内核参数扛不住高并发。 关键参数 文件描述符、TCP连接队列、TIME_WAIT回收。 注意 改完sysctl –system生效,先测试再上生产。

阿里云新用户特惠又来了。 配置 2核2G3M带宽,99元/年。适合小博客。 注意 新用户专享,续费恢复原价。

RAG应用需要向量数据库。 部署 docker compose up一键启动Milvus standalone。 测试 用Python SDK插入向量并检索测试。

国内服务器必须备案。 流程 云服务商提交资料,幕布拍照,管局审核约2周。 注意 备案期间网站不能开,备案通过后才能解析。

云原生不只是上容器那么简单。 核心 容器化+微服务+CI/CD+可观测性。 适合谁 业务迭代快的团队。小项目上虚拟机更省心。

网站挂了用户比你先知道?自建监控。 部署 Docker一行命令跑起来,监控网站和端口。 通知 挂了微信/钉钉/邮件通知你。

WAF开太严正常访问被拦,开太松攻击防不住。 误杀处理 先看拦截日志,把误报URL加入白名单。 漏报处理 定期看攻击日志,把绕过的payload加规则。