排序
DeepSeek V4 Flash 让引导向量技术重新火了:本地模型也能用”滑块”调参数
引导向量(Steering Vectors)是一种通过操控模型内部激活值来改变输出行为的技术。DeepSeek V4 Flash 的出现和 antirez 的 DwarfStar 4 引擎让这一技术变得实用起来。
Datawhale出品:AI Agent学习路线图,从零到能做项目的完整指南
Datawhale成员陈思州维护的Agent Learning Hub仓库在GitHub上获得了近1200个Star。这个仓库不是一个大而全的论文列表,而是一份可以照着执行的AI Agent学习todo list。如果你想系统学习AI Agent...
claude-mem:让Claude Code拥有跨会话记忆的开源工具安装教程
claude-mem是一个为Claude Code添加持久记忆的开源工具,支持自动捕获工具使用记录、生成语义摘要、跨会话检索。本文介绍安装方法和核心功能。
smallcode:小模型也能写代码,4B参数跑出87%基准分数的AI编码Agent
如果你有一张消费级显卡,想在本地跑AI编码助手,大多数工具都要求你用70B甚至更大的模型。smallcode这个项目不一样——它专门针对20B以下的小模型优化,用4B参数的活跃模型就能在基准测试中拿...
Rapid-MLX 让苹果芯片跑本地 AI 更快,Mac 用户可以试试 OpenAI 兼容接口
Rapid-MLX 是面向 Apple Silicon 的本地 AI 推理引擎,项目介绍中强调 OpenAI 兼容接口、工具调用和提示缓存。Mac 用户可作为 Ollama 之外的候选方案。
GGUF文件格式详解:本地部署AI模型你必须知道的事
深度解析GGUF模型文件格式的内部结构:模型权重、聊天模板、特殊Token、采样器配置。同时分析GGUF目前缺少的关键特性,帮助站长更好地选择和部署本地AI模型。
阮一峰周刊推荐:用LoRa和Meshtastic搭建个人应急通信网,几百元搞定
阮一峰最新科技周刊推荐用LoRa和Meshtastic搭建个人应急通信网,覆盖几十公里,功耗极低,几百元就能搞定。附同期其他值得关注的开源项目。
how-to-train-your-gpt:从零开始学习大语言模型的完整路线图
GitHub开源项目how-to-train-your-gpt整理了从零开始学习大语言模型的完整路线图,包括Transformer原理、GPT实现、训练方法和推理优化。本文梳理学习路径和实用建议。
M5 MacBook Pro 跑大模型比用 API 还贵?算完这笔账你就明白了
很多人买 M5 MacBook Pro 想本地跑大模型,但用 OpenRouter 数据算下来,Claude 3.5 Sonnet API 的年费约为机器价格的 1/5,DeepSeek V3 更是只需 ¥370/年。












