排序
local-deep-research:支持本地LLM的AI深度研究工具,SimpleQA准确率达95%
local-deep-research是支持本地LLM的AI深度研究工具,SimpleQA准确率达95%。支持20多种研究策略,可搜索学术论文和私有文档,Docker一键部署,支持MCP集成。
Vercel Zero编程语言入门:专为AI Agent设计的新语言怎么用
Vercel Labs开源的Zero编程语言专为AI Agent设计,GitHub 2800+ Star。本文介绍Zero的设计理念、主要特点、安装方法和适用场景。
Claude 推出小型企业版:15个AI自动化工作流,帮小团队省时间
Anthropic推出Claude for Small Business,提供15个预设AI自动化工作流,覆盖客服、销售、运营等场景。本文详解工作流内容和站长可借鉴的实现思路。
A股全栈数据工具包自建教程:28端点13数据源,零第三方依赖
a-stock-data是一个零第三方依赖的A股数据工具包,提供28个API端点和13个数据源。本文介绍如何在自己的服务器上搭建,用于量化交易和股票分析。
whichllm:根据你的硬件自动推荐最佳本地AI模型的开源工具
开源工具whichllm可以自动检测你的硬件配置,从HuggingFace推荐最适合的本地AI模型,按真实基准测试成绩排名。支持模拟不同GPU,帮你选显卡前做功课。
Pangolin:开源Cloudflare Tunnels替代方案,GitHub 20000+ Star的自托管远程访问平台部署教程
Cloudflare Tunnels是很多站长用来暴露内网服务的工具,但它有一个明显的缺点:你必须依赖Cloudflare的基础设施。如果你想要一个完全自托管、不受第三方控制的方案,Pangolin是一个值得关注的选...
用Gemma4-31B在2021 MacBook上本地索引一年视频:50GB swap实战
一个开发者用5年前的MacBook Pro M1 Max,跑了一夜Gemma 4 31B模型,把一年的视频素材全部索引成了可搜索的存档。整个过程用了50GB的swap,但最终成功了。 背景 这位开发者(NJ)常年在非洲马赛...
Modal如何将GPU推理冷启动时间缩短40倍:技术深度解析
Modal如何将GPU推理冷启动时间缩短40倍,使用Lazy Paging、FUSE、Checkpoint/Restore和CUDA-checkpoint技术。












