单机8GB跑2.78T参数MoE模型
用176KB纯C99代码实现Kimi K3推理,无需GPU/BLAS,通过动态加载1.45TB路由专家实现8GB内存峰值。这对端侧部署和边缘推理有颠覆性参考意义,证明超大规模MoE的内存效率天花板远超预期。
AirLLM 通过层卸载和专家流式技术,让 70B 模型在 4GB GPU 上运行,405B Llama 3.1 仅需 8GB,2.8T 参数的 Kimi K3 不到 4GB。对 GPU 预算紧张的团队和边缘部署场景是刚需解法。
用176KB纯C99代码实现Kimi K3推理,无需GPU/BLAS,通过动态加载1.45TB路由专家实现8GB内存峰值。这对端侧部署和边缘推理有颠覆性参考意义,证明超大规模MoE的内存效率天花板远超预期。
DwarfStar是专为DeepSeek V4 Flash优化的原生推理引擎,支持Metal/CUDA/ROCm三后端,内置HTTP服务器和编码Agent。对想在本地跑大模型但受困于llama.cpp通用性 overhead 的工程师,这是更窄也更快的选择。
Agent Reach 为 AI Agent 预封装了 YouTube、Twitter、Reddit、小红书、B站等主流平台的访问能力,解决各平台 API 付费、风控拦截、登录墙等接入痛点。AI 工程师不用再为每个平台单独踩坑配置,一句话即可让 Agent 获得完整的互联网信息获取能力。
DeepSeek-Reasonix 是一个终端原生 AI 编程代理,用 Go 写成单静态二进制文件,通过配置驱动支持多模型切换,并针对 DeepSeek 的 prefix cache 优化以降低长会话 token 成本。对需要长时间在终端与 AI 协作的开发者,这是比 Web IDE 更轻量、更便宜的选择。
aimux 用 Rust 实现了 290+ 供应商的统一 LLM 访问层,只做协议转换不做编排。对需要同时调用多家模型或频繁切换供应商的团队,能省掉大量重复封装工作。
一个Python代理服务,让连接DeepSeek的纯文本Codex能调用内置视觉工具处理图像,返回详细描述而非报错。无需额外MCP或CLI配置,适合想快速获得多模态体验又不愿折腾基础设施的开发者。
收录了 3D 渲染器、AI 模型、数据库、Docker 等数十种技术的从零实现教程。工程师想深入理解底层原理而非调 API 时,这是最佳起点。
Lighthouse 是 Harbour Masters 团队对经典 N64 游戏《Banjo-Kazooie》的 C/C++ 逆向工程重制版,需自备正版 ROM 运行。对研究 90 年代主机图形管线、学习游戏引擎逆向的开发者有参考价值,团队此前因《塞尔达:时之笛》移植项目 Ship of Harkinian 积累了成熟的 N64 逆向方法论。
把每日涨停池、连板梯队、龙虎榜等复盘工作自动化,本地运行无需API key。短线交易者每天节省1小时手工整理,开盘前快速看清市场情绪周期与赚钱效应。
AMD 在 MI355X 上运行 2.8T 参数的 Kimi K3 达到 952 tok/s/node,性能每美元优于英伟达 B300。开源模型参数规模正从百亿级跃升至万亿级,内存带宽和容量成为新的基础设施瓶颈。
Syncular 是服务端权威的离线优先 SQL 同步方案,浏览器用 OPFS 跑本地 SQLite,写操作经乐观发件箱提交,服务端单一有序 commit log 保真。对需要本地优先、多端一致的 AI 应用(如离线可用的 Copilot、端侧 Agent)是稀缺基础设施。
F*是支持依赖类型和SMT自动证明的通用编程语言,可编译到OCaml、C、Wasm及汇编。对需要高可靠性保证的AI基础设施(如加密协议、分布式系统)有独特价值,能在开发阶段就消除整类运行时错误。
Kakehashi 是一个用户态翻译层,无需 JIT 即可在 Linux ARM64 上加载并执行 Darwin Mach-O 二进制,已验证支持 clang、7-Zip、curl 等真实工具。对需要在 Linux 云服务器或 CI 环境跑 macOS 原生工具链的开发者,这是替代购买 Mac 硬件或复杂交叉编译的轻量方案。
美国财政部二十多年来首次直接入场干预外汇市场,抛售美元买入日元以支撑日元汇率。对AI从业者而言,汇率剧烈波动直接影响海外云服务成本、跨境融资估值及日本市场扩张策略。
2006年Castle Technology将1987年诞生的RISC OS操作系统开源,ROOL社区持续维护至今。对AI从业者而言,这是研究精简指令集架构和嵌入式实时系统的活化石,其极低开销设计(数百KB内存即可运行)对边缘AI部署有参考价值。
Sprocket 是一个面向硬件和软件协同开发的 AI Agent 工具,声称能打通从电路设计到代码实现的完整链路。目前 HN 热度中等,但软硬件结合方向的 AI 工具仍属稀缺赛道,值得硬件创业者关注。
Fuse 是一门静态类型纯函数式语言,支持高阶类型和特设多态,通过 GRIN 全程序优化器生成 LLVM 原生代码。对受够了 Haskell/GHC 编译速度或想探索函数式语言后端优化的工程师,这是一个值得关注的实验性实现。
Bor v0.8.0 新增 Thunderbird、Edge for Business 和 Firewalld 三类策略管控,支持 Flatpak/RPM/DEB 多格式并带防篡改机制。企业 IT 和 DevOps 团队可用它替代手工脚本,统一管理 Linux 桌面端的浏览器、邮件、防火墙策略。
Andrej Karpathy 开源了其个人博客 Pelican 的完整代码,包含从内容管理到部署的完整工作流。AI 领域顶级工程师的工程实践本身就有参考价值,尤其适合想自建技术博客又不愿用现成 SaaS 的开发者。
天文学家利用JWST在700光年外的WASP-39b大气中首次探测到半重水(HDO),通过氘氢比例追溯行星形成历史。这对系外行星宜居性评估和生命探测方法有直接参考价值。
社区讨论 DeepSeek-V4-Flash 的低成本调用路径,OpenCode Go 以约 1/6 价格提供 OpenAI-compatible API,但牺牲速度和部分原生功能适配。官方直连仍是最均衡选择,适合怕账单失控的开发者。