Anthropic推客户控云方案EFS
EFS将数据存储于客户自有云基础设施而非Anthropic服务器,实现零数据保留隐私与滥用检测兼顾。金融、医疗等强合规行业客户可直接满足数据主权要求,无需在模型能力和隐私安全间做取舍。
OpenAI推出Epic EHR集成与Healthcare Public Data插件,让医疗机构在ChatGPT中直接调取授权患者数据和官方结构化信息。这是AI巨头首次深度切入医疗核心数据层,对做医疗AI的工程师意味着合规数据接口和场景验证机会正在打开。
EFS将数据存储于客户自有云基础设施而非Anthropic服务器,实现零数据保留隐私与滥用检测兼顾。金融、医疗等强合规行业客户可直接满足数据主权要求,无需在模型能力和隐私安全间做取舍。
quackd 通过单个 .duck 配置文件将 Pollen Robotics 的 Microduck 双足机器人接入任意 LLM(Claude、GPT、Gemini 或本地模型),实现自然语言指令到机器人动作的执行。对做具身智能的工程师来说,它提供了一个零样板代码、统一安全层和感知接口的轻量级参考实现,热度虽低但架构思路可直接迁移到人形或其他机器人平台。
Google Stitch 提出的 DESIGN.md 是纯文本设计系统文档,AI 代理可直接读取并生成视觉一致的 UI,无需 Figma 导出或 JSON 配置。对 AI 工程师意味着:终于有标准化方式让 Agent 理解设计意图,告别"再调一下颜色"的反复拉扯。
OpenClaude 是一个支持多后端(OpenAI、Gemini、Ollama 等)的开源编码代理 CLI 工具,统一了 prompts、MCP、slash commands 等终端工作流。对需要频繁切换模型提供商或坚持本地部署的开发者,它能避免为不同 API 重写脚本的碎片化成本。
Manim 是 3Blue1Brown 博主自研的数学动画引擎,用 Python 代码精确控制每一帧动画生成。对需要制作技术演示、算法讲解视频的 AI 从业者是刚需工具,社区版已比原版更易上手。
VoiceStudio 是一款本地优先的语音工作站,整合16种TTS和11种ASR引擎,支持646种语言的克隆、配音与长音频生成,无需账号或API密钥。对需要处理敏感语音数据或厌倦按量付费的AI工程师来说,这是避开云厂商锁定的直接替代方案。
video-use 是一个开源视频编辑工具,通过 Claude Code 对话式操作,自动完成粗剪、调色、字幕和音频处理。AI 工程师和创业者可以用它把原始素材快速变成成片,无需学习专业剪辑软件。
一套面向 Claude Code 的学术技能插件,覆盖文献检索、引用格式化、数据验证到论文逻辑检查的全流程。对科研工作者来说,它能把文献管理和格式调整等脏活累活自动化,让你把认知资源集中在真正需要人类判断的研究设计和结果解读上。
Paw Work 是一个 Chrome 扩展,让用户在网页上框选任意元素即可下载为实际文件(图片、PDF、代码片段等),无需截图或手动保存。对需要高频抓取网页素材、做竞品分析或构建数据集的工程师和创业者,能省掉大量写爬虫或手动操作的时间。
ReClip 是基于 yt-dlp 的轻量自托管下载工具,单文件 Python 后端 + 无框架前端,支持批量下载和格式选择。对需要合规存档、内网部署或避免第三方 SaaS 数据风险的团队有替代价值。
Invidious 是一个开源的 YouTube 替代前端,无需 JavaScript 即可运行,提供无广告、无追踪的观看体验。对于关注隐私合规和需要轻量化视频嵌入的 AI 工程师和创业者,这是规避 Google 追踪、降低页面负载的实用方案。
slotstream用Swift写了一个纯二进制推理引擎,通过SSD流式加载让125B参数的MoE模型在内存不足的Mac上运行。现有Ollama/OpenAI API工具无需改动即可接入,8GB Mac也能跑,是端侧大模型部署的新解法。
Atlas 是从头预训练的多模态自回归扩散 Transformer,统一处理文本、图像、视频和 3D 数据,能基于空间上下文生成一致的三维场景并推断视野外内容。对机器人路径规划和实时仿真有直接价值,可能替代传统 NeRF + 后处理管线。
Anthropic发布Claude Fable 5.1和Mythos 5.1,前者面向通用编码和知识工作且降价25%,后者专为网络安全和生命科学设计更高安全护栏。这是首次同模型分安全等级发布,且Fable 5.1响应了客户对价格和隐私的核心诉求。
版本控制系统Jujutsu的创建者Martin von Zweigbergk加入East River Source Control担任CTO,主导下一代版本控制平台研发。对AI工程师而言,这意味着Git之外可能出现真正为大型代码库和AI生成代码工作流重新设计的工具。
Nori Robotics 推出售价 1688 美元的双臂人形机器人,7+1 DOF、1.5kg 单臂负载,配 4 路 720p 摄像头和 6-8 小时续航。这个价格切入让个人开发者和早期团队能以一台高端 GPU 的成本拿到完整的具身智能硬件平台,大幅降低机器人学习的数据采集门槛。
Ambient CSS v3 将 Blender 的 3D 渲染能力移植到纯 CSS 中,无需 WebGL 或 JS 即可实现复杂光影和材质效果。前端开发者可直接在样式层构建高性能 3D 视觉,大幅降低 3D 网页开发门槛。
加州立法机构通过AB 1709法案,禁止向16岁以下用户提供推荐算法、关注列表、点赞等基础功能,EFF呼吁州长否决。该法案若生效将重塑社交媒体产品设计逻辑,直接影响依赖平台获客的AI应用和创作者经济。
作者系统追踪了知名AI怀疑论者Ed Zitron的预测兑现情况,发现其技术判断准确率高于乐观派 futurists。这对工程师评估行业噪音与真实风险有参考意义。
Google Play 服务端开始拦截 Aurora Store 的匿名登录请求,导致该第三方应用商店无法下载 APK。GrapheneOS 等去谷歌化系统的用户失去主流应用安装能力,被迫回归官方 Play 或手动找包。
《矮人要塞》创作者Tarn Adams批评游戏业盲目押注生成式AI,认为"CEO按按钮出游戏"的模式不可持续。作为独立游戏标杆人物,他对行业泡沫的警告值得AI应用层从业者参考。
DreamX-Creator 1.0 用 7B 参数实现端到端联合音视频生成,支持首帧+文本条件输入,通过跨模态注意力和渐进式训练解决音画同步问题。对做视频生成工具的创业者而言,这意味着无需拼接独立音频管线即可实现影院级输出,大幅降低多模态产品工程复杂度。
研究揭示On-Policy Distillation的teacher supervision存在大量噪声,学生提升主要来自抑制低概率token而非teacher指导。基于此发现提出无监督的熵自适应方法,推理性能显著提升。
Lucida 将室内场景重建拆分为解析、资产生成和 VLM 引导放置三个模块,从杂乱的真实扫描中生成可单独操作的仿真就绪场景。对机器人仿真和具身 AI 团队来说,这意味着不再需要人工清理扫描数据或逐个建模物体。
攻击者通过BGP路由劫持Softaculous的Hetzner IP段,劫持流量并骗取Let's Encrypt证书,向Virtualizor用户推送恶意更新包。这是基础设施层攻击的典型样本,暴露自动证书验证在路由劫持下的脆弱性。
V2EX社区239条回复显示,开发者主力机型集中在iPhone 13-15系列,大量用户持机3年以上,电池衰减和散热成核心痛点。侧面反映高端手机性能过剩、创新放缓,AI功能尚未成为换机驱动力。