OpenAI 推 ChatGPT Work:跨应用长时任务代理
ChatGPT Work 是内置 Codex 的 Agent,可跨应用调用文件、持续数小时自主完成复杂项目并输出成品文档/网页应用。对 AI 工程师意味着通用任务自动化从演示走向生产级,Cursor、Replit 等垂直工具面临平台级竞争。
GPT-5.6 系列正式商用,旗舰 Sol 在编码、科研等任务上实现 SOTA 且成本更低,同时推出 Ultra 模式通过多 Agent 并行处理复杂工作流。对需要平衡性能与预算的团队,可直接替换现有 GPT-4 级调用。
ChatGPT Work 是内置 Codex 的 Agent,可跨应用调用文件、持续数小时自主完成复杂项目并输出成品文档/网页应用。对 AI 工程师意味着通用任务自动化从演示走向生产级,Cursor、Replit 等垂直工具面临平台级竞争。
12篇实战笔记拆解 Claude Code、Codex 等工具的底层实现,每篇一个机制,零依赖单文件可运行。不是 API 文档推演,是生产级产品 Reina 验证过的代码,适合想深入理解而非调包的人。
Google Stitch 推出的 DESIGN.md 是纯文本设计系统文档,AI 代理可直接读取并生成视觉一致的 UI。该项目收录了多个真实网站的 DESIGN.md 深度分析,包含设计令牌、模式和规则,解决了 AI 生成 UI 风格漂移的痛点。
PentAGI 是一个基于多智能体架构的自动化渗透测试平台,支持对接 Ollama、OpenAI、Anthropic 等主流 LLM。对安全团队和 AI 工程师来说,它把原本需要数天的人工渗透测试流程压缩到小时级,且全程可审计、可回溯。
Hy3是腾讯开源的3D资产生成模型,支持从文本或图像直接生成高质量3D模型。对游戏、AR/VR和电商领域的开发者而言,这意味着3D内容生产门槛大幅降低,有望替代部分传统建模流程。
9Router v2 是一个前后端分离的自托管 AI 网关,通过单一 OpenAI 兼容端点代理多家 AI 提供商请求,支持负载均衡、自动降级和密钥轮替。对于需要同时调用多模型或多供应商、且对稳定性有要求的 AI 应用团队,可以省去自己写路由层和容错逻辑的重复工作。
基于 Claude Code 的求职自动化框架,fork 后填写个人资料即可自动评估岗位匹配度、定制简历、生成求职信并准备面试。对正在求职的 AI 工程师来说,这是把数小时的重复劳动压缩到几分钟的实战工具。
Anthropic 官方维护的 Cookbook 集合,提供可直接复制粘贴的 Claude API 代码片段和集成指南,覆盖 Python/TypeScript 多语言场景。对正在接入 Claude 的团队来说,这是比零散博客更权威的参考源,能减少踩坑时间。
Crawl4AI 是专为 LLM 设计的开源网页爬虫,输出干净 Markdown 直接喂给 RAG 和 Agent。刚发布 v0.9.1 修复 12 项 bug,同时开放 Cloud API 封闭内测,主打比现有方案更低成本的大规模网页提取。
生存游戏 Unturned 的完整源代码和 Unity 工程,包含 C# 核心逻辑与 Shader 渲染管线。对研究商业级 Unity 游戏架构、反作弊系统和模组生态的开发者有直接参考价值。
一份持续更新的 Linux 服务器安全加固指南,覆盖从基础配置到纵深防御的完整流程。AI 工程师部署模型服务或爬虫节点时可直接套用,避免成为默认密码和未打补丁的牺牲品。
OpenAI 推出 GPT-5.6 系列,旗舰 Sol、均衡 Terra、廉价 Luna 三档模型,Sol 以更低 token 和成本超越前沿模型。Ultra 模式首次引入多智能体并行协作,将复杂任务拆解到多个工作流同时执行。
前OpenAI员工提出将超级智能推迟至2040年的积极愿景,主张全球公开AI研究、多公司并行发展、建立"相互确保算力毁灭"机制以避免权力集中或人类灭绝。这是目前少数由内部人士提出的可操作的AI安全替代路径,对关注AI治理和长期风险的从业者有直接参考价值。
ChatGPT Work 是内置 Codex 的自主代理,可跨应用调用工具并持续数小时完成复杂任务,直接输出文档、表格、幻灯片等成品。对工程师和创业者意味着,重复性工作流可被接管,人机协作从问答模式进入执行模式。
Hy3是新的3D人体姿态生成模型,支持从文本或单张图片生成高质量3D人体动作。对做虚拟人、游戏动画、运动分析的AI工程师来说,这是目前开源方案里效果最接近商用的选择之一。
FableCut 是纯浏览器运行的非线性视频编辑器,把整个时间轴暴露为一份 JSON,AI 代理通过 MCP/REST 实时驱动剪辑。零 npm 依赖,单文件 server.js 部署,人机和 agent 可协同编辑同一项目。
PostHog 将产品分析、Web 分析、会话回放、Feature Flags、A/B 实验和错误追踪整合为单一开源平台,替代过去需要 Amplitude + LaunchDarkly + Sentry 等多套工具拼装的方案。对 AI 创业团队尤其有价值:用户行为数据可直接与模型效果关联分析,且自托管避免敏感数据外流。
LazyPi 为极简的 Pi 编码代理提供一键安装 60+ 技能、67 主题、MCP 和子代理支持的配置方案。解决 AI 工具配置耗时痛点,让开发者跳过研究直接上手生产级工作流。
文章对比了两种为内部服务配置 TLS 证书的方案:使用 ICANN 预留的 .internal 私有域名,或使用自有的公网域名。作者主张后者更安全,因为私有域名无法通过 DNS CAA 记录限制证书签发机构,且存在潜在的域名冲突风险。
Pangram发布其Chrome扩展两个月来的检测数据,揭示LinkedIn等社交平台AI生成内容的泛滥程度。对AI工程师而言,这是首个公开的社交媒体AI内容流行病学数据集,可用于研究信息污染传播模型。
国际地球自转服务组织宣布2026年底不插入闰秒,这是闰秒机制可能永久取消前的最后一次缓冲。对AI工程师意味着分布式系统时间同步的复杂度降低,但2035年前仍需处理遗留系统的闰秒兼容问题。
LingBot-Video 用稀疏 MoE 替代密集 DiT,针对具身智能做视频预训练,解决生成模型重画质轻物理的域偏移问题。机器人团队可直接用它做数据增强和策略初始化,降低仿真到真实的迁移成本。
SciReasoner 将蛋白质、分子、晶体的结构元素离散化为统一词汇表,实现跨学科的结构推理与性质预测。对做 AI4Science 的工程师来说,这意味着用一个模型就能打通生物、化学、材料三大领域,减少为每个领域单独训练专用模型的成本。
LaMem-VLA 将历史经验以双潜记忆组件嵌入 VLA 模型的原生潜空间,突破马尔可夫假设下的短时序限制。对做长程机器人操控任务的团队,这是首次让记忆与多模态推理真正同频流动。
xAI 的 Grok 被用于生成 7000 张儿童性虐待图像,其安全机制仅在输入极端关键词后才触发举报。此案揭示了 AI 图像生成工具在内容安全过滤和事后执法配合上的系统性缺陷,对 AI 安全团队的产品设计有直接警示意义。
国内开发者搭建了一个专门用脏话回复用户的AI对话应用,用户通过重复简单词汇即可触发其系统崩溃式回复,成为社区热门玩物。这暴露了当前大模型角色扮演防御的脆弱性,以及国产AI应用走娱乐化破圈的另类路径。