近期 AI 行业要闻与 GitHub 热门开源项目
新华社 / 中国经济网
OpenAI 于 2026 年 9 月 3 日发布新一代模型 GPT-6 Astra,称其为公司迄今能力最强的模型,上下文窗口达 105 万词元,并成为首个达到「关键」级网络安全能力的前沿模型。
阅读全文 →Future Technology
Anthropic、Google、Meta 与 OpenAI 在 2026 年 9 月初的 72 小时内相继发布新一代前沿模型,标志着行业竞争从单一基准转向「每任务成本」与智能体的工程化落地竞争。
阅读全文 →Anthropic 官方
Anthropic 推出 Claude Opus 5.5,在大多数任务上达到 Claude Fable 5.1 的水平,而运行成本较 Opus 5 降低约 40%,面向长周期智能体与专业办公场景。
阅读全文 →Google DeepMind
Google DeepMind 发布 Gemini 3.8 Flash,延续低价策略并强化文本、图像、音视频与 PDF 等多模态输入能力,同时推出限定版 Gemini 3.8 Flash Cyber。
阅读全文 →Anthropic 官方
Anthropic 发布 Claude Fable 5.1 与 Mythos 5.1:Fable 面向通用与智能体工作,Mythos 为受限访问的高安全版本,并下调缓存读取定价以降低长任务成本。
阅读全文 →Meta Superintelligence Labs
Meta 发布 Muse Spark 1.3 并附带 Contributor Tier 学习授权,强化开源生态与智能体能力,进一步巩固其在开源大模型领域的布局。
阅读全文 →IT之家
据多方消息,OpenAI 即将推出一款常驻 AI 助手,内部代号「O」,预计在 9 月 29 日的 OpenAI DevDay 发布,可实现长期持续运行与独立身份。
阅读全文 →OpenAI 官方
OpenAI 发布 GPT-6 Sol 和 Luna 两款模型,以不同能力与成本组合将前沿智能带入日常工作,覆盖不同规模的企业需求。
阅读全文 →OpenAI 官方
OpenAI 将 GPT-Live-1 引入 API,带来自然的全双工语音对话能力,并增强指令遵循、自定义语音与电话支持,加速语音交互应用落地。
阅读全文 →OpenAI 官方
OpenAI 公开发布由 AI 生成的纳维–斯托克斯千禧年大奖难题解法,包括相关论文与 Lean 形式化证明,被视为 AI 在科学研究领域的标志性进展。
阅读全文 →OpenAI 官方
OpenAI 推出 MentalHealthBench,一个基于专家意见设立的基准,用于评估 AI 在真实心理健康对话中能否提供实用且安全的回应。
阅读全文 →定焦One
随着 AI 事故密集进入公众视野,AI 安全(Securing AI)成为新兴赛道。Gartner 预计全球市场规模将从 2026 年的 28.35 亿美元高速增长,引发资本与巨头布局。
阅读全文 →OpenAI System Card
OpenAI 发布 GPT-6 Astra System Card,首次披露其达到预备框架下的「关键」级网络安全能力等级,并同步说明相应的防护与访问控制措施。
阅读全文 →定焦One
OpenAI 于 9 月 16 日首次推出模型「对齐失效」报告框架,将过去零散的安全事件披露转变成持续跟踪、调查与公开机制。
阅读全文 →Gartner
Gartner 2026 年 Hype Cycle 显示,智能体 AI 处于期望膨胀期的顶峰:只有 17% 的组织已部署 AI 智能体,却有超过 60% 计划在未来两年内采用。
阅读全文 →McKinsey & Company
麦肯锡《2026 全球 AI 现状调查》显示,40% 大型企业报告已规模化部署 AI 智能体,同比增长明显;但企业级财务层面的 EBIT 影响连续两年基本持平。
阅读全文 →OpenAI 官方
OpenAI 推出 Agents API 公测版,开发者可用受管的 Codex 执行环境构建与运行云端智能体,支持长会话、上下文管理、工具调用与子智能体。
阅读全文 →Gartner
Gartner 基于对 107 个智能体部署的分析指出,聚焦特定领域的专业化 Agent 比通用大而全的 Agent 产生更强的业务价值,预计到 2028 年相关 ROI 占比达 80%。
阅读全文 →半两财经
2026 中国互联网基础资源大会发布智能体可信基础设施(ATI),信通院就智能体上下文工程展开首次国内标准起草,加速构建 AI 智能体国家级规范体系。
阅读全文 →TrustCyber
统计显示,2026 年 8 月 5 日至 9 月 3 日期间至少 42 个主流 AI 模型进入公开、预览或受限部署,以 GPT-6 Astra 收官,模型供给呈海量竞争态势。
阅读全文 →超智能体技能框架与软件开发方法论,教你如何系统性地使用 AI Agent 拆解与执行复杂任务,配套可复用的技能模板与实施流程,帮助开发者把智能体真正落地到日常工
面向编程智能体的性能优化系统(Agent Harness),提供 Skills、Instincts、内存、安全与研究优先的开发机制,为 Claude Code、
开源的企业级 LLM 应用开发平台,通过可视化工作流一站式构建 Agentic 工作流、RAG 管线,并集成丰富的大模型与工具,让 AI 应用高效落地。
可视化 AI Agent 与工作流搭建工具,以拖拽方式快速构建、部署智能体应用,连接大模型、工具与数据源,降低 AI 应用的开发门槛。
Anthropic 官方的终端智能体编程工具,能够理解你的代码库、执行日常开发任务、解释复杂代码并处理 Git 工作流,全程通过自然语言驱动。
业界领先的智能体工程平台,为构建多步骤、可观察、可测试的 LLM Agent 提供框架与工具链,是 Agentic AI 应用开发的核心基础设施。
Google 开源终端 AI Agent,将多模态 Gemini 大模型的强大能力直接带入终端,支持代码、命令与工作流的自然语言驱动操作。
面向企业工作场景的开源 AI Agent 管理应用,用于在工作环境中统一创建、编排与协作管理多个智能体,提升团队 AI 生产力。
面向并行 Agent 舰队统一调度的智能体开发环境(ADE),可在桌面、移动端与远程运行时上运行任意编程 Agent,实现大规模并行智能体开发。
『让所有软件原生支持 Agent』的开源方案,通过 CLI 层将各种工具与应用改造成可被智能体原生调用与操作的形式,推进 Agent-Native 生态。
阿里巴巴开源的混合架构代码审查工具:确定性流水线结合 LLM Agent,实现精准的逐行评论与内置多语言规则集(NPE、线程安全、XSS、SQL 注入等),经阿
Anthropic 官方金融服务 AI 智能体参考集,覆盖投行、股权研究、私募股权与财富管理等工作流的 Agent、技能与数据连接器,供专业人士审阅后使用。
不断学习的智能体记忆系统(Agent Memory),让 AI Agent 在多次会话中积累并复用经验,实现越用越聪明的长期记忆能力。
用于配置与监控 Claude Code 的 CLI 工具,内置大量可复用的配置与监控模板,帮助团队标准化并持续观察终端智能体的运行状态。
腾讯开源的一站式 LLM 知识平台:把原始文档转化为可检索的 RAG、可自主推理的 Agent 与自维护的 Wiki,支撑企业知识库与智能问答。
Anthropic 开源的知识工作者插件合集,主要面向 Claude Cowork,覆盖文档处理、信息整合等场景的知识类 AI 插件。
Cloudflare 开源的编程智能体安全审计技能,用于多阶段安全审计,产出可独立验证、机器可读的审计结果,强化安全分析的自动化程度。