AI SIGNAL BRIEF

2026年7月28日 · 今日简报

今日 · 持续更新
覆盖窗口07/28 00:00 – 07/28 09:00Asia/Singapore生成时间07/28 09:00Asia/Singapore

本日截至当前,行业焦点高度集中于 Kimi K3 的发布与生态扩张:这款 2.8T 参数 MoE 模型具备 100 万 token 上下文与原生视觉能力,发布当天即获得 vLLM、SkyPilot 的开源部署支持,并同时接入 Cursor、DigitalOcean、Fireworks、Baseten、Together 等多个平台,美国本土托管与零数据保留成为主打合规卖点。与此同时,月之暗面发布 PerceptionBench,将视觉感知评估从推理中剥离;Epoch AI 宣布 AI 解决了 FrontierMath: Open Problems 中第二个未解数学问题并附形式化证明;SemiAnalysis 对 AMD 与 OpenAI、Meta 的认股权证交易提出'最高 105% 折扣'的循环性质疑。企业侧,OpenAI 将 GPT-Live 语音功能扩展至 Edu/Business/Enterprise 全球用户。

数据更新 07/28 09:02
01事件线索

Kimi K3 发布并当日打通全生态部署

Kimi K3 正式发布:2.8T 参数 MoE 架构、100 万 token 上下文、原生视觉能力。发布当天即获得 vLLM 官方部署指南与 SkyPilot day-0 完整 serving 栈支持,并上线 DigitalOcean Serverless Inference;Cursor 宣布接入(CursorBench 得分接近前沿),由 Fireworks、Together、Baseten 提供美国本土推理并支持零数据保留。Fireworks 自称发布时唯一与官方质量持平的提供商,AA 上达 165 tok/s。

为什么重要
这是近期罕见的'发布即全栈落地'案例:开源推理栈、云平台、编程工具、合规托管在同日齐备,显示大模型竞争已从模型能力比拼转向部署速度、生态响应与企业合规承诺的综合较量。对开发者而言,K3 在多条路径上均可立即使用。
趋势影响
K3 进入主流 AI 编程工具且性能接近前沿,加上美国本土推理和零数据保留支持,降低了企业合规顾虑,对 Cursor 用户是可立即启用的新模型选项。
置信度 / 来源数
· 5 条来源 · 4 位达人
来源证据5 条帖子 · 4 位达人查看来源
02事件线索

AI 解决 FrontierMath: Open Problems 第二个未解数学问题

Epoch AI 宣布 AI 找到了 2-adic 数域绝对 Galois 群的一个 presentation,这是其'重要未解研究数学问题'基准中第二个被攻克的问题。解法先由 Roe 用 Fable 5 引出,后由 David Turturean 用 GPT-5.5 Pro 独立复现,并配套发布包括交互式形式化证明在内的解释材料;官方预告下周将发布扩展题集。

为什么重要
前沿模型开始触及真实未解的研究级数学问题而非竞赛题库;多模型独立复现加可交互检验的形式化证明,把 AI 数学产出从'给出答案'推进到'人类可核验、可复用'的知识形态,可能改变研究数学的发现与验证流程。
趋势影响
多模型独立引出同一解法增强了可信度,交互式形式证明把“AI 给出答案”推进到“人类可检查、可复用”的数学知识形态。
置信度 / 来源数
· 3 条来源 · 1 位达人
来源证据3 条帖子 · 1 位达人查看来源
03事件线索

月之暗面发布 PerceptionBench 视觉感知基准

PerceptionBench 从 42 个基准中的前沿模型失败案例出发,归纳出 10 项原子视觉感知能力,构建 3000 道经验证题目,每题仅隔离单一能力、仅凭观察即可作答,不依赖推理或外部知识,已在博客、GitHub、HuggingFace 同步开放。

为什么重要
该基准将视觉感知从推理与知识中剥离,为多模态模型提供更细粒度、可诊断的能力评估工具,对模型比较、失败分析与训练数据建设均有参考价值。
趋势影响
该基准试图把视觉感知从推理与知识中剥离,为多模态模型提供更细粒度、可诊断的能力评估,对模型比较、失败分析和数据建设都有参考价值。
置信度 / 来源数
· 1 条来源 · 1 位达人
来源证据1 条帖子 · 1 位达人查看来源

ACTIVE VOICES

本期活跃声音

7月28日自然日 · 15 个来源 / 29 条帖子 · 按原帖发布时间

已显示第 1 页,共 2 页

SOURCE LEDGER

全部原帖与分析

本页 10 条 · 共 29 条
排序
级别
达人全部达人