NEWS / 01

资讯

按发布时间追踪 AI 模型、工具与公司的最新记录。

最新发布

Qwen3.8-Max-Preview

阿里发布 Qwen3.8-Max-Preview:2.4T 参数旗舰模型上线,Qwen3.8 将开放权重

阿里千问于 7 月 19 日上线 Qwen3.8-Max-Preview,首发进入 Token Plan、Qoder 和 QoderWork。官方称 Qwen3.8 总参数量达到 2.4T,并预告将很快开放权重;截至目前,完整 benchmark、模型卡、许可证和权重发布时间仍未公布。

内容优先级85

Timeline

按发布时间继续阅读

  1. 02

    WAIC 2026 上海开幕:世界人工智能合作组织协定签署,超 300 款 AI 新品集中亮相

    2026 世界人工智能大会暨人工智能全球治理高级别会议于 7 月 17 日在上海开幕。29 个国家的代表签署成立世界人工智能合作组织协定,该组织总部设在上海;大会同时公布 140 余场论坛、1100 余家参展企业和超 300 款全球首发产品的计划。截至 7 月 18 日大会仍在进行,首发数量与合作成果需以闭幕后的正式口径为准。

  2. 03
    Kimi K3月之暗面

    Kimi K3 Benchmark 深度解读:前端 Arena 登顶,通用推理仍落后 Claude Fable 5 与 GPT-5.6 Sol

    Kimi K3 在 Moonshot AI 公布的 35 项对照测试中有 7 项单独领先、1 项并列领先;Arena 将其列为前端开发第 1、综合文本第 9。按 100 万输入加 20 万输出、全部输入未命中缓存计算,K3 约需 6 美元,比 Claude Fable 5 低 70%、比 GPT-5.6 Sol 低约 45%,但费用约为 GLM-5.2 的 2.63 倍。

  3. 04
    Kimi K3月之暗面

    Moonshot AI 发布 Kimi K3:2.8 万亿参数、100 万 Token 上下文,完整开源权重 7 月 27 日前上线

    Moonshot AI 于 2026 年 7 月 16 日发布旗舰模型 Kimi K3。该模型采用 2.8 万亿参数 MoE 架构,原生支持视觉理解和 100 万 token 上下文,已登陆 Kimi、Kimi Work、Kimi Code 与 API;完整模型权重计划最迟于 7 月 27 日发布。

  4. 05
    AnthropicPalantir谷歌云OpenAI

    OpenAI 与 Anthropic 争相押注 FDE:前置部署工程师会是 Agent 时代企业落地与 PMF 的银弹吗?

    随着 AI 模型性能增速放缓,大模型落地应用成为企业级市场的竞争焦点。2026 年 5 月,OpenAI 设立 40 亿美元部署子公司,Anthropic 嵌入金融巨头 FIS 总部,Google Cloud 开启数百人规模的 FDE 招聘。前置部署工程师(FDE)这一由 Palantir 开创的驻场开发模式,正在成为大模型厂商争夺企业工作流入口的利器。

  5. 06
    阿里云Qwen-Audio-3.0-Realtime

    阿里云 Qwen-Audio-3.0-Realtime 正式发布:低延迟全双工语音交互与主动 Agent 工具调用开启语音大模型新时代

    阿里云正式发布实时语音交互大模型 Qwen-Audio-3.0-Realtime。模型实现毫秒级低延迟响应,支持全双工自由打断,并具备主动调用 Agent 外部工具的能力,首发上线 Plus 和 Flash 两个版本。

  6. 07
    Gemini 3.5 Pro

    Gemini 3.5 Pro 传 7 月 17 日发布:推迟发布背后或为重训解决编程与推理短板

    备受瞩目的 Google Gemini 3.5 Pro 屡次推迟发布,最新爆料指向 2026 年 7 月 17 日至 8 月初。报道称,Google 正在 LMArena 等渠道测试,并因早期代码过度思考、Token 暴增等问题重新训练了部分参数。

  7. 08
    GraphifyGitNexusCodeGraph

    开发者警告:在 GPT-5.6 Sol 中使用 Superpowers 框架正引发严重的“左右脑互博”

    2026年7月,开发者 @Lonely__MH 警告称在 GPT-5.6 Sol 模型上启用 Superpowers 技能会导致左右脑互博。该框架与 Sol 的原生高强度推理发生冲突,引发上下文污染、Token 暴增和任务死循环。

  8. 09
    GPT-5.6 SolGPT-5.6 TerraGemini 3.5 FlashClaude Opus 4.8

    寻找真正的“性价比之王”

    DeepSwe 最新评测数据分析:只要满足 Pass@1 高于 65% 的性能基线,只看价格。gpt-5.6-luna 是当前最省钱的首选。