OpenAI 发布 GPT-5

OpenAI 发布 GPT-5:多模态能力大幅提升,原生支持图像与音频推理

OpenAI 在今日凌晨的发布活动中正式推出 GPT-5 模型,新版本原生支持文本、图像、音频的统一推理能力,长上下文窗口提升至 200 万 token,在 MMLU、HumanEval 等基准测试中全面超越 GPT-4。

模型发布 2026-09-15 来源:OpenAI 官方 3520 阅读
字节豆包大模型升级

字节跳动豆包大模型升级:1.5T 长上下文窗口开启内测

字节跳动旗下豆包大模型宣布升级至 Doubao-Pro 1.5T 版本,原生支持 150 万 token 的超长上下文窗口,可一次性处理整本《三体》三部曲并保持稳定推理,已对部分企业客户开放内测申请。

企业动态 2026-09-14 来源:字节跳动 2840 阅读
Anthropic 推出 Claude 4.5

Anthropic 推出 Claude 4.5:编码能力跃升行业第一,支持 8 小时连续 Agent 任务

Anthropic 发布 Claude 4.5 Sonnet 与 Claude 4.5 Opus 两款新模型,在 SWE-Bench Verified 上取得 78% 的最高分,新增"长程 Agent 模式",可在受控环境中连续 8 小时执行自主编码与运维任务。

模型发布 2026-09-13 来源:Anthropic 官方 2190 阅读
Google Gemini 2.0

Google Gemini 2.0 正式版发布:原生多模态推理,速度提升 3 倍

Google 正式发布 Gemini 2.0 Flash 与 Gemini 2.0 Pro,新版本原生支持图像、音频、视频的统一输入输出,首字节响应时间从 1.8 秒降低至 0.6 秒,可与 Search、Maps 等 Google 服务原生联动。

模型发布 2026-09-12 来源:Google DeepMind 1865 阅读
Sora 2 正式上线

Sora 2 正式开放使用:物理一致性显著提升,支持 60 秒长视频

OpenAI 旗下视频生成模型 Sora 2 正式面向 Plus 用户开放,新版本在物理模拟、人物连贯性、镜头运动等方面显著提升,单次生成时长上限提升至 60 秒,并支持参考图、参考视频作为输入。

技术突破 2026-09-11 来源:OpenAI 官方 3420 阅读
Stability AI 新模型

Stability AI 推出 Stable Diffusion 4:4K 高清出图成默认,速度提升 2 倍

Stability AI 发布全新一代图像生成模型 Stable Diffusion 4,默认输出分辨率提升至 4096×4096,单图生成时间较 SD3 降低 50%,并原生支持中文 Prompt 输入,对亚洲人脸、汉字渲染更准确。

模型发布 2026-09-10 来源:Stability AI 1560 阅读
Midjourney V7

Midjourney V7 重磅上线:4K 画质与角色一致性突破

Midjourney 正式发布 V7 版本,新版本默认开启"自然语言模式",支持中文 Prompt 描述,4K 高清出图速度提升 3 倍,并通过 Character Coherence 功能实现角色在多张图中保持一致外观与服装。

技术突破 2026-09-09 来源:Midjourney 官方 4280 阅读
Runway Gen-4

Runway Gen-4 推出角色一致性:电影预告片一键生成

Runway 发布 Gen-4 模型,主打"角色一致性"与"场景一致性",可在多个镜头中保持角色外观、服装、表情连贯,配合新推出的电影模板,3 分钟即可生成完整电影预告片。

技术突破 2026-09-08 来源:Runway 官方 2380 阅读
智谱 GLM-5

智谱 GLM-5 开源发布:性能对标 GPT-5 同档位模型,商用免费

智谱 AI 正式开源 GLM-5 系列模型,包含 GLM-5-Base、GLM-5-Chat 与 GLM-5-Code 三款权重,在 MMLU、CMMLU、HumanEval 等基准测试中均接近 GPT-5 同档位模型水平,并允许免费商用。

模型发布 2026-09-07 来源:智谱 AI 3120 阅读
月之暗面 Kimi 更新

月之暗面 Kimi 更新:支持 200 万字长文本深度阅读与分析

月之暗面旗下 Kimi 智能助手完成新一轮升级,长上下文窗口扩展至 200 万汉字,新增"深度阅读"模式,可对长篇财报、论文、合同进行结构化提取与跨章节问答,免费用户也可使用。

企业动态 2026-09-06 来源:月之暗面 4890 阅读