-
阶跃星辰发布 Step 5 Preview:600B MoE 旗舰模型,支持 100 万 Token 上下文
阶跃星辰发布新一代旗舰基座模型 Step 5 Preview,面向真实世界 Agentic 任务设计。模型采用 600B 稀疏 MoE 架构,每 Token 激活约 27B 参数,支持 100 万 Token 上下文及文本、视觉输入,重点强化 AI 编程、软件工程、专业知识工作和金融研究等复杂任务。Step 5 Preview 已开放 API 与 Studio 体验,官方计划于 10 月 15 日…- 593
- 0
-
Step 5 Preview:阶跃星辰推出的新一代旗舰基座模型
Step 5 Preview 是阶跃星辰推出的新一代旗舰 Agentic 模型,采用 600B 稀疏 MoE 架构,每 Token 激活 27B 参数,支持 100 万 Token 上下文和视觉输入,重点面向 AI 编程、软件工程、金融研究及复杂 Agent 任务。- 290
- 0
-
DeepSeek V4.1 Flash正式发布:原生支持多模态,API 成本进一步降低
DeepSeek 正式发布 V4.1 Flash 模型,采用全新的非对称 Causal-Encoder-Decoder 架构,总参数量为 552B,输入激活 8B、输出激活 16B。新模型原生支持视觉理解,并通过压缩 KV Cache、优化推理效率和下调 API 价格,进一步降低 AI Agent、编程及长上下文任务的使用成本。- 4.5k
- 0
-
Xiaomi MiMo 桌面客户端开放邀测,两款 MiMo-X 新模型同步亮相
2026年09月08日,小米宣布,Xiaomi MiMo Desktop 桌面客户端正式开放邀请测试,并同步提供两款新一代模型 Preview 版体验,代号分别为 MiMo-X-Pro-Preview 和 MiMo-X-Flash-Preview。 MiMo Desktop 面向办公、研究、设计和编程等真实工作场景。用户可输入表格、图片、视频、PDF、录音及压缩包等素材,通过自然语言说明目标,由客…- 2.2k
- 0
-
OpenAI发布GPT-6 Astra:面向复杂端到端任务的新一代旗舰模型
OpenAI正式发布旗舰模型GPT-6 Astra,重点强化计算机与浏览器操作、软件工程、科学推理和专业办公能力。该模型支持105万tokens上下文,将分批向ChatGPT付费用户、OpenAI API及Amazon Bedrock开放。- 4.5k
- 0
-
GPT-6 Astra - OpenAI 推出的新一代旗舰大模型
GPT-6 Astra 是 OpenAI 面向复杂端到端任务推出的旗舰推理模型,重点强化计算机与浏览器操作、软件工程、科学研究和专业办公,可在长流程中调用工具并生成文档、表格、演示文稿等成品,适合开发者、研究人员及企业知识工作者。- 814
- 0
-
Gemini 3.8 Flash - Google 推出的新一代高效多模态模型
Gemini 3.8 Flash 是 Google 推出的新一代高效多模态模型,重点提升长程软件工程、自主智能体、工具调用和复杂专业推理能力,并支持百万级上下文。同期推出的 Flash Cyber 专注漏洞发现与自动修复,目前仅通过 Fairwind Program 向可信网络安全机构开放。- 329
- 0
-
Anthropic发布Claude Fable 5.1:复杂任务能力升级,缓存成本降低75%
Anthropic正式发布Claude Fable 5.1,重点提升长周期智能体编程、多步骤研究及专业知识工作能力,支持100万Token上下文和12.8万Token输出。模型维持原有API价格,缓存读取成本降低75%,现已面向Claude付费用户及API客户开放。- 1.9k
- 0
-
Claude Fable 5.1 - Anthropic 面向编程、知识工作与科研的前沿大模型
Claude Fable 5.1 是 Anthropic 的前沿大模型,擅长编程、知识工作与长周期 Agent 任务,并具备科研级建模分析能力,可通过 Claude API 接入。- 599
- 0
-
腾讯混元推出Hy4 preview轻量版模型
2026年09月01日,腾讯混元发布 Hy4 Preview 轻量版模型,将权重文件从约1.5TB压缩至214GB,基本保留长文理解和多轮上下文检索能力,可用于编码、工具调用、长文档处理与常规问答。- 1.4k
- 0
-
DeepSeek-V4-Flash-Vision-Exp开放模型权重,采用MIT协议开源
DeepSeek正式开放DeepSeek-V4-Flash-Vision-Exp模型权重及参考推理代码,采用MIT协议,支持多模态Agent研究、私有化部署与二次开发。- 1.8k
- 0
-
腾讯发布并开源 Hy4 preview:770B参数、1M上下文,强化编程与科研能力
腾讯混元发布并开源新一代旗舰模型 Hy4 preview,采用770B总参数、49B激活参数的MoE架构,支持1M Tokens上下文,重点提升软件工程、办公分析、游戏开发与科学研究能力,现已上线腾讯云和OpenRouter。- 1.4k
- 0
-
Hy4 preview - 腾讯混元发布的新一代开源旗舰大语言模型
Hy4 preview 是腾讯混元推出的770B参数MoE旗舰模型,激活49B参数,支持1M上下文,重点强化编程、办公分析、游戏开发与科学研究能力。- 3.1k
- 0
-
阿里发布Qwen3.8-Flash:新架构降低训练成本,API输入每百万Tokens仅1元
8月26日晚,阿里通义千问团队正式发布全新多模态 MoE 模型 Qwen3.8-Flash。该模型主模型参数量为 125B,额外配备 51B N-gram Embedding,每 Token 仅激活 6B 参数,原生支持 262,144 Tokens 上下文,并可通过 YaRN 扩展至100万 Tokens。 Qwen3.8-Flash 围绕 Attention、Residual、Embeddin…- 2.7k
- 0
-
Qwen3.8-Flash:阿里通义千问最新推出的多模态大模型
Qwen3.8-Flash-Next 是阿里通义千问推出的开放权重多模态 MoE 模型,预览 Qwen4 架构,支持编程、办公智能体、图像视频理解及百万级上下文。- 1.1k
- 0
-
智谱发布 GLM-5.3-Flash:GLM-5 系列首款原生多模态模型
2026年08月26日,智谱 AI 正式发布 GLM-5.3-Flash,也就是此前受到行业关注的“ox-alpha”。这是 GLM-5 系列首款原生多模态模型,面向 Coding、Agent 和专业生产力任务,在保持较强模型能力的同时,进一步降低推理与使用成本。 GLM-5.3-Flash 采用 320B 总参数、18B 激活参数的 MoE 架构,并在 GLM 系列中首次结合稀疏注意力与线性注意…- 3.4k
- 0
-
GLM-5.3-Flash - 智谱推出的高性价比原生多模态模型
GLM-5.3-Flash 是智谱 AI 推出的 GLM-5 系列首款原生多模态模型,拥有 320B 总参数和 18B 激活参数,支持 100 万 token 上下文。模型聚焦编程、智能体与专业办公任务,通过混合注意力架构降低推理成本,并以 MIT 协议开放模型权重。- 1.2k
- 0
-
DeepSeek-V4-Flash-Vision-Exp:DeepSeek推出的多模态视觉理解模型
DeepSeek-V4-Flash-Vision-Exp 是一款面向多模态 Agent 场景的实验性视觉理解模型,在保持 V4-Flash 文本能力的同时支持图文混合输入,可用于图片分析、商业 PPT、网页重构、前端开发及自动化工作流,主要通过 DeepSeek API 向开发者提供。- 1k
- 0
-
Qwen3.8 正式开源:27B 原生多模态模型开放,消费级显卡可部署
阿里正式开源 Qwen3.8 系列,Qwen3.8-27B 采用 270 亿参数原生多模态 Dense 架构,综合能力超过 Qwen3.7-Plus,支持编程、办公和视觉理解,采用 Apache 2.0 协议,量化后可在消费级显卡部署。- 5.7k
- 0
-
GLM-5.3:智谱推出的开源AI编程与网络安全大模型
GLM-5.3 是智谱推出的新一代开源大模型,基于 GLM-5.2 相同基座通过大规模后训练提升 AI 编程、长程 Agent、终端操作、代码审查和漏洞发现能力,并计划在安全加固后开放完整模型权重。- 1.7k
- 0
-
Google 发布 Gemini 3.7 Flash:强化 Coding 与 Agent,支持 100 万 Token 上下文
Google 正式发布 Gemini 3.7 Flash,新模型重点强化 AI 编程、Agent 工作流、Web 开发和专业知识处理能力,在多项软件工程与业务自动化测试中明显超过 Gemini 3.6 Flash。模型支持 100 万 Token 上下文,目前已正式 GA,可用于生产环境。- 1.6k
- 0
-
Gemini 3.7 Flash - Google 推出的高效 Coding 与 Agent 模型
Gemini 3.7 Flash 是 Google 推出的新一代高效 AI 模型,重点强化 AI 编程、多步骤 Agent、Web 开发和专业知识工作,支持多模态理解、工具调用和复杂业务工作流,并以更低成本面向开发者和企业提供服务。- 1.1k
- 0
-
WeLM - 微信团队研发的一系列大型语言模型
WeLM 是微信团队自主研发的大语言模型体系,重点面向微信 AI 助手、小程序和 Agent 场景,新一代模型采用 MoE 架构,并探索 80B、617B 参数规模及 Hidden Decoding 隐式推理技术。- 1.1k
- 0
-
Grok 4.6 正式发布:强化长任务 Agent 与 AI 编程,支持 50 万 Token 上下文
SpaceXAI 正式发布旗舰模型 Grok 4.6,重点强化长时间 Agent、AI 编程、知识工作和交互式应用开发能力,支持文本与图像输入以及 50 万 Token 上下文。新模型进一步提升复杂任务的持续执行能力,并已通过 Grok、API 及第三方开发工具提供使用。- 5.1k
- 0
















