-
Google 发布 Gemini 3.8 Live,实时语音 AI 可边对话边推理
Google 正式发布 Gemini 3.8 Live 与 Gemini 3.8 Live Extended Thinking 两款实时语音模型,分别面向低延迟语音交互和复杂多步骤语音 Agent 场景。新模型支持实时视觉理解、多语言切换、工具调用,其中 Extended Thinking 可在保持语音交流的同时进行后台推理和异步任务执行。- 684
- 0
-
Gemini 3.8 Live - Google 推出的新一代实时多模态语音模型
Gemini 3.8 Live 是 Google 推出的实时音频对音频模型,面向语音智能体与实时对话场景,支持视觉理解、97 种语言自动切换、异步工具调用和实时多模态交互;同时推出 Extended Thinking 版本,为复杂任务提供后台持续推理与多步骤执行能力。- 135
- 0
-
DeepSeek V4.1 Flash正式发布:原生支持多模态,API 成本进一步降低
DeepSeek 正式发布 V4.1 Flash 模型,采用全新的非对称 Causal-Encoder-Decoder 架构,总参数量为 552B,输入激活 8B、输出激活 16B。新模型原生支持视觉理解,并通过压缩 KV Cache、优化推理效率和下调 API 价格,进一步降低 AI Agent、编程及长上下文任务的使用成本。- 3.4k
- 0
-
OpenAI发布GPT-6 Astra:面向复杂端到端任务的新一代旗舰模型
OpenAI正式发布旗舰模型GPT-6 Astra,重点强化计算机与浏览器操作、软件工程、科学推理和专业办公能力。该模型支持105万tokens上下文,将分批向ChatGPT付费用户、OpenAI API及Amazon Bedrock开放。- 3.6k
- 0
-
GPT-6 Astra - OpenAI 推出的新一代旗舰大模型
GPT-6 Astra 是 OpenAI 面向复杂端到端任务推出的旗舰推理模型,重点强化计算机与浏览器操作、软件工程、科学研究和专业办公,可在长流程中调用工具并生成文档、表格、演示文稿等成品,适合开发者、研究人员及企业知识工作者。- 616
- 0
-
WeLM - 微信团队研发的一系列大型语言模型
WeLM 是微信团队自主研发的大语言模型体系,重点面向微信 AI 助手、小程序和 Agent 场景,新一代模型采用 MoE 架构,并探索 80B、617B 参数规模及 Hidden Decoding 隐式推理技术。- 963
- 0
-
DeepSeek-V4:DeepSeek 推出的新一代开源大语言模型
DeepSeek-V4 是 DeepSeek 推出的新一代开源大语言模型系列,面向长上下文理解、复杂推理、代码生成和 Agent 自动化任务场景。- 20.6k
- 0
-
Muse Spark - Meta AI 推出的原生多模态推理模型
Muse Spark 是 Meta AI 推出的原生多模态推理模型,支持工具调用、视觉链式思考和多智能体协作,已用于 Meta AI app 与网页端,并将逐步接入更多 Meta 产品生态。- 3k
- 0
-
小米 MiMo-V2-Pro 正式发布:Agent 场景超越 Sonnet 4.6,API 定价仅为同级 1/5
2026年3月18日,小米正式发布旗舰 Agent 基座模型 Xiaomi MiMo-V2-Pro,总参数量超过 1T(激活参数 42B),支持 1M 超长上下文,采用创新 Hybrid Attention 混合注意力架构(比例 7:1),较上代 MiMo-V2-Flash 参数规模扩大约 3 倍。 在 Artificial Analysis 全球综合智能排行榜上,MiMo-V2-Pro 位列全球…- 5.9k
- 0
-
Xiaomi MiMo-V2-Pro:小米发布的最新旗舰 Agent 基座模型
Xiaomi MiMo-V2-Pro 是小米面向 Agent 时代发布的旗舰基座模型,总参数量超 1T(激活参数 42B),支持 1M 超长上下文,在 Artificial Analysis 全球综合智能榜单位列第八、国内第二。在 OpenClaw、Claude Code 等 Agent 框架中端到端任务完成能力整体超越 Sonnet 4.6,逼近 Opus 4.6,API 定价仅为同级的 1/5…- 8.4k
- 0
-
OpenAI 发布 GPT-5.4:面向专业工作,强化表格、文档、编程与智能体能力
OpenAI 于 2026 年 3 月 5 日发布 GPT-5.4,并同步上线 ChatGPT、API 和 Codex。官方将其定位为面向专业工作的前沿模型,重点提升表格、文档、演示文稿、编程、网页研究和智能体工作流能力,同时带来原生 computer-use、更高 token 效率,以及 GPT-5.4 Pro 版本,进一步强化复杂任务表现。- 4.5k
- 0
-
GPT-5.4 - OpenAI 新一代专业工作模型,擅长知识工作、编码与计算机操作
GPT-5.4 是 OpenAI 于 2026 年 3 月发布的前沿模型,主打专业工作场景,整合了更强的推理、编程、计算机使用和工具调用能力。它支持在 ChatGPT、API 和 Codex 中使用,并提供 GPT-5.4 Pro 版本,适合处理文档、表格、演示文稿、软件开发及多步骤智能体任务。- 5.6k
- 0
-
Grok 4 Fast:xAI 最新发布的低成本高效推理模型,支持 200 万 token 长上下文
Grok 4 Fast 是 xAI 最新发布的低成本高效推理模型,支持 2M token 长上下文、工具浏览能力与统一架构,在多个 benchmark 中性能与 Grok 4 近似但成本大幅降低,适合企业与开发者部署使用。- 4.7k
- 0
-
豆包1.5·深度思考模型:火山引擎推出的AI推理模型
在数学、编程、科学推理等专业领域及创意写作等通用任务中表现突出,在AIME 2024、Codeforces、GPQA等多项权威基准上达到或接近业界第一梯队水平。支持128k上下文窗口,16k输出。- 7.6k
- 0
-
OpenAI o4-mini:OpenAI最新推出的经济高效的推理模型
o4-mini 是OpenAI 发布的一款高效推理模型,专为快速、低成本的任务设计。它在数学、编程和视觉任务上表现出色,尤其适合高吞吐量场景。o4-mini 能自主使用 ChatGPT 的工具,如搜索、文件分析和代码执行,以快速生成答案。它还支持多模态输入,能处理图像和文本,对话自然且相关。其性价比高,是处理复杂问题的理想选择。- 4.8k
- 0
-
OpenAI o3:OpenAI推出的最新推理模型,支持工具调用和图像理解
OpenAI o3 是 OpenAI 发布的最新推理模型,代表了其在智能推理领域的最高水平。它能够自主使用 ChatGPT 内的所有工具,包括网络搜索、文件分析、代码执行和图像生成。- 5.9k
- 0
-
腾讯混元T1:腾讯推出的最新深度思考推理模型
腾讯混元 T1 是腾讯推出的最新深度思考推理模型,具备强大的分析和推理能力,能够清晰、有依据地回答复杂问题。T1 还支持联网搜索,结合实时信息提供更准确的答案。- 7.6k
- 0
-
OpenAI o3-mini:OpenAI最新发布的AI推理模型
o3-mini 是 OpenAI 推出的新一代推理模型,旨在为用户提供高效且经济的推理能力。它继承了前代 o1 模型的优点,同时通过优化提升了在 科学、数学、编程 等领域的推理能力,并保持了 低成本 和 低延迟。o3-mini 已经在 ChatGPT 和 API 中上线,适用于广泛的企业和开发者场景。- 11.8k
- 0
-
Step R-mini:阶跃星辰推出的推理大模型,擅长数学、逻辑和代码
Step R-mini是由阶跃星辰推出的自研AI 推理模型,这是 Step 系列家族的首个推理模型,擅长逻辑推理、代码和数学问题的解决,同时也能进行文学创作等任务。Step R-mini 采用“慢思考”和反复验证的逻辑机制,能够提供准确、可靠的回答。- 4.5k
- 0
-
星火深度推理模型X1
星火深度推理模型X1是科大讯飞推出的首个具备深度思考和推理能力的大型AI模型。它基于全国产算力训练,拥有较高的数学能力和推理能力,能够在较少算力的情况下提供业界领先的效果,并成功实现了在实际场景中的应用。- 6.7k
- 0
-
GLM-Zero:智谱AI最新推出的AI深度推理模型
GLM-Zero是智谱AI推出的最新推理模型,专为解决数学、编程、常识问答等复杂任务而设计。该模型具备卓越的推理能力,能高效处理高级数学运算、逻辑推理、编程任务等,适用于教育、科研和技术开发等多个领域。凭借其强大的计算和推理能力,GLM-Zero为用户提供了精准、高效的解决方案,推动了生成式AI在多领域的应用和发展。- 10.2k
- 0

















