📢 🎉 会员体系全新上线,注册即享全部会员教程!
#063
🌙 深色
☀️ 浅色
🇨🇳 中文
🇬🇧 English
🇫🇷 Français
🇵🇭 Filipino
🇲🇾 Bahasa Melayu
🇮🇩 Bahasa Indonesia
🇹🇷 Türkçe
🇸🇦 العربية
🇯🇵 日本語
🇰🇷 한국어
🇪🇸 Español
🇵🇹 Português
🇩🇪 Deutsch
🇻🇳 Tiếng Việt
🇹🇭 ไทย
🇷🇺 Русский

← 返回资讯

模型发布

21条 · 按时间排列,最新在前

1

WorkBuddy 上线 DeepSeek V4.1-Flash,免费试用两周

X:Tencent WorkBuddy (@WorkBuddy_AI) · 9-10

WorkBuddy 宣布 DeepSeek V4.1-Flash 已在其平台上线,免费试用两周。引用的 DeepSeek 公告称 V4.1-Flash 已登陆 DeepSeek API 并支持原生多模态。

AI资讯
2

DeepSeek-V4.1-Flash 上线 SiliconFlow,552B MoE 支持 1M 上下文

X:硅基流动 SiliconFlow (@SiliconFlowAI) · 9-10

硅基流动宣布 DeepSeek-V4.1-Flash 于 Day 0 上线其平台。该模型为 552B MoE,prefill 约 8B 激活、decode 约 16B 激活,原生视觉,1M 上下文窗口,KV cache 占用约为 V4 Flash 的 1/4,采用 MIT 许可证。

AI资讯
3

DeepSeek 发布 V4.1-Flash,API 价格同步下调

DeepSeek:API 更新日志 · 9-10

DeepSeek 发布 DeepSeek-V4.1-Flash,是全新模型结构系列中最小尺寸的模型,具备原生多模态视觉理解能力,评测包括 GPQA Diamond 90.9、HLE 36.8、Codeforces Rating 3471、Terminal-Bench 2.1 90.6 等。

AI资讯
4

DeepSeek 发布 V4.1-Flash,大幅降低 AI Agent 的 KV cache 内存需求

The Decoder:AI News(RSS) · 9-10

DeepSeek 发布多模态模型 V4.1-Flash,以 MIT 许可开源在 Hugging Face,目标是大幅压缩 KV cache 和长上下文处理成本。

AI资讯
5

DeepSeek 发布 V4.1-Flash:新架构带来原生视觉理解与大幅降价

X:Kim (@kimmonismus) · 9-10

DeepSeek 发布 V4.1-Flash,采用 Causal Encoder-Decoder 新架构并支持原生视觉理解,552B MoE 参数,输入处理激活 8B、输出生成激活 16B。

AI资讯
6

DeepSeek 发布 V4.1-Flash:新 Causal Encoder-Decoder 架构,带原生视觉理解

X:Kim (@kimmonismus) · 9-10

DeepSeek 发布 V4.1-Flash,采用新 Causal Encoder-Decoder 架构并支持原生视觉理解,为其新架构家族中最小模型。该模型为 552B 参数 MoE,输入处理激活 8B、输出生成激活 16B;KV cache 需求较上一代降至 HBM 的 1/4、SSD 存储的 1/8,API 价格更…

AI资讯
7

DeepSeek AI 发布 DeepSeek-V4.1-Flash:1M 上下文、FP4 KV 缓存与跨层注意力复用

MarkTechPost(RSS) · 9-10

DeepSeek AI 发布多模态 MoE 模型 DeepSeek-V4.1-Flash,552B 主干加 196B Engram 参数,上下文窗口 1M,prefill 激活 8B 参数、decode 激活 16B,全局 KV 缓存降至每 token 890 字节,约为 DeepSeek-V4-Flash 的 1/4…

AI资讯
8

DeepSeek 发布 V4.1-Flash,API 价格同步下调

DeepSeek:API 更新日志 · 9-10

DeepSeek 发布 DeepSeek-V4.1-Flash,是全新模型结构系列中最小尺寸的模型,具备原生多模态视觉理解能力,评测包括 GPQA Diamond 90.9、HLE 36.8、Codeforces Rating 3471、Terminal-Bench 2.1 90.6 等。

AI资讯
9

Suno v6 发布,支持图片、视频和语音备忘录生成音乐

X:Suno (@suno) · 9-10

Suno 发布 v6 模型,可将图片、视频和语音备忘录转化为音乐,并对已创建的歌曲进行精确修改。同时提供 v6-wild 版本供探索更多可能性,官方附有 2 分钟以内的功能演示视频。

AI资讯
10

OpenAI 发布 GPT-6 Astra,面向专业工作场景

OpenAI:官网动态(RSS · 排除企业/客户案例) · 9-9

OpenAI 发布 GPT-6 Astra,已在 ChatGPT Work、Codex 和 API 提供,定价为每百万输入 token $10、输出 token $50。

AI资讯
11

Meta 发布 Muse Spark 1.3,Intelligence Index 得 61-62 分逼近 Claude 与 GPT-5.6

X:Kim (@kimmonismus) · 9-3

Meta 发布 Muse Spark 1.3,为五个月内第四个 Muse Spark 版本。max 变体(合作伙伴限时预览)在 Artificial Analysis Intelligence Index 得 62 分。

MetaMuse Spark模型评测
12

Meta 发布 Muse Spark 1.3,智能体与科学推理能力提升

X:Alexandr Wang(Scale AI 创始人/Meta 首席 AI 官) · 9-3

Meta 发布 Muse Spark 1.3,是五个月内第四个 Muse Spark 版本。xhigh 版在 Artificial Analysis Intelligence Index 得 61 分。

MetaMuse Spark智能体
13

Google DeepMind 发布 Gemini 3.8 Flash 与 3.8 Flash Cyber 两款新模型

Google DeepMind:Blog(RSS) · 9-3

Google DeepMind 发布 Gemini 3.8 Flash 与 3.8 Flash Cyber。

GoogleGemini模型发布
14

小红书 dots3-note Preview 开源:280B 参数轻量多模态模型

公众号:小红书技术 · 8-14

小红书技术开源 dots3-note Preview,dots3 系列最轻量模型,总参数 280B、激活参数 16B,支持 512K 上下文及文本、视觉、语音多模态理解,针对复杂推理和长程 Agent 任务优化。

小红书开源多模态
15

智谱 GLM-5.3 发布:编程能力开源第一,并涌现网络安全能力

公众号:智谱 · 8-14

智谱发布 GLM-5.3,编程能力较前代提升 50%,在 Terminal Bench 3.0 等基准中取得开源第一,接近 Claude Fable 5。模型在安全任务中表现持平 Mythos 5,CyberGym 测试得分 84.5%。权重两周后开源,即日起上线 ZCode、AutoClaw 等工具。

智谱GLM编程
16

DeepSeek V4 Pro 登陆硅基流动,1M 上下文

X:硅基流动 · 8-14

DeepSeek-V4-Pro-0813 上线硅基流动 SiliconFlow,具备 1M 上下文窗口及三档推理强度,侧重编码、工具调用与智能体工作流,MIT 开源。定价输入 $1.32/M、输出 $3.96/M、缓存命中 $0.44/M。

DeepSeek硅基流动1M上下文
17

Google DeepMind 推出 Gemini 3.7 Flash:面向编程与智能体的最强工作模型

Google DeepMind Blog · 8-14

Google DeepMind 发布 Gemini 3.7 Flash,距 3.6 Flash 仅三周,主打编程与智能体任务,输入/输出价格分别为每百万 token $0.75 和 $3.75,为原 3.6 Flash 的一半。

GoogleGeminiFlash
18

MiniMax Music 3.0 发布:新一代开源权重、生产级全能音乐模型

MiniMax Blog · 8-14

MiniMax 推出 Music 3.0,新一代音乐生成模型,可根据创意概念和可选歌词一次性完成整首歌的作曲、编曲、演奏与制作,最长支持五分钟。

MiniMax音乐生成开源
19

蚂蚁集团旗下 Robbyant 开源 LingBot-Vision:1B 参数边界中心视觉基础模型

MarkTechPost · 7-8

蚂蚁旗下具身智能公司开源一套自监督视觉 Transformer,专为密集空间感知设计。旗舰 ViT-g/16 约 1.1B 参数,在密集空间任务中匹配或超越参数规模达 7 倍的大模型,已在 Hugging Face 以 Apache-2.0 开源。

开源视觉Transformer
20

Pulpie:用于清理网络的 Pareto 最优模型

Hacker News 热门 · 7-8

一族用于从 HTML 提取主要内容的 Pareto 最优模型。最小模型 210M 参数在 WebMainBench 上接近 600M 的 Dripper,但成本仅 1/20;清理 10 亿页 HTML 成本约 $7,900。已开源。

开源数据处理HTML
21

Meta Superintelligence Labs 推出 Muse Image 和 Muse Video

X:AI at Meta · 7-8

Meta 超级智能实验室发布首个媒体生成模型。Muse Image 号称当前最先进图像生成模型,能精准遵循指令/编辑/多参考构图;Muse Video 基于相同预训练,高保真且原生支持音频。

图像生成视频生成Meta