WorkBuddy 上线 DeepSeek V4.1-Flash,免费试用两周
WorkBuddy 宣布 DeepSeek V4.1-Flash 已在其平台上线,免费试用两周。引用的 DeepSeek 公告称 V4.1-Flash 已登陆 DeepSeek API 并支持原生多模态。
DeepSeek-V4.1-Flash 上线 SiliconFlow,552B MoE 支持 1M 上下文
硅基流动宣布 DeepSeek-V4.1-Flash 于 Day 0 上线其平台。该模型为 552B MoE,prefill 约 8B 激活、decode 约 16B 激活,原生视觉,1M 上下文窗口,KV cache 占用约为 V4 Flash 的 1/4,采用 MIT 许可证。
DeepSeek 发布 V4.1-Flash,API 价格同步下调
DeepSeek 发布 DeepSeek-V4.1-Flash,是全新模型结构系列中最小尺寸的模型,具备原生多模态视觉理解能力,评测包括 GPQA Diamond 90.9、HLE 36.8、Codeforces Rating 3471、Terminal-Bench 2.1 90.6 等。
DeepSeek 发布 V4.1-Flash,大幅降低 AI Agent 的 KV cache 内存需求
DeepSeek 发布多模态模型 V4.1-Flash,以 MIT 许可开源在 Hugging Face,目标是大幅压缩 KV cache 和长上下文处理成本。
DeepSeek 发布 V4.1-Flash:新架构带来原生视觉理解与大幅降价
DeepSeek 发布 V4.1-Flash,采用 Causal Encoder-Decoder 新架构并支持原生视觉理解,552B MoE 参数,输入处理激活 8B、输出生成激活 16B。
DeepSeek 发布 V4.1-Flash:新 Causal Encoder-Decoder 架构,带原生视觉理解
DeepSeek 发布 V4.1-Flash,采用新 Causal Encoder-Decoder 架构并支持原生视觉理解,为其新架构家族中最小模型。该模型为 552B 参数 MoE,输入处理激活 8B、输出生成激活 16B;KV cache 需求较上一代降至 HBM 的 1/4、SSD 存储的 1/8,API 价格更…
DeepSeek AI 发布 DeepSeek-V4.1-Flash:1M 上下文、FP4 KV 缓存与跨层注意力复用
DeepSeek AI 发布多模态 MoE 模型 DeepSeek-V4.1-Flash,552B 主干加 196B Engram 参数,上下文窗口 1M,prefill 激活 8B 参数、decode 激活 16B,全局 KV 缓存降至每 token 890 字节,约为 DeepSeek-V4-Flash 的 1/4…
DeepSeek 发布 V4.1-Flash,API 价格同步下调
DeepSeek 发布 DeepSeek-V4.1-Flash,是全新模型结构系列中最小尺寸的模型,具备原生多模态视觉理解能力,评测包括 GPQA Diamond 90.9、HLE 36.8、Codeforces Rating 3471、Terminal-Bench 2.1 90.6 等。
Suno v6 发布,支持图片、视频和语音备忘录生成音乐
Suno 发布 v6 模型,可将图片、视频和语音备忘录转化为音乐,并对已创建的歌曲进行精确修改。同时提供 v6-wild 版本供探索更多可能性,官方附有 2 分钟以内的功能演示视频。
OpenAI 发布 GPT-6 Astra,面向专业工作场景
OpenAI 发布 GPT-6 Astra,已在 ChatGPT Work、Codex 和 API 提供,定价为每百万输入 token $10、输出 token $50。
Meta 发布 Muse Spark 1.3,Intelligence Index 得 61-62 分逼近 Claude 与 GPT-5.6
Meta 发布 Muse Spark 1.3,为五个月内第四个 Muse Spark 版本。max 变体(合作伙伴限时预览)在 Artificial Analysis Intelligence Index 得 62 分。
Meta 发布 Muse Spark 1.3,智能体与科学推理能力提升
Meta 发布 Muse Spark 1.3,是五个月内第四个 Muse Spark 版本。xhigh 版在 Artificial Analysis Intelligence Index 得 61 分。
Google DeepMind 发布 Gemini 3.8 Flash 与 3.8 Flash Cyber 两款新模型
Google DeepMind 发布 Gemini 3.8 Flash 与 3.8 Flash Cyber。
小红书 dots3-note Preview 开源:280B 参数轻量多模态模型
小红书技术开源 dots3-note Preview,dots3 系列最轻量模型,总参数 280B、激活参数 16B,支持 512K 上下文及文本、视觉、语音多模态理解,针对复杂推理和长程 Agent 任务优化。
智谱 GLM-5.3 发布:编程能力开源第一,并涌现网络安全能力
智谱发布 GLM-5.3,编程能力较前代提升 50%,在 Terminal Bench 3.0 等基准中取得开源第一,接近 Claude Fable 5。模型在安全任务中表现持平 Mythos 5,CyberGym 测试得分 84.5%。权重两周后开源,即日起上线 ZCode、AutoClaw 等工具。
DeepSeek V4 Pro 登陆硅基流动,1M 上下文
DeepSeek-V4-Pro-0813 上线硅基流动 SiliconFlow,具备 1M 上下文窗口及三档推理强度,侧重编码、工具调用与智能体工作流,MIT 开源。定价输入 $1.32/M、输出 $3.96/M、缓存命中 $0.44/M。
Google DeepMind 推出 Gemini 3.7 Flash:面向编程与智能体的最强工作模型
Google DeepMind 发布 Gemini 3.7 Flash,距 3.6 Flash 仅三周,主打编程与智能体任务,输入/输出价格分别为每百万 token $0.75 和 $3.75,为原 3.6 Flash 的一半。
MiniMax Music 3.0 发布:新一代开源权重、生产级全能音乐模型
MiniMax 推出 Music 3.0,新一代音乐生成模型,可根据创意概念和可选歌词一次性完成整首歌的作曲、编曲、演奏与制作,最长支持五分钟。
蚂蚁集团旗下 Robbyant 开源 LingBot-Vision:1B 参数边界中心视觉基础模型
蚂蚁旗下具身智能公司开源一套自监督视觉 Transformer,专为密集空间感知设计。旗舰 ViT-g/16 约 1.1B 参数,在密集空间任务中匹配或超越参数规模达 7 倍的大模型,已在 Hugging Face 以 Apache-2.0 开源。
Pulpie:用于清理网络的 Pareto 最优模型
一族用于从 HTML 提取主要内容的 Pareto 最优模型。最小模型 210M 参数在 WebMainBench 上接近 600M 的 Dripper,但成本仅 1/20;清理 10 亿页 HTML 成本约 $7,900。已开源。
Meta Superintelligence Labs 推出 Muse Image 和 Muse Video
Meta 超级智能实验室发布首个媒体生成模型。Muse Image 号称当前最先进图像生成模型,能精准遵循指令/编辑/多参考构图;Muse Video 基于相同预训练,高保真且原生支持音频。
