#DeepSeek
#DeepSeek
今日 0 条
OpenRouter@OpenRouterAI 评分6565TechCrunch:AI(RSS)AI 评分6666 月之暗面(Moonshot AI)瞄准年底 20 亿美元年化营收
据 Bloomberg 报道,月之暗面(Moonshot AI)目标在年底达到 20 亿美元年化营收,是 8 月营收运行率的两倍,得益于今夏发布的 K3 模型。
IT之家(RSS)AI 评分6868 消息称月之暗面凭 Kimi K3 瞄准年底 20 亿美元年化收入,估值 500 亿美元融资
据彭博社报道,凭借 Kimi K3 模型的成功,月之暗面计划今年年底前将年化收入提高数倍至 20 亿美元(约合 134.56 亿元人民币)。知情人士称公司 8 月年度经常性收入已突破 10 亿美元,较 6 月的 3 亿美元大幅增长,7 月发布的 Kimi K3 推动了这一增长。公司正以 500 亿美元估值融资,最快可能今年赴港上市,并与微软、亚马逊和谷歌洽谈 30% 的收入分成。
公众号:卡尔的AI沃茨精选AI 评分7676 实测 DeepSeek V4.1 Flash:价格大降、原生带视觉,作者用游戏与城市生成任务验证表现
作者实测 DeepSeek V4.1 Flash,缓存命中输入降价 7 倍多、输出砍三分之二,9 月 14 日中午 12 点起所有发往 v4-pro 的请求将被强制路由到 4.1 Flash 并按其低价计费。
推荐理由:作者实测 DeepSeek V4.1 Flash 的价格、架构参数和多个生成任务,并给出与 GLM 5.3 Flash 的对比结果和暴露的缺陷。
Rohan Paul@rohanpaul_aiAI 评分6969Anthropic 发布 2026 年 9 月滥用检测报告,称已拦截旨在增强病毒危险性的请求,并描述了 5 起生物滥用案例,涉及禽流感研究和一份来自军方研究机构的基孔肯雅热资助申请书。
Artificial Analysis@ArtificialAnlysAI 评分7878
Yuchen Jin@Yuchenj_UWAI 评分6565
WorkBuddy@WorkBuddy_AI精选AI 评分7070推荐理由:WorkBuddy 官宣上线 DeepSeek V4.1-Flash 并给出两周免费入口,引用内容还说明了 V4-Pro 的退役与迁移安排。
elvis@omarsar0AI 评分6666
SiliconFlow@SiliconFlowAIAI 评分6767The Decoder:AI News(RSS)AI 评分8080 DeepSeek 发布 V4.1-Flash,大幅降低 AI Agent 的 KV cache 内存需求
DeepSeek 发布多模态模型 V4.1-Flash,以 MIT 许可开源在 Hugging Face,目标是大幅压缩 KV cache 和长上下文处理成本。
SemiAnalysis@SemiAnalysis_AI 评分6868IT之家(RSS)AI 评分5959 DeepSeek V4.1 Flash 模型上线国家超算互联网
DeepSeek V4.1 Flash 模型 9 月 10 日上线国家超算互联网中心,用户可在官网「模型服务」页面调用其 API。该模型为 552B 参数 MoE 模型,采用 Causal-Encoder-Decoder 结构,输入激活 8B、输出激活 16B;基准测试中超越了包括 DeepSeek V4 Pro 在内的旗舰模型。
Thomas Wolf@Thom_WolfAI 评分6868
X.PIN@thexpinAI 评分5858
Thomas Wolf@Thom_WolfAI 评分7474DeepSeek 发布 DeepSeek-V4.1-Flash,称其为新架构家族中最小模型,具备原生视觉理解,面向更快推理、更高吞吐和扩展到更大模型而设计。
MarkTechPost(RSS)精选AI 评分8787 DeepSeek AI 发布 DeepSeek-V4.1-Flash:1M 上下文、FP4 KV 缓存与跨层注意力复用
DeepSeek AI 发布多模态 MoE 模型 DeepSeek-V4.1-Flash,552B 主干加 196B Engram 参数,上下文窗口 1M,prefill 激活 8B 参数、decode 激活 16B,全局 KV 缓存降至每 token 890 字节,约为 DeepSeek-V4-Flash 的 1/4、DeepSeek-V1 的 1/437。
推荐理由:文章拆解了 KV 缓存压缩和预精简架构的具体做法,读者可以对照其工程路径评估长上下文部署成本。
Aravind Srinivas@AravSrinivasAI 评分6161
🚨 AI News | TestingCatalog@testingcatalogAI 评分7676IT之家(RSS)AI 评分6060 DeepSeek Harness 0.1.5 更新:适配 DeepSeek V4.1 Flash 模型,新增文件上传与侧边栏预览功能
DeepSeek Harness v0.1.5 发布,针对 DeepSeek V4.1 Flash 模型专项训练适配,覆盖标准、程序化工具调用(PTC)和极简模式,并支持保留 KV Cache 更新系统提示词。
IT之家(RSS)AI 评分8686 DeepSeek 发布 V4.1 Flash 模型,基准超越 V4 Pro 并下调 API 定价
深度求索正式发布 DeepSeek V4.1 Flash,为 552B 参数 MoE 模型,采用全新 Causal-Encoder-Decoder 结构,原生支持多模态,基准测试超越包括 DeepSeek V4 Pro 在内的旗舰模型。
DeepSeek:API 更新日志精选AI 评分8080 DeepSeek 发布 V4.1-Flash,API 价格同步下调
DeepSeek 发布 DeepSeek-V4.1-Flash,是全新模型结构系列中最小尺寸的模型,具备原生多模态视觉理解能力,评测包括 GPQA Diamond 90.9、HLE 36.8、Codeforces Rating 3471、Terminal-Bench 2.1 90.6 等。
推荐理由:官方发布附带完整评测数字和 API 切换细节,读者可据此判断新模型能力水平及旧模型下线对现有调用和计费的影响。
公众号:DeepSeek(深度求索)AI 评分8686 DeepSeek 发布 V4.1 Flash:552B MoE 多模态模型,同步开源并下调 API 定价
DeepSeek 正式发布 V4.1 Flash,全新 Causal-Encoder-Decoder 结构的 552B 参数 MoE 模型,输入激活 8B、输出激活 16B,具备原生多模态视觉理解,基准测试超越包括 DeepSeek V4 Pro 在内的旗舰模型。
IT之家(RSS)AI 评分6868 DeepSeek 发布 V4.1 Flash 模型,V4 Pro 服务推迟至 9 月 14 日下线
DeepSeek 于北京时间 2026 年 9 月 10 日正式发布 V4.1 Flash 模型并执行新的 Flash 定价,V4 Pro 服务推迟至 9 月 14 日 12:00 下线,届时将路由到 V4.1 Flash 并按其计费。
IT之家(RSS)AI 评分6969 DeepSeek 合并快速、专家、识图模式为统一智能模式,V4.1 Flash 最快今日发布
DeepSeek 宣布将快速模式、专家模式和识图模式合并为统一的智能模式,模型可自动检测查询复杂度、在检测到图片输入时激活视觉能力并按任务难度调整处理能力。
Ars Technica:AI(RSS)AI 评分7979 NSA、CISA 与 FBI 指控 DeepSeek 等六家中国 AI 公司大规模蒸馏美国前沿模型
NSA、CISA 和 FBI 联合指控 DeepSeek、Moonshot AI、阿里巴巴、MiniMax、StepFun 和 Z.AI 至少自 2024 年底起对美国模型开展工业级蒸馏攻击,涉及 Claude、GPT、Gemini 和 Grok 的多个变体。机构称这些公司可能在“中国政府知情”下行动,借此缩短研发周期、减少训练前沿模型的成本。
DeepSeek 官方精选AI 评分8282 DeepSeek V4.1 Flash 发布,视觉理解进入默认 Flash API
DeepSeek 发布 V4.1 Flash,在新架构下加入原生视觉理解,并通过 deepseek-flash 接口提供。旧版 V4 Flash 与视觉实验版已退役,原名称暂时指向新版;公告还宣布下调 API 价格。本次发布没有提供可核实的权重开放信息。
推荐理由:原生视觉进入默认 Flash 接口,同时发生旧模型映射调整,使用方需要重新检查模型选择与多模态任务表现。
karminski-牙医@karminski3AI 评分5555Hacker News 热门(buzzing.cc 中文翻译)AI 评分7474 DeepSeek 将于9月10日发布 V4.1 Flash,性能超越 V4 Pro 且价格更低
DeepSeek 计划于北京时间2026年9月10日左右正式发布 V4.1 Flash,官方称其在性能、成本、速度和任务完成时间等关键指标上全面超越 V4 Pro。
X.PIN@thexpinAI 评分8282
Rohan Paul@rohanpaul_ai精选AI 评分8282NSA、CISA 和 FBI 发布联合公告 AA26-251A,指控 DeepSeek、月之暗面、阿里、MiniMax、阶跃星辰和 Z .AI 自 2024 年底起对美国前沿模型进行工业规模蒸馏。
推荐理由:原文梳理了联合公告的指控手法与缓解建议,并指出检测指标可能误伤普通企业 Agent 流量。
IT之家(RSS)AI 评分5656 DeepSeek 计划 9 月 10 日前后发布 V4.1 Flash,各项指标全面超越 V4 Pro
DeepSeek 开放平台发布通知,计划于北京时间 2026 年 9 月 10 日前后正式发布 V4.1 Flash 模型,官方称经内外部多方测试,其在性能、费用、速度、总用时等指标上全面超越 V4 Pro。
IT之家(RSS)精选AI 评分7878 曝 DeepSeek 聘请中信证券筹备科创板 IPO,目标年内递交申请
路透社报道称,DeepSeek 已聘请中信证券筹备科创板上市,目标今年递交 IPO 申请、明年挂牌,募资将用于算力基建、模型研发、芯片自研与人才激励。公司正推进新一轮融资,目标估值约 5000 亿元人民币,此前 6 月完成约 74 亿美元首轮外部融资,投后估值超 500 亿美元;2026 年前 7 个月营收约 4.75 亿元。
推荐理由:综合路透与金融时报报道,梳理了 DeepSeek 的 IPO 筹备、融资结构与场外份额乱象,可帮助读者了解其资本化进程的全貌。
IT之家(RSS)AI 评分6767 DeepSeek 宣布 9 月 10 日起 Flash 系列降价,输出每百万 Token 4 元
DeepSeek 开放平台公告,北京时间 2026 年 9 月 10 日 12 时起调整 Flash 系列定价。空闲时段输入缓存命中每百万 Token 0.02 元(降幅 60%)、缓存未命中 1 元(降幅 33.33%)、输出 4 元(降幅 11.11%),高峰时段价格均为空闲时段的两倍。
Tianyi Cui@tianyiAI 评分5252
X.PIN@thexpinAI 评分5454IT之家(RSS)AI 评分5757 DeepSeek V4.1 Flash 中间版本开启内测,采用新模型结构并原生支持多模态
DeepSeek 今日在官方交流群通知 DeepSeek V4.1 Flash 中间版本开启内测,采用新模型结构,原生多模态支持,能力更强、速度更快、成本更低。
X.PIN@thexpinAI 评分5959文章分析内蒙古乌兰察布为何成为中国增长最快的 AI 算力集群之一,核心论点是中国把电力而非芯片视为 AI 竞赛的关键约束,将发电作为数据中心本身的一部分来建设。
Rohan Paul@rohanpaul_aiAI 评分7171据 Bloomberg 报道,DeepSeek 计划在内蒙古吉瓦级数据中心部署 16 万颗华为 950DT 芯片,建成后将是已知最大规模的华为 AI 集群之一。