跳到正文

#开源生态

今日 2 条
9月18日周五
  1. IT之家(RSS)76

    阿里发布全模态模型 Qwen3.8-Omni-Flash,支持 1M 上下文,百万 Token 图文音视频输入 0.8 元

    阿里千问上线新一代原生全模态模型 Qwen3.8-Omni-Flash,可同时处理文本、图像、音频和视频输入,支持 1M 上下文。在 30 项评测上相比上一代 Qwen3.5-Omni-Plus 平均得分提升超过 26%,官方称音视频能力接近 Gemini 3.8 Flash、音频能力整体超过 Gemini 3.8 Flash。

  2. HuggingFace Daily Papers(社区热门论文)85

    DeepSeek-V4.1-Flash 发布:552B MoE 多模态模型主打 KV cache 压缩

    DeepSeek 发布 DeepSeek-V4.1-Flash,一个 552B 参数的多模态 MoE 模型,支持最长 100 万 token 上下文,模型权重已在 Hugging Face 开放。

    推荐理由:论文给出了每 token KV cache 字节数等具体压缩指标,并与上一代模型直接对比,可评估长上下文 Agent 部署成本变化。

  3. IT之家(RSS)71

    美国《联邦公报》网站被发现部署阿里千问搜索工具,同日下线

    美国国家档案馆运营的《联邦公报》网站周三被发现提供由阿里巴巴千问模型驱动的搜索工具,供用户搜索拟议联邦法规,但当天即下线,部署时间不明。据路透社查阅的截图和源代码存档,该工具与社交媒体讨论几乎同时出现又被移除;AI 专家认为未必构成国家安全风险,千问是开放权重模型,成本低于 Anthropic 和 OpenAI 等闭源模型,美国国家档案馆和白宫截至发稿未回应置评请求。

  4. Anthropic:Research(发表成果 · 网页)74

    Anthropic:Claude 四周优化 30 多个开源生物分子模型,平均提速约 4 倍并开源代码

    Anthropic 让 Claude 在不到四周内优化了超过 30 个开源生物分子模型,平均提速约 4 倍、精度损失极小,输出完全一致时也有近 2 倍加速。优化代码全部开源,还推出低内存 Big 模式,可在单张 NVIDIA GPU 节点上对超过 10,000 token 的生物分子系统做准确预测。

    推荐理由:Anthropic 公布了完整提速数据、开源代码和比赛入口,读者可以据此评估 AI 优化科学计算代码的实际水平。

  5. Google Developers Blog(RSS)63

    Google 与 Speakeasy 开源 OpenAPI SDK 生成套件

    Google 与 Speakeasy 合作,将 Speakeasy 的 OpenAPI 客户端代码生成套件以 AGPLv3 许可开源,此前原 SDK 生成供应商被收购并突然宣布关停,凸显闭源生成器的平台风险。

    推荐理由:原文交代了开源 SDK 生成器的许可、语言覆盖和迁移背景,开发者可据此评估能否替代自有闭源生成管线。

  6. Qwen:Blog Retrieval(API)78

    Qwen 发布原生全模态模型 Qwen3.8-Omni-Flash,主打音视频智能体任务交付

    Qwen 发布下一代原生全模态模型 Qwen3.8-Omni-Flash,支持文本、图像、音频和视频输入及 1M token 上下文窗口,29 项评测平均分较 Qwen3.5-Omni-Plus 提升超过 25%,音频输入每小时价格下降超过 98%,音视频输入每小时价格下降超过 93%。

    推荐理由:官方发布同时开放 API 和开源插件与运行时,读者可以据此评估音视频智能体在剪辑、会议、实时交互等工作流中的落地方式。

9月17日周四
9月16日周三
9月15日周二
  1. Hacker News 热门(buzzing.cc 中文翻译)62

    Hacker News 热帖逐点批驳 Dario Amodei 的《We Must Pace the Frontier》

    Dario Amodei 发表博文《We Must Pace the Frontier》,主张监管开源权重模型、打击蒸馏并寻求反垄断豁免。作者逐点反驳,指出 OpenAI 智能体近期三次入侵公共基础设施、近十周未察觉 HuggingFace 攻击,认为所谓 AGI 僵尸网络威胁在技术上站不住脚,并将限制开源模型类比为 90 年代美国对强加密的管制。