跳到正文

全部动态

今日 13 条
9月29日周二
  1. OpenAI:官网动态(RSS · 排除企业/客户案例)40

    OpenAI 扩大对 Lenfest Institute AI 奖学金计划的支持

    OpenAI 宣布向 Lenfest Institute 的 AI Collaborative and Fellowship Program 追加 500 万美元资金,并提供最高 500 万美元的软件额度和工程支持,使其支持规模较此前翻倍。该计划自 2024 年启动以来已向 11 家美国新闻机构派驻 AI 工程研究员,此次将邀请新一批新闻机构加入。

  2. Arena.ai69

    Arena 宣布 Anthropic 的 Claude Sonnet 5.5 已进入 Agent Arena,并开放投票。Agent Arena 基于全球用户数百万个真实的长程智能体任务评测模型,模型可使用 web search、filesystem 和 terminal 工具完成复杂工作流,榜单用因果追踪方法衡量模型相对平均模型的结果表现。

    推荐理由:Arena 介绍了其 Agent Arena 的评测方式,读者可以据此理解 Claude Sonnet 5.5 在真实智能体任务上的衡量口径。

  3. Claude:YouTube(RSS)67

    Anthropic 发布 Claude Sonnet 5.5,速度比 Sonnet 5 快超 30%

    Anthropic 发布 Claude Sonnet 5.5,运行速度比 Sonnet 5 快 30% 以上,写作更清晰,适合快速来回交互。定位上与为复杂判断工作打造的 Claude Opus 5.5 区分,Sonnet 5.5 擅长范围明确的日常任务、修复 bug 以及制作文档、幻灯片和表格。模型即日起全量可用,Claude Haiku 5.5 将在未来几周加入该系列。

  4. Claude:YouTube(RSS)65

    Anthropic 发布 Claude Sonnet 5.5,速度比 Sonnet 5 快逾 30%

    Anthropic 发布 Claude Sonnet 5.5,运行速度比 Sonnet 5 快超过 30%,写作更清晰,适合快速往复的日常任务。官方称其擅长修复 bug、制作文档、幻灯片和表格并有较强设计感,而 Claude Opus 5.5 面向需要谨慎判断的复杂工作;Sonnet 5.5 即日起全面可用,Claude Haiku 5.5 将在未来几周加入该系列。

  5. LlamaIndex:产品、工程与评测49

    LlamaParse 为什么表单解析比 VLM 更可靠?

    LlamaIndex 发文解释表单为何需要专用解析器:VLM 擅长通用推理,但表单解析结果并不会随推理增强而变好,且成本更高。LlamaParse 将表单表示为带 id、label、value 的字段与 section 嵌套 JSON 树,能保留复选框、签名及字段归属关系,避免扁平化后两个 "Date" 字段无法区分。

9月28日周一
  1. Databricks:Blog(RSS)38

    营销与数据工程最常误解的 24 个营销数据术语

    Databricks 博客梳理了营销与数据工程团队最常理解不一致的 24 个营销数据术语,围绕活动数据来源、客户身份、受众就绪、激活等五个实际问题展开。文章以“inactive customers”“real-time”等为例,说明同一术语在双方眼中的定义差异会直接影响构建内容、成本与上线时间,并建议在开工前先对齐含义。全部 24 个术语可通过可打印 PDF 获取。

  2. 公众号:腾讯元宝50

    腾讯元宝桌宠尝鲜版上线:Windows 与 macOS 升级 v2.87 即可开启

    腾讯元宝推出桌宠抢鲜版,Windows 与 macOS 用户将元宝 PC 端升级至 v2.87 及以上,点击左下角头像进入「我的桌宠」即可开启。该桌宠可实时盯长任务进度、以专属动画提醒完成,支持拖拽文件图片直接导入应用、快速抓取长文案网页重点,还会提醒久坐起身和喝水,拖到屏幕边缘自动吸边。目前正在灰度放量中。