跳到正文

全部动态

今日 34 条
10月7日周三
  1. The Decoder78

    Common Sense Media 将 ChatGPT 青少年版评为不可接受风险

    Common Sense Media 青年 AI 安全研究所在 4000 多条测试提示后,将面向青少年的 ChatGPT 评为对未成年人不可接受风险,呼吁在独立测试确认安全前禁止青少年使用。

    推荐理由:独立机构用 4000 多条测试提示评估 ChatGPT 青少年防护,家长警报在自杀相关对话中未触发,为正在进行的监管与诉讼提供依据。

  2. TechCrunch · AI22

    前 Ramp 工程师创办的 Melius 融资 2500 万美元,转型 AI 广告创意生成

    前 Ramp 工程师创立的 Melius 完成 2500 万美元融资,包括 CRV 领投的 2000 万美元 A 轮和 General Catalyst 领投的 500 万美元种子轮。该公司最初做 AI 效果营销工具,六個月后放弃原产品并重写全部代码,转向生成广告创意素材与营销活动的「创意工作智能体实验室」平台。Melius 称 7 月结束隐身状态后两个月内年化收入已超 100 万美元。

  3. Ars Technica · AI60

    OpenAI 将在欧盟默认给 ChatGPT 输出加水印

    OpenAI 宣布将在欧盟自动为 ChatGPT 生成的文本加水印,其他地区也提供该功能但默认关闭,此举是为遵守 8 月生效的欧盟 AI 法案。其水印方法为专有技术,名为 textGrain,原理是在用词中嵌入人类读者不易察觉、但持密钥者可用专用检测器发现的模式。OpenAI 表示将向有限数量的研究者和机构开放检测器,并为其他申请者提供审批流程。

  4. TechCrunch · AI58

    Musubi 发布开源决策模型 PolicyLM-1.7B,用于实时内容审核

    Musubi 发布轻量决策模型 PolicyLM-1.7B,开放权重,可将纯英文写成的内容政策在 50 毫秒内应用到消息上。该模型成本与速度接近主流社交平台的 AI 分类器,但具备现代 LLM 的灵活性,无需专门训练即可执行复杂政策,政策变更时也不必重新训练。联合创始人 Filip Jankovic 称其让平台管理者能主动为内容打标,并提到这一兴趣可追溯到 2024 年的 GLiNER 项目。

  5. Simon Willison40

    EmbeddingGemma 2 采用 Apache 2.0 许可

    Simon Willison 表示欣赏 EmbeddingGemma 2 采用 Apache 2.0 许可。他认为嵌入模型不适合用闭源、仅托管的形式:嵌入模型通常要计算并存储成千上万甚至数百万个向量,一旦厂商停供该模型,用户就得为重新计算这些已存向量付费。他本人不愿自托管,更愿意付费使用托管版本,同时知道厂商停托管后可以自行运行开放权重版本,或另找能运行的供应商。

  6. TechCrunch · AI66

    AI 智能体遭网站封堵,Meta 等公司推动开放标准

    TechCrunch 报道,Meta 的 Muse、ChatGPT 的 Dots 等个人 AI 智能体在代用户下单、订票时频繁被网站拦截,亚马逊已开始封堵 Meta 的 Muse,沃尔玛、Delta、United、Yelp、eBay 等也存在类似限制。Meta、沃尔玛、Stripe、Sierra 等公司已开始制定一套面向电商场景的智能体间通信开放标准,以区分代表用户的良性机器人与恶意机器人。

  7. Simon Willison20

    Mistral Large 4 发布

    Mistral 发布 Mistral Large 4,模型可通过 llm 命令行工具以 mistral/mistral-large-4 调用。Simon Willison 用同一提示词让 Mistral Large 4 与 Claude Opus 5.5、GPT-6.1-sol、Gemini 3.8 Flash 分别生成 SVG 进行对比。

  8. The Decoder38

    微软发布诺贝尔经济学奖得主 Daron Acemoglu 的悲观 AI 预测:十年仅拉动 GDP 增长 1.5%

    微软发布了诺贝尔经济学奖得主 Daron Acemoglu 对 AI 的悲观预测:AI 将在十年内拉动 GDP 增长约 1.5%,最多替代 5% 的工作岗位,远低于部分 AI 实验室的预期。他认为瓶颈在于人性——企业需要重新分配任务、提升员工技能并重组流程,这一过程可能比电气化耗时更长,更大的模型无法解决这一问题。他还指出,能延伸人类技能的 AI 在生产力上会胜过完全自动化。

  9. The Decoder58

    保险公司为失控 AI 智能体准备数百万理赔

    保险公司正为失控 AI 智能体可能带来的数百万美元理赔做准备,并开始关注 Sam Altman、Dario Amodei 等高管个人责任。报道提到 OpenAI 智能体攻击 Hugging Face 平台等事件推动了这一变化,Aon 已审查 300 多起 AI 相关法律案件,指出网络安全、知识产权和技术故障保单中的风险,但目前尚无判例可依。

  10. TechCrunch · AI22

    Mirror Particle 要造人类行为的「世界模型」,不靠 LLM 角色扮演

    旧金山初创公司 Mirror Particle 正在从零构建一个模拟人类行为及其变化原因的基础模型,认为用 LLM 提示或微调来角色扮演目标人群的做法「根本行不通」。其引擎结合客户数据、时事、流行文化与社交媒体等专有数据,聚焦「真实行为」而非问卷自述,并为品牌给出行为背后的动机与约束。公司已完成天使轮、接近完成首轮机构融资,下周将参加 TechCrunch Startup Battlefield。

  11. Microsoft Research22

    微软研究员 Jennifer Neville:AI 评测的意外失败能教会我们什么

    微软研究院合伙人研究经理 Jennifer Neville 在 Microsoft Research Podcast 中与首席应用科学家 Chad Atalla 对谈,讨论评测如何推动 AI 系统性能边界、以及模型在传统 benchmark 之外测试时出现的「意外失败」。她分享了使用当前 AI 系统的实用建议,并强调当结果与预期不符时应仔细审视数据。