跳到正文

全部动态

今日 23 条
9月24日周四
  1. OpenAI72

    OpenAI 宣布 ChatGPT Voice 更新,即日起在最新版应用全球推送。语音功能现可使用邮件、日历和 Slack 等插件,并由 GPT-6 Astra、Sol 和 Luna 模型驱动。同时语音可在网页和移动端的 ChatGPT Work 中使用,仅通过说话即可在浏览器中创建文档、演示文稿、网站和表格,或处理复杂任务。

    推荐理由:官方宣布 ChatGPT Voice 接入插件和新模型并支持语音驱动工作流,读者可据此了解语音能力扩展到哪些日常任务。

  2. TechCrunch:AI(RSS)58

    OpenAI 在 ChatGPT 移动端推出语音触发的智能体功能

    OpenAI 宣布为 ChatGPT 移动端带来语音触发的智能体功能,用户可用语音让模型起草文档、总结邮件等。Plus 和 Pro 用户可在手机 Work 标签页创建文档、草拟邮件、总结 Slack 消息,还能建站、做演示文稿、使用云端浏览器和财务功能;Free 和 Go 用户可使用插件和已连接应用。

  3. Google Developers Blog(RSS)60

    Antigravity SDK 支持本地模型,首发 Gemma 4 26B A4B 配合 LiteRT

    Google 宣布 Antigravity SDK 支持本地工作流,首发支持通过 Google AI Edge 的 LiteRT 运行 Gemma 4 26B A4B,可完全离线获得智能体辅助能力,建议机器配备超过 24GB VRAM 或统一内存。

    推荐理由:官方给出完整的本地模型接入步骤和混合编排示例,开发者可以直接照此把智能体工作流搬到离线环境。

  4. Google DeepMind:Blog(RSS)54

    Google DeepMind 为 Private AI Compute 增加安全的服务端持久记忆

    Google DeepMind 宣布将为 Private AI Compute 平台引入私密的服务端持久记忆,使 AI 助手能跨设备长期保留上下文。数据密封在云端专用加密存储中,解密密钥仅保存在用户设备上,请求通过端到端加密通道在隔离的安全飞区中临时解密处理,即使 Google 也无法访问。

  5. Google DeepMind64

    Gemini Live Avatar 上线企业入口,生成同步说话的视频形象

    谷歌将实时视频形象加入 Gemini 3.8 Live,企业可构建带口型、表情和语音同步的对话角色,并在后台调用工具。服务支持多语言和预设形象;从参考图片定制形象需要企业白名单,音视频输出带有 SynthID 水印。

    推荐理由:实时形象与工具调用结合,让企业对话界面可以表达表情和口型,公开的准入条件便于评估实际接入范围。

9月23日周三
  1. vLLM 官方博客(RSS)74

    vLLM 发布 vllm-metal v0.28.0:在 Apple Silicon 上支持并发推理服务

    vLLM 官方发布 vllm-metal v0.28.0,把 vLLM 的 V1 调度器、paged KV cache 和 OpenAI 兼容服务器带到 Apple Silicon,由 MLX 和 Metal 执行模型,版本号与上游 vLLM 对齐。

    推荐理由:官方首次发布 vllm-metal,用 packed varlen attention 和 paged KV 解决 Mac 上并发请求的服务问题,并给出可复现的并发基准数据。