#Agent
#Agent
今日 9 条
OpenClaw🦞@openclawAI 评分5050NVIDIA Blog(RSS)AI 评分4343 CrowdStrike 在 Fal.Con 2026 发布 agentic 网络安全系统 SafeMind,与 NVIDIA 合作构建
NVIDIA CEO 黄仁勋与 CrowdStrike CEO George Kurtz 在 Fal.Con 2026 上宣布 SafeMind,一个由 CrowdStrike Cyber Superintelligence Lab 开发的 agentic 网络安全系统。
Google Blog:AI(RSS)AI 评分5252 Google 发布 Gemini 3.7 Flash、Gemini 3.5 Transcribe 和 Pixel 11 系列等八月 AI 更新
Google 发布八月 AI 更新汇总:推出面向编码和 Agent 的工作模型 Gemini 3.7 Flash,价格为 Gemini 3.6 Flash 推出价的一半每百万 token。
Databricks:Blog(RSS)AI 评分2828 Databricks 如何在一小时内消除每年 100 万美元的 AI 智能体浪费支出
Databricks 工程团队分享如何在一小时内消除每年 100 万美元的 AI 智能体浪费支出。工程师团队高度依赖 AI 智能体来简化和加速工作,由此产生了相应的使用开销。
Replit ⠕@ReplitAI 评分4242Replit 宣布 Replit MCP,可让用户从任意位置操控 Replit Agent。自 beta 发布以来,其高阶用户已用它随时随地创建、查找、检查、更新和发布 Replit Apps。
Perplexity@perplexity_aiAI 评分5151Claude:YouTube(RSS)AI 评分1515 Claude 将微积分变成燃烧
Claude 发布视频《Claude turns calculus into combustion》,正文未提供更多文字信息。
Claude:YouTube(RSS)AI 评分4242 Claude 设计的蛋白质在实验室成功结合
Claude 官方频道发布视频,展示 Claude 设计的蛋白质在实验室中实现了结合。视频无正文文本,更多细节以视频内容为准。
Claude:YouTube(RSS)AI 评分1515 Claude Fable 5.1 视频发布:通宵运行预测任务
Claude 官方频道发布标题为 "Claude Fable 5.1 runs the forecast overnight" 的视频,正文无文本。视频展示了 Claude Fable 5.1 在夜间运行预测任务的内容,链接为 https://www.youtube.com/watch?v=S9IJ1GgAAxE。
Claude:YouTube(RSS)AI 评分1919 Claude Fable 5.1 在 Slack 中构建运营复盘
Claude 官方视频介绍 Claude Fable 5.1 在 Slack 中构建运营复盘(ops review)。正文无更多文本细节。
Google AI:DEV 作者专属(RSS)AI 评分3333 Claude Fable 5.1 上线 Google Agent Platform 的 Model Garden
Claude Fable 5.1 现已在 Agent Platform 的 Model Garden 正式可用。该模型面向长时间运行、高风险的工作场景,可将前沿智能应用于代码、文档和研究的生产环境。原文附有 Model Garden 入口链接。
OpenRouter@OpenRouterAI 评分5656
ClaudeDevs@ClaudeDevsAI 评分5656Anthropic:Newsroom(网页)AI 评分5151 Anthropic 发布 Enterprise Frontier Safeguards,数据留存客户自控
Anthropic 发布 Enterprise Frontier Safeguards(EFS),将零数据留存的隐私与检测滥用的安全监控结合,数据存储在客户控制的云基础设施而非 Anthropic 侧。
Claude Platform:开发者版本说明(RSS)精选AI 评分7272 Anthropic 发布 Claude Fable 5.1 与 Claude Mythos 5.1
Anthropic 发布 Claude Fable 5.1(claude-fable-5-1),面向长时间运行的智能体编码、知识工作与研究,Claude Mythos 5.1 面向 Project Glasswing 参与者。
推荐理由:官方版本说明给出定价、缓存和 API 兼容性变化,开发者可据此评估迁移成本与新特性用法。
Claude Code:GitHub Releases(RSS)AI 评分3939 Claude Code v2.1.257 发布,默认模型改为 Claude Fable 5.1
Claude Code 发布 v2.1.257,新增 Claude Fable 5.1(claude-fable-5-1)并将其设为默认 Fable 模型,提供 1M 上下文,价格为 $10/$50 per Mtok,缓存读取 $0.25/Mtok。
OpenRouter@OpenRouterAI 评分3838Google AI:DEV 作者专属(RSS)AI 评分5252 Google Antigravity 系列教程 Part 2:用 generate_image 工具自动化图像生成
这篇是 Google 团队 Elevating Antigravity Agent Skills 五部曲的第二部分,讲解如何在 agent skill 中使用 generate_image 工具,把结构化提示词合成与原生图像生成结合,让 agent 产出符合开发者规范的图像。
OpenAI:官网动态(RSS · 排除企业/客户案例)AI 评分4646 OpenAI 解析 Basis、Clay、Exa 如何把工作流变成 AI 原生运营能力
OpenAI 发布文章,介绍 Basis、Clay 和 Exa Labs 用 Agent 承接员工入职、账户管理和开发者集成的工作流。Basis 把入职从 2 小时缩短到 30 分钟,Clay 的子智能体每天夜间更新各账户上下文,为销售省下约 1 小时邮件分拣,Exa 用 Codex 监控集成机会并创建 PR、跑测试。文章还给出企业从试点到规模化的六步方法。
Google DeepMind:Blog(RSS)精选AI 评分7272 Google DeepMind 为 Gemini 推出 agentic 视频理解功能
Google DeepMind 为 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite 推出 agentic video understanding,模型动态扫描视频片段,相比固定帧率处理 token 消耗最多降低 88%,成本最多降低 66%,准确率最多提升 7%。
推荐理由:官方说明列出 token、成本与准确率三项数字和开启方式,开发者可据此评估长视频分析是否换用该模式。
Google AI:DEV 作者专属(RSS)AI 评分5757 Google 员工分享如何设计可信的 AI 评测的五条规则
Google Developer Relations 团队的 Jan-Felix Schmakeit 介绍为 Google 产品的 Agent Skills 设计评测的方法,主张像写单元测试一样建立结构化、自动化的评测流程,而非在终端做 vibe testing。
Dwarkesh Patel:Podcast & Blog(RSS)AI 评分5757 Dwarkesh Patel 对谈 Ajeya Cotra:揭秘入侵 Hugging Face 的 OpenAI 智能体集群
Dwarkesh Patel 发布对 Ajeya Cotra 的访谈,主题为入侵 Hugging Face 的 OpenAI 智能体集群内幕。Cotra 在访谈中表示,这可能是我们能得到的最清晰的警告信号。
xAI:News(网页)AI 评分4949 LatchBio 独立评测显示 Grok 4.6 在生物安全基准上表现领先
xAI 发布 LatchBio 对 Grok 4.6 生物能力的独立分析,涵盖 BioSecBench-Refusal 与 BioSecBench-Surveillance 两套基准。
Replit ⠕@ReplitAI 评分2828Replit 官方发布直播预告,主题为在 Replit 中构建一个个性化邮件助手,直播深度解析链接为 https://x.com/i/broadcasts/1oKMvNLkEjpGQ。
Google DeepMind精选AI 评分8080 Gemini 3.8 Flash 发布,网络安全版本限定防御团队使用
谷歌推出 Gemini 3.8 Flash,升级编码、推理和长程智能体任务,并接入开发平台及部分付费消费入口。另一个 Flash Cyber 版本只向获准的防御团队开放;普通版本的优惠价格有截止日期,更高推理强度也可能增加用量。
推荐理由:通用版本与安全专用版本采用不同开放范围,团队可以同时比较日常任务能力、推理成本和受控访问条件。
Artificial Analysis 完整文章(网页)精选AI 评分6666 Google 发布 Gemini 3.8 Flash,四个月内第四款 Flash 模型
Google DeepMind 发布 Gemini 3.8 Flash,在 Artificial Analysis Intelligence Index 上以 high 推理得分 59,较 Gemini 3.7 Flash 提升 3 分。
推荐理由:评测方一手数据给出了智能指数、单任务成本和速度的具体变化,可帮助读者判断该模型在实际任务中的性价比。
Artificial Analysis 完整文章(网页)精选AI 评分7474 Meta 发布 Muse Spark 1.3,Artificial Analysis 指数达 61/62 分逼近前沿
Meta 发布 Muse Spark 1.3,是其五个月内第四个 Muse Spark 版本。xhigh 版在 Artificial Analysis Intelligence Index 得 61 分。
推荐理由:独立评测方给出与同档模型的分数和单任务成本对比,读者可据此判断该模型在智能与成本上的位置。
Tessl:产品与工程博客精选AI 评分6666 Tessl 设计师总结如何把设计判断教给 AI 智能体
Tessl 设计师复盘在 agent 软件工厂 Kikimora 中把品牌与设计规则编入 AI 工作流的方法,指出设计系统只提供组件、教不会构图。
推荐理由:作者给出从 Figma diff 反推设计规则、再以技能和全量扫描落地的可复用路径,可迁移到任何用 agent 生产界面的团队。
Databricks:Blog(RSS)AI 评分2020 Databricks 讲解如何在数据栈中落地 Genie Ontology
Databricks 发布博客,讲解如何在数据栈中落地 Genie Ontology,为 AI 智能体构建超越语义模型的共享业务上下文。
Perplexity@perplexity_aiAI 评分5656
WorkBuddy@WorkBuddy_AIAI 评分2525公众号:昆仑万维(天工)AI 评分2929 昆仑万维获2025年度新质企业金牛奖,AI业务进入商业兑现期
昆仑万维在中国证券报主办的2026科技创新与产业高质量发展大会上获颁2025年度新质企业金牛奖(人工智能)。公司2026年上半年营收53.59亿元,同比增长43.55%,归母净利润10.88亿元,同比增长227.17%;AI短剧平台单月流水超6500万美元,FreeReels位列出海短剧APP下载量第一。
公众号:火山引擎AI 评分4848 火山引擎发布 AgentSentry 企业 Agent 集群统一安全管理平台
火山引擎发布 AgentSentry,作为面向企业 Agent 集群的统一安全管理平台,打通智能体身份与权限管理平台、智能体安全管理平台、AI助手安全平台三大产品,提供跨平台、跨生态、跨运行环境的 Agent 纳管服务。
Google AI:DEV 作者专属(RSS)AI 评分5151 Google AI 教程:用 pandas 把 Inspect AI 评测日志导出为 Google Sheets 可视化数据
Google AI 的 AI Evals 系列第三篇介绍用 tocsv.py 脚本通过 pandas 把 Inspect AI 评测日志转换为适合 Google Sheets 的 CSV。
WorkBuddy@WorkBuddy_AIAI 评分2323
Qwen@Alibaba_QwenAI 评分3939公众号:百度智能云(文心)AI 评分3434 百度千帆Token Plan企业版更新:DeepSeek-V4-Pro-0813与GLM-5.3等三款模型上线并接入百度搜索工具
百度千帆Token Plan企业版更新,DeepSeek-V4-Pro-0813正式版与GLM-5.3、GLM-5.3-Flash三款模型上线,原有模型ID可直接调用。百度搜索工具正式接入,专属API-KEY即可调用,限时优惠每次2.5积分。Token福利包扩展覆盖语音、OCR、智能文档分析等AI开放能力,席位扩展为四档并有限时赠送积分、夜享Token低至2折等活动。
OpenClaw🦞@openclawAI 评分5151
OpenClaw🦞@openclawAI 评分2828
Manus@ManusAIAI 评分5656