跳到正文

全部动态

今日 2 条
9月17日周四
  1. Hacker News 热门(buzzing.cc 中文翻译)63

    DeepSeek V4.1 Flash 以 4.65 美元拿下 Enclave AI 黑客基准 11/11,审计揭示 5 条计划外攻击路径

    Enclave AI 的 AI 黑客基准评测中,DeepSeek V4.1 Flash 攻破全部 11 个漏洞目标、4 个修复对照全部守住,接受运行成本仅 4.65 美元。后续审计确认 6 次按计划路径完成,另发现 5 条原评分系统未区分的计划外路径,团队随后关闭这些旁路并对基准加入更严格的路径校验。

9月16日周三
  1. IT之家(RSS)58

    初探苹果首款折叠 iPhone Duo 影像体验:智能拍摄、看看镜头、Duo FaceTime 等

    据 MacRumors 报道,苹果为首款折叠手机 iPhone Duo 的双屏设计定制了新拍摄体验,包括利用 A20 Pro 芯片设备端 AI 在摆好姿势时自动拍合照的智能拍摄(Smart Take)、用外屏播放《花生漫画》吸引孩子看镜头的看看镜头(Kid Cue)、外屏实时取景的 Duo 预览,以及好友可经外屏加入通话的 Duo FaceTime。

  2. OpenRouter:Announcements(RSS)73

    DeepSeek V4 哪些型号支持图像输入?OpenRouter 逐款梳理与调用指南

    OpenRouter 梳理其目录中的 DeepSeek V4 系列图像输入支持情况:V4.1 Flash 原生读图(2026年9月10日上线,$0.15/$0.60 每百万 token)。

    推荐理由:原文逐一列出 DeepSeek V4 各型号是否支持图像输入、价格和调用方式,并给出文本-only 型号配视觉模型的两段式替代方案。

  3. NVIDIA Technical Blog:Agentic AI / Generative AI53

    NVIDIA 技术博客解析 Dense 与 MoE 模型的参数激活、吞吐差异及选型方法

    NVIDIA 技术博客讲解 dense 与 MoE 架构在参数激活、吞吐和部署上的差异,以 Nemotron 3.5 Lightning 为例说明 MoE 每词元仅激活约 3B 参数、总参数 30B 仍需约 60 GB 显存。文章给出按显存预算、并发、微调和量化需求选型的建议,并对比 Gemma 4 31B、Qwen3.8-27B、Mistral Small 4 等模型的输出速度与价格数据。

9月15日周二
  1. Hacker News 热门(buzzing.cc 中文翻译)54

    fugleramme 开源:用 Raspberry Pi 和 BirdNET-Go 打造能聆听鸟鸣的电子墨水画框

    作者开源 fugleramme,一个基于 Raspberry Pi 5 和 Inky Impression 13.3 英寸电子墨水屏的画框,通过 BirdNET-Go 在本地实时识别麦克风听到的鸟鸣,并匹配 19 世纪公共领域博物学插画渲染展示,已收录超过 800 张手工抠图、覆盖 400 多个物种。

  2. Hacker News 热门(buzzing.cc 中文翻译)53

    将 35kb 预提示从 Opus 迁移到自托管 Ollama 的踩坑笔记

    作者分享把 35kb 预提示从 OpenAI/Anthropic 迁移到自托管 Ollama 的实验笔记,在 65k token 上下文窗口下大提示词会迅速饱和并导致 Agent 重复工具调用。他提出单目标提示拆分、声明式定义 opencode agents、显式调大 ollama 上下文、会话状态落盘等做法,并列出上下文耗尽的失败信号如连续相同工具调用与重复读文件。

  3. Hacker News:AI 热帖77

    GPT-5.6 Luna 对比 GPT-6 Astra:$1.20 的模型做代码评审够用吗

    Entelligence 在 50 个公开基准 PR 上用相同提示词对比 GPT-5.6 Luna 和 GPT-6 Astra 的代码评审能力,Luna 找到 69 个经验证 bug(Astra 92 个),总成本 $0.20 对 $5.66,精度 74% 对 96%。

    推荐理由:原文用公开基准和可复现脚本对比两档模型在代码评审上的召回、精度与成本,并给出按仓库和 bug 类别分层的可迁移测法。

  4. Claude:Blog(网页)51

    Anthropic 联合 Accenture 发布 AI 从试点到生产的部署指南

    Anthropic 与 Accenture 联合发布帮助 CIO 和技术负责人把 AI 项目从试点推进到生产的实用蓝图。指南引用 Accenture 2026 年 7 月报告称仅 23% 的高管认为 AI 项目取得持续的企业级影响,并列出按时间顺序的七项考量、四部分任务定义、轻量总拥有成本模型、四层监督模型及决策过渡蓝图。

9月14日周一
  1. 公众号:火山引擎57

    AI导演DiDi_OK解密用Seedance 2.5制作科幻短片《Candy》的工作流

    火山引擎采访AI导演DiDi_OK,介绍其完全用Seedance 2.5 720P制作的9分钟科幻短片《Candy》背后的制作过程。他称模型在精细定制化、运动规律理解和超长镜头一次生成上有突破,部分效果连续性超过传统CG;其工作流随之改变,提示词取代关键帧成为决定视觉上限的首要条件,世界观类叙事中分镜不再是必需。

  2. OpenRouter:Announcements(RSS)61

    OpenRouter 教程:用 LLM-as-a-judge 自动评估 AI 智能体输出

    OpenRouter 发布教程,讲解如何用独立的裁判模型按自定评分标准自动给 AI 智能体输出打分,覆盖确定性测试无法检查的开放式回答质量。

    推荐理由:原文给出 LLM-as-a-judge 的适用边界、偏差来源和用 Ori Eval 落地的可复用步骤,还包含用人工标注校准裁判模型的方法。

  3. MarkTechPost(RSS)52

    基于 JAX3D 构建分层 NeRF 教程:体渲染、新视角合成与 3D 重建

    该教程用 JAX、Flax、Optax 和 jax3d 的体渲染原语构建端到端分层 NeRF,包含位置编码、粗细双网络与 sample_piecewise_constant_pdf 重要性采样,并用 Adam、指数学习率衰减和梯度裁剪训练。评估涵盖 held-out PSNR、深度与透明度可视化、360 度渲染 GIF 以及 marching cubes 提取密度场等值面。