跳到正文

内容形态

工具与数据 最新动态

工具与数据材料及其证据、限制与使用方法。

27 条精选近 30 天 16 条共收录 67 条

订阅此主题 RSS 更新

精选归档 · 第 2 页

6月12日周五第 21–27 条
5月13日周三
  1. PennyLane Releases

    PennyLane 0.45.0 发布量子算法开发工具更新

    PennyLane 0.45.0 发布,新增 SumOfSlatersPrep 稀疏态制备、QSVT 角度求解器和资源估计模板,并提供图分解规则及路径检查工具。该版本还增强 qjit 工作流的 specs、标记和电路图检查能力;Iterative-Optax QSVT 求解器需要安装 optax,NumPy 支持升级为 2.0 或更高版本。

    本站判断:新增态制备、分解检查和资源估计能力,覆盖量子算法开发与编译流程,便于定位实现成本和资源开销。

4月24日周五
  1. OpenAI · Alignment Research Blog

    OpenAI 开源思维链可监测性评测数据集与参考代码

    OpenAI 开源思维链可监测性评测的部分数据集、g-mean2指标计算代码和交叉拟合过滤策略,代码仓库为 https://github.com/openai/monitorability-evals。发布内容涵盖干预、过程和结果属性评测,并提供用于模拟运行评测的高层脚手架;该脚手架仅用于示例,不提供支持。部分依赖私有或受限数据的评测未包含在此次发布中。

    本站判断:公开思维链可监测性评测数据、g-mean2计算代码和交叉拟合过滤策略,便于复核噪声对干预评估的影响。

4月14日周二
3月25日周三
  1. Anthropic · Engineering Blog

    Anthropic 如何构建 Claude Code auto mode:以模型分类器减少权限确认

    Anthropic 为 Claude Code 推出 auto mode,用模型分类器替代人工批准操作,并通过输入层提示注入探测和输出层分类器检查高风险行为。分类器由 Sonnet 4.6 运行,先进行单令牌快速过滤,再对可疑操作进行推理复核;其完整流程将真实流量误报率从8.5%降至0.4%,但真实过度主动操作的漏报率为17%,合成数据外泄任务的漏报率为5.7%。

    本站判断:Anthropic 拆解了 Claude Code auto mode 的双层安全架构与评估取舍,有助于理解模型分类器如何减少权限确认及其残余风险。

2025年12月18日周四
  1. NVIDIA · Quantum Computing

    NVIDIA CUDA-Q QEC 0.5.0 增加实时译码、GPU译码器与AI推理能力

    NVIDIA CUDA-Q QEC 0.5.0 增加在线实时译码、GPU加速算法译码、AI译码器推理和滑动窗口译码支持,可通过检测器误差模型生成、译码器配置、加载初始化和实时译码四步流程运行。

    本站判断:提供从检测器误差模型到实时译码的完整流程,并同时覆盖GPU算法译码、AI推理与滑动窗口,便于比较不同QEC译码路径。

2025年12月17日周三