!封面图
---
📰 今日摘要
今天科技圈有三个重磅消息:DeepSeek正式发布多模态视觉模型,神秘Ox Alpha在OpenRouter匿名上线且完全免费,npm12默认封杀安装脚本。同时Cloudflare推出Agent Tracing工具,帮助开发者调试AI Agent应用。
---
🔥 DeepSeek V4-Flash-Vision-Exp 正式发布
8月21日,DeepSeek通过官方API正式开放了V4系列的视觉理解能力——deepseek-v4-flash-vision-exp实验模型。这是DeepSeek V4首次明确支持图像输入,补上了多模态开发场景的一块重要拼图。
关键信息
- 模型名称: deepseek-v4-flash-vision-exp(实验性)
- 图片计费: 单图最多384 tokens,与V4-Flash价格一致
- 接口支持: Chat Completions / Messages / Responses 三种格式
- 接入方式: base64内联、外部URL、Files API
性能提升
与V4-Flash-0731相比,Vision-Exp在多项基准测试中显著提升:
| 测试项 | V4-Flash-0731 | Vision-Exp | 提升 |
| -------- | -------------- | ------------ | ------ |
| Toolathlon-Verified | 70.3 | 75.9 | +5.6 |
| DeepSWE | 54.4 | 59.3 | +4.9 |
| NL2Repo | 54.2 | 57.7 | +3.5 |
| DSBench-Hard | 59.6 | 63.6 | +4.0 |
| Terminal Bench 2.1 | 82.7 | 83.9 | +1.2 |
与Opus 4.8对比
Vision-Exp在文本Agent能力上已接近Claude Opus 4.8,在DeepSWE上甚至实现反超(59.3 vs 58.0),Toolathlon仅差0.3分。但在NL2Repo等测试中仍有差距。
---
🐂 神秘"Ox Alpha"突袭OpenRouter,全网盲猜
同一天,OpenRouter悄悄上线了一款代号Ox Alpha的神秘模型,不设发布会、不公布技术报告,只用一个忍者表情宣告登场——于是AI圈也上演了一出"牛来"。
已知信息
- 模型ID:
stealth/ox-alpha - 上下文窗口: 100万 Token
- 最大输出: 13万 Token
- 多模态输入: 文本 + 图像 + 视频
- 工具调用: 支持,暂不支持严格JSON Schema约束
- 首Token延迟: 约1.95秒
- 输出速度: 约49 Token/秒
- 价格: 目前完全免费
社区猜测
从Google Gemini、小米MiMo V3到腾讯混元新模型,各种猜测层出不穷。OpenRouter本身只负责路由,背后的供应商选择匿名发布。
实测表现
社区集中测试后发现:
- 代码生成和可视化任务稳定可靠
- 支持经过澄清后完成复杂功能需求
- 推理档位最高时存在"过度思考"倾向——花费数十倍token换有限的质量提升
值得关注
OpenCode为这次公开测试准备了每天100万亿Token的容量。这更像一场大规模真人压力测试,而非普通产品发布。厂商希望观察模型在真实Agent Harness、代码仓库和长周期任务中的表现。
---
🔒 npm 12 发布:默认封杀 postinstall 脚本
npm官方发布了npm 12,将三个危险的安全默认行为改为需要开发者主动确认:
三大变更
1. allowScripts 默认关闭 — preinstall/install/postinstall脚本不再自动运行,需通过 npm approve-scripts 显式批准
2. --allow-git 默认 none — Git依赖项不再能绕过安全检查
3. --allow-remote 默认 none — HTTPS tarball依赖项默认禁止
配置示例
# 批准特定包的安装脚本
npm approve-scripts canvas sharp
全局配置
npm config set allow-scripts=canvas,sharp --location=user
在package.json中配置
{
"overrides": {
"allow-scripts": ["esbuild", "sharp", "bcrypt"]
}
}
安全背景
JFrog报告显示,过去一年的恶意npm攻击中,约53% 来自这三种安装脚本途径。pnpm已多年提供类似功能,Yarn和Bun也先后跟进,npm此次终于补上了这块安全短板。
---
☁️ Cloudflare 推出 Agent Tracing
Cloudflare发布Agents首个可观测性组件——Agent Tracing,为部署在Cloudflare Workers上的AI Agent提供统一的调试Dashboard。
核心能力
- Agent级别Span: 新增Agent调用、模型调用、工具执行、审批等追踪层级
- 完整瀑布流: Subagent嵌套调用完整呈现,包括模型、工具、D1查询、KV读写
- Session Replay: 跨多轮交互重放已记录的会话
Trace结构示例
invoke_agent {agent class}
├── chat {model}
└── execute_tool {tool}
└── tool_approval {tool}
注意事项
- 不同框架默认隐私策略不同:Think默认不保存Payload,Flue默认保存
- Payload可能被截断:Span大小限制会影响长消息记录
- Human-in-the-loop延迟不记录:Approval Span只记录Worker内部事件
- 2026年10月1日起收费:Beta期间免费
💬 Hacker News 热门讨论
"Why your local LLM feels dumber than it is" (74 points)
Level1Techs论坛的热门讨论,分析了本地部署大模型时常见的性能陷阱和优化建议,对NAS玩家有实用参考价值。
"Munder Difflin – Agent harness to run an office of your clones" (234 points)
一个让开发者可以运行多个AI Agent协作完成复杂任务的框架,获得社区高度关注。
---
📌 今日总结
今天的科技圈被三件事主导:多模态能力快速普及(DeepSeek Vision)、匿名模型测试新玩法(Ox Alpha免费百万上下文)、依赖安全回归理性(npm12默认封禁)。对于做AI Agent和私有化部署的开发者来说,这些变化既带来新机会,也提出了更高的工程要求。
---
本文数据来源:InfoQ、Hacker News | 采集时间:2026-08-23 06:00 CST
喜欢本文?关注公众号【Geek 运维】,获取更多NAS、AI、服务器运维干货。
评论区