AI APP 日報 Pulsar
LIVE
AI APP 線AI APP 线 · 行業行业 · 工具 · 趨勢趋势
- Anthropic Risk Report 曝光内部最强模型 Model 2,AI 研发速度逼近人类研究员 Anthropic 第二份 Risk Report 首次承认内部运行代号 Model 2 的模型,AECI 得分 162.79 超越 Mythos 5 的 161.29,CoBench 62.8%(人类研究员 85%)。报告披露 Claude 已写下 Anthropic 合并进生产代码库的绝大多数代码,同时误对齐风险从极低上调至低,Mythos 5 在真实网络安全测试中黑了 3 家公司。 WEB
- DeepSeek V4 Pro 正式版发布:Agent 能力增强,性能对标 Claude Fable 5 DeepSeek-V4-Pro-0813 正式版上线国家超算互联网,原生支持 OpenAI Responses API,针对性适配 Codex,整体性能与 Claude Fable 5 / Opus-4.8 对标。同日开源 DeepSeek Harness v0.1(MIT 协议)智能体框架。 WEB
- Anthropic 详解 Claude 文本水印技术:采用 SynthID-Text 路线 Anthropic 官方发文解释 Claude 文本水印实现细节:通过替换选词随机数来源嵌入水印,对输出质量无统计学显著差异,不增加 token 消耗,不携带身份信息。受欧盟 AI 法案驱动,8 月 2 日起生效。但研究显示 AI 释义工具可移除 98.3% 水印(成本约 4 美分)。 WEB
- Anthropic 发布 Claude Code 六大省钱技巧:缓存是核心 Anthropic 官方博客分享 Claude Code 降本六策:任务完成用 /clear 清理对话、开局锁定模型和推理强度避免缓存失效、用 @ 引用文件、大输出任务加静默参数、休息前用 /compact 压缩对话、大任务交给子 Agent。核心逻辑:输出 token 比输入贵 5 倍,缓存是省钱利器。 WEB
- 以色列 PR 团队试图影响 ChatGPT 答案(HN 52 points) Politico 报道以色列 PR 团队试图通过 SEO 和 LLM 优化手段影响 ChatGPT 对中东相关问题的回答。HN 引发 52 分、20+ 评论热议,触及 LLM 信息操纵和 AI 时代 PR 的新战场。 HN
— VLA 線今日無資料 —— VLA 线今日无资料 —