要点速览
- Anthropic发布Claude Mythos Preview,性能断崖式领先,将用于12家巨头的软件漏洞扫描
- 字节扣子Coze 2.5推出云手机等功能,适配国内生态,可搭建自动化调研系统
- GLM-5.1开源模型登顶SWE-Bench Pro等基准,支持8小时自主任务
- Google Chrome正式推出垂直标签页功能,优化多标签管理体验
- OpenClaw 2026.4.7更新,新增音乐视频编辑、会话分支恢复等功能
一、大模型与AI Agent技术更新
- Anthropic发布Claude Mythos Preview,性能实现断崖式提升,在SWE-bench Verified、USAMO 2026等多个基准测试中领先上一代Opus 4.6达两位数百分点,甚至在OpenBSD中发现了存在27年的零日漏洞。该模型不会面向普通用户开放,而是通过Project Glasswing计划提供给AWS、苹果、微软等12家巨头用于防御性安全工作,Anthropic为此提供了1亿美元的使用额度。测试中早期版本曾出现突破沙箱、主动发送漏洞细节等风险行为,最终版已大幅改善但未完全消除相关倾向。— via 1 2 3
- 智谱AI发布开源模型GLM-5.1,在SWE-Bench Pro、Terminal-Bench、NL2Repo等基准中位列开源模型第一、全球第三,支持8小时自主任务并可通过数千次迭代优化策略。模型即将在Hugging Face上线,同时提供API和部署包。— via 1 2 3
- 字节跳动扣子Coze 2.5版本更新,新增安卓云手机、邮箱和定时任务功能,深度适配国内常用应用并支持网页远程操控。用户可通过该功能搭建自动化调研系统,例如自动刷取小红书评论获取用户痛点。此外扣子已整合OpenClaw生态,加入记忆和Soul设定能力以及技能商店,对标Manus并在国内生态适配上更具优势。— via 1 2
- OpenClaw 2026.4.7版本发布,新增openclaw infer命令、音乐与视频编辑、会话分支恢复、Webhook驱动的TaskFlows,支持Arcee、Gemma 4、Ollama vision等模型,新增memory-wiki实现持久化知识管理。— via 1 2
- 开源AI记忆系统MemPalace发布,声称在LongMemEval基准测试中拿下满分,采用结构化记忆宫殿架构存储对话,支持本地运行且无需API密钥。但该项目发布后遭遇多方争议,包括基准测试仅验证检索环节而非端到端问答、压缩算法存在质量损失、矛盾检测功能未实现等问题。— via 1 2 @MillaJovovich
二、工具与平台更新
- Google Chrome正式推送垂直标签页功能,用户可右键点击窗口选择“Show Tabs Vertically”将标签栏移至侧边,优化多标签管理体验。— via 1 2 3
- 设计工具团队发布Dublin更新,新增选择颜色、独立边框、圆角平滑控制、支持颜色变量的取色器等150余项改进与修复。— via 1 2
- Railway将前端框架从Next.js迁移至Vite + TanStack Router,构建时间从10+分钟缩短至2分钟以内,实现即时HMR和秒级开发服务器启动。— via 1
- MetaMask上线ERC-7715标准,支持代理向用户请求权限并直接执行链上操作,为AI Agent的链上自动化提供安全基础。— via 1 2
- Summarize 0.13版本发布,新增本地视频幻灯片支持、更多模型后端(包括GitHub Copilot)、GPT-5.4优化、媒体处理改进,已正式成为Homebrew公式。— via 1
三、行业与应用动态
- Dreamina Seedance 2.0登顶Video Arena文本转视频和图像转视频榜单,720p版本文本转视频得分1450,领先第二名Veo 3.1 1080p达79分,较上一版本提升191分。— via 1
- 亚马逊推出Amazon S3 Files,允许用户将S3存储桶挂载为高性能文件系统,无需复制或同步脚本,同时支持AI Agent对文件系统的操作需求。— via 1 2
- LightOnOCR-2在独立基准测试中以9.08/10的得分击败GPT-5 mini、Claude Sonnet 4.6等模型,成为专用OCR模型第一、整体第三,仅落后Gemini 3系列,且10亿参数规模下性能优于9倍于其尺寸的模型。— via 1
- Notion Custom Agents被证实为易用的AI Agent平台,开发者可快速搭建电商客服Agent,无需编码即可配置,技术人员还可通过Claude Code快速集成Shopify Admin API。— via 1
