要点速览
- NVIDIA与SK hynix、LG、NAVER、Doosan、现代汽车等多家企业宣布AI工厂及物理AI合作,加速基础设施布局。
- Perplexity与哈佛研究显示自主代理比纯搜索减少87%任务时间,降低94%成本,并集成Similarweb数据。
- Hugging Face联合Meta、Nvidia等推出OpenEnv协议层,并发布多个模型,Nvidia在HF首页模型占比达30%。
一、NVIDIA密集签约,扩展AI工厂与物理AI生态
- NVIDIA与SK hynix宣布多年技术合作,为全球AI工厂开发下一代内存。SK hynix将为NVIDIA Vera Rubin到Jetson Thor平台开发内存,并利用Omniverse和CUDA-X加速半导体设计制造。— 来源:1
- NVIDIA与Doosan集团扩大合作,涉及物理AI、机器人和AI工厂基础设施,Doosan正探索NVIDIA的物理AI堆栈、DSX、MGX和加速计算平台。— 来源:1
- NAVER基于NVIDIA DSX平台扩建GAK Sejong数据中心,初始55兆瓦,计划达千兆瓦规模,为韩国提供主权和物理AI模型及企业工作负载。— 来源:1
- LG集团与NVIDIA基于DSX平台建设AI工厂,为LG的机器人、自动驾驶、数据中心技术和GPU云服务提供加速计算基础设施。— 来源:1
- Jensen与现代汽车集团领导会面,讨论AI在车辆、工厂和机器人中的应用。— 来源:1
二、Perplexity自主代理研究取得突破,集成Similarweb
- Perplexity与哈佛合作的研究显示,使用Perplexity Computer自主代理相比纯搜索,任务完成时间减少87%,成本降低94%,且用户满意度更高,能实现跨学科搜索。— 来源:1
- Similarweb数据现已集成到Perplexity AI,用户可通过原生集成或官方连接器获取市场、受众和竞争情报。— 来源:1
三、Hugging Face社区多项进展:OpenEnv协议、新模型与Nvidia主导地位
- OpenEnv项目由Hugging Face、Meta-PyTorch、Nvidia等共同维护,作为连接训练环境、模型与测试的统一协议层,旨在为开源模型提供像前沿实验室那样的紧密训练耦合。— 来源:1
- Gemma 4 MTP正式合并到llama.cpp,支持Gemma 4 QAT+MTP实现轻量快速配置。— 来源:1
- SUPER GEMMA 4 26B UNCENSORED GGUF v2模型发布,0/100拒绝率、修复工具调用问题、推理速度提升90%,可在16-22GB VRAM运行。— 来源:1
- Nvidia在Huggingface首页模型占比达30%,表明美国开源回归。— 来源:1
- vLLM-Omni v0.22.0重大升级,支持NVIDIA Cosmos 3世界模型、机器人实时API、生产级TTS等,共有339次提交和124位贡献者。— 来源:1
四、其他值得关注的信号
- OpenAI CEO Sam Altman 认为Codex每日选择计划(每天选一人给予10倍使用限制)有趣且可能形成递归循环。— 来源:1
- RunwayML发布Aleph 2.0模型,可将上传的视频自动适配不同宽高比,填充剩余场景。— 来源:1
- Deedy评价AI电影《Hell Grind》是出色技术演示但电影质量平庸,时间快50倍,人力减少660倍,成本低36倍,但剪辑、表演等仍显人工。同时指出Meta AI近两个月用户增长2.5倍但30天留存率仅4.5%,暗示非有机增长。— 来源:1 2
- Ethan Mollick 认为随着AI让好创意实现成本降低,建议储存最困难、最有价值、最不寻常的想法。— 来源:1
