不可变操作系统」共找到 1448 篇相关文章

算法论文8

无需训练,即插即用,2倍GPU端到端推理加速——视频扩散模型加速方法DraftAttention

高质量视频生成任务中,扩散模型成主流,但DiT模型注意力机制计算量大,成推理瓶颈。现有加速法效果佳,为此美国东北大学等团队提出DraftAttention,可2倍加速推理且损画质。

机器之心
新闻资讯7

继续吃瓜!Sam Altman 公开邮件:我没有偷创意,反击IYO创始人“求收购成反诉讼”

Sam Altman 公开发文并附邮件截图,反击硬件初创公司 IYO 诉讼。IYO 创始人 Jason Rugolo 多次求投资或收购被拒后起诉,邮件显示 OpenAI 从一开始就看好合作,Altman 还揭露起诉前对方仍求收购。

AI寒武纪
算法论文8

AI哪怕答案正确,逻辑链却惨忍睹,奥数级等式证明成功率到50%| 斯坦福&伯克利&MIT

斯坦福、伯克利、MIT等联合研究,系统评估29个大模型在奥数级等式证明任务的能力。研究发现,模型答案正确多靠猜,推理漏洞多,参数大、思考久也能提升推理严谨度,但自我反思和定理线索策略有改善效果。

量子位
算法论文7

何恺明改进了谢赛宁的REPA:极大简化但性能依旧强悍

扩散生成模型在建模复杂数据分布表现出色,但与表征学习领域关联大。谢赛宁团队提出REPA,过较麻烦。何恺明团队提出Dispersive Loss,简化且性能强,无需预训练等,适用于多种模型。

机器之心
产品应用8

Cursor 1.0 正式发布:AI 代码编辑器进入“自动审查 + 记忆”时代!

智能代码编辑器 Cursor 正式发布 1.0 版本,带来多项重磅功能,如自动代码审查助手 BugBot、Jupyter Notebook 原生支持、项目级 AI 记忆等,还提升了用户体验,是向“AI 编程操作系统”迈进的重要一步。

AI科技大本营
产品应用8

训练MoE足足提速70%!华为只用了3招

Scaling Law下,MoE成扩展模型能力法宝,但训练难题凸显。华为构建Adaptive Pipe & EDPB优化方案,还打造DeployMind仿真平台,解决了MoE训练中通信等待、负载均等问题,使训练吞吐提升72.6%。

量子位
算法论文7

奖励是假的,能让Qwen提升25%性能却是真的!

华盛顿大学博士生团队用Qwen模型对虚假奖励进行RLVR,使MATH - 500准确率显著提升约25%。研究发现RLVR考虑奖励正确性,还分析了虚假奖励有效的原因,提示现有研究要在非Qwen模型验证。

量子位
新闻资讯8

甲小姐对话柳钢:AI编程商业化的中国解法 | 甲子光年

AI编程赛道发展火热但商业化难题凸显,国内外市场境遇同。极狐GitLab CEO柳钢将困境转化为突破口,推出驭码CodeRider。他认为用AI赚钱时代已到,还分享对产品、商业、开源等方面的看法。

甲子光年
新闻资讯7

撞名Anthropic的“外挂”刷屏:让“DeepSeek V4‑Pro碾压 Fable 5”但无人能复现,Token开销反而翻倍

J - Space Cognition Suite社区项目在X上传播,称修改DeepSeek V4 - Pro模型权重,用推理时Harness能提升其在多项Agent Benchmark表现,超Fable 5,但未第三方复现,且Token开销可能翻倍。

InfoQ
开源动态7

Vercel 发布新语言 Zero:代码是写给人看的,而是写给 AI 的

Vercel Labs 发布实验性系统编程语言 Zero,定位是速度快、体积小且便于智能体使用修复。Zero 有工具链契约等特色,v0.3.0 有重大转变,过在 Hacker News 上遭部分质疑。

InfoQ