批不变性」共找到 1344 篇相关文章

推荐文章7

4000 Star,Vibe Coding终级指南:胶水编程

Vibe Coding由karpathy提出,本文分享其终极指南。介绍了胶水编程、方法论精要、工具资源、编码模型性能分级参考等内容,还给出架构与工作流程,建议选第一梯队模型处理复杂任务。

PaperAgent
开源动态8

OPPO AI重磅发布:深度研究智能体,离“真正好用”还有多远?我们给大模型做了一次全身体检

2025年,Deep Research成AI热点,OPPO AI Agent Team对大模型评测。发布论文,开源评测基准FINDER和失败分类体系DEFT,揭示AI“装懂”“缺乏韧性”问题,还分析模型表现并给出发展建议。

深度学习自然语言处理
算法论文8

总成本降低30倍,告别昂贵后训练,在线策略蒸馏敲开大模型后训练的未来

明星公司Thinking Machines由前OpenAI首席技术官联合创立,其研究团队提出在线策略蒸馏的LLM后训练方法。该方法结合在线策略训练与蒸馏优势,解决后训练两难困境,成本降30倍,还为持续学习和个性化打开新大门。

AIGC开放社区
新闻资讯7

线性注意力回归!Kimi新模型引爆,MiniMax却悄悄换回传统架构

LLM领域线性注意力机制正在回归,工程实践主要由国产模型推进。早期线性注意力因牺牲精度未获主流认可,今年下半年多个国产模型采用其变体,MiniMax却又换回传统架构,Kimi新模型带来新解法。

AI寒武纪
推荐文章8

领投 Ilya 新公司,13 年净 IRR 33%,Greenoaks 的科技投资哲学

本文编译访谈,展现 Greenoaks 投资哲学。其由 Neil Mehta 创立,13 年净 IRR 达 33%。领投 Ilya 新公司,看重 JDCE 理念,投资聚焦未来 S&P 500 公司,坚持商业规律,盲目追 AI 热点。

海外独角兽
产品应用7

Claude Chrome 插件使用体验:强大,但有点慢

作者分享Claude for Chrome插件使用体验,介绍使用流程,测试让其查看马斯克推文,结果准确。该插件能力强且通用,但存在慢、焦点抢占问题,还提到与deepresearch及云厂商设备的差异。

AGI Hunt
7

Claude用户退订潮!被指高峰期偷换缩水模型,工程师列9大罪状呼吁全网退订

Claude出现大危机,AI工程师带头呼吁退订,列9大罪状,如高峰时段偷换缩水模型等。少用户退订,转投OpenAI Codex,其使用量激增。这也让国产模型等获更多尝试,CLI AI编程模式受重视。

量子位
算法论文8

其实,扩散语言模型在最终解码之前很久,就已确定最终答案

随着扩散语言模型(DLM)发展,它成自回归(AR)模型有力替代。但实际推理慢于 AR 模型。研究者发现早期答案收敛现象,提出 Prophet 策略,实验显示其能在保持高质量生成时显著加速推理。

机器之心
新闻资讯8

《“人工智能+”行动意见》深度解读:从人口红利到智能红利,中国经济社会变革新引擎

《“人工智能+”行动意见》是全面重塑中国经济、社会与治理体系的国家战略。它以应用促创新,定位AI为新质生产力关键引擎,涉及多领域变革,还采取对称竞争策略,应对国际博弈。

AI Reading Hub
产品应用8

刚刚,智谱推出全球首个手机通用Agent,人人可用

智谱发布新版AutoGLM,是全球首个手机通用Agent。它为用户配备云端手机,能在影响用户操作的前提下完成各类任务,还在技术上有重大突破,成本更低,代表全新互联网流量。

AGI Hunt