新词新站」共找到 3952 篇相关文章

产品应用8

Macaron 版本拆解:三个信号,看懂 Personal AI 的进化路径

Macaron版本技术视频技术浓度超预期,结尾藏产品更彩蛋。此次更社交功能、Daily Spark、记忆打通等背后,藏着Personal AI关键变化,其团队Mind Lab有技术突破,开源方案获高认可。

特工宇宙
新闻资讯8

Mamba一作预告架构!长文论述Transformer≠最终解法

Mamba一作将演讲整合成科普长文,探讨SSMs和Transformer模型权衡之术。认为Attention非万能,Transformer是阶段性最优。几天后将发布架构,能与Transformers兼容,还回顾了两模型特点及结合优势。

量子位
新闻资讯7

Ilya模型要来了?投资人爆料:今年最重要的发布!

a16z合伙人Martin Casado预告今年最重要的模型发布,线索指向Ilya Sutskever的模型。SSI成立两年低调发展,获巨额融资,7月与英伟达合作。持续学习是焦点,但相关能力信息有限。

机器之心
算法论文8

重复一下提示,Gemini准确率竟从21%飙升至97%!

Google Research团队研究发现,重复提示可让Gemini准确率从21.33%升至97.33%。该策略能提升主流大模型非推理任务表现,在多模型多基准测试中优势明显,且不增加延迟。

AIGC开放社区
新闻资讯8

紫光集团三周年:智变跃升,交出硬核答卷

2025年7月11日紫光集团完成战略重整三周年,交出硬核答卷,连续三年营收超千亿,专利增加。其聚焦智能科技主业,通过战略布局、技术攻坚、生态协同实现发展,未来将持续求求变,深化合作。

芯师爷
算法论文8

吴恩达作:87%推理token用不着,丢掉反而快3倍

吴恩达作Prefix Sliding指出,模型推理时丢弃中间已贬值token,只保留前缀+滑动窗口,无需训练可提速3倍,配合RL训练能将推理轨迹扩展到10万token以上。该方法为Agent场景提供思路。

PaperAgent
算法论文8

RL成本降幅超90%!Meta提出Agent训练范式DreamGym

传统强化学习(RL)训练LLM Agent面临成本高、任务多样性不足等挑战。Meta团队提出DreamGym框架,以经验合成为核心,通过三大组件协同工作,在多种任务和模型上提升性能,为通用Agent训练开辟路径。

深度学习自然语言处理
新闻资讯7

聊天框之外,AI 交互正在被哪些「界面」重写?

近期,「理想的 AI 交互形态」引发热议。目前流行的聊天对话框式 AI 交互有局限,一些产品开始在特定场景引入不同交互设计。文章还分析了多数 AI 产品界面停留在聊天框的原因及业界探索交互机会的情况。

机器之心
新闻资讯8

刚刚,OpenAI 发布 GPT‑5-Codex 模型,专为编程而生

OpenAI 发布专为 Agent 编程优化的 GPT-5-Codex 模型,在动态思考、性能、代码审查等方面表现出色。同时,Codex 平台大升级,集成 GitHub,保障安全隐私,还公布了定价与可用性。

AGI Hunt
算法论文8

强化学习也遇到了“天花板”?Andrej Karpathy构建了一个算法

大神Karpathy肯定强化学习(RL)价值,指出其比监督微调更具扩展性,但存在渐进式学习低效、背离人类学习机制的局限。他提出“第二天性”范式算法,还面临泛化等挑战。

AI寒武纪