「预发布模型」共找到 9159 篇相关文章

算法论文8

融资 1200亿后 Kimi 再扔王牌,新架构爆改 Transformer 老配件,比 DeepSeek 同款还省钱

Kimi 发布新论文,提出“注意力残差”架构改进 Transformer 残差连接,解决“稀释问题”,让 AI 更聪明、更省钱,还推出“分块注意力残差”优化成本。与 DeepSeek 方案对比,Kimi 方案性价比更高。

AI前线
新闻资讯8

范式跃迁:LLM + EC重构算法设计范式,华为&港城大夺冠CVRP国际顶级赛事

近日,华为与港城大联合团队‘OptVerse - CityU’在CVRPLib BKS全球挑战赛夺冠。他们用‘大模型(LLM)+进化计算(EC)’架构,刷新98个历史最优解,51个设新纪录,验证AI在算法设计潜能。

机器之心
产品应用7

一键搞定百万行Excel和PPT排版!这家杭州电力AI初创要给打工人减负

AI生产力革命被困云端,本地智能体工作台XMO - AgentBox应运而生。它由杭州曦谋决策打造,集成DeepSeek模型,能处理复杂场景,有平台化能力、核心价值,适合专业人士,现可免费下载桌面版。

量子位
算法论文8

最新最完整的Agent Memory综述!

《Memory in the Age of AI Agents: A Survey》由多顶尖机构联合发布,对AI智能体记忆机制系统梳理。从形式、功能、动态维度厘清AI记忆本质,提出构建下一代强人工智能的蓝图。

深度学习自然语言处理
产品应用8

教育行业首个AI Agent落地!斑马口语「超人类外教」诞生

教育行业首个AI Agent落地,斑马口语推出「超人类外教」。它有「人」味,能灵活交流、共情,背靠猿力大模型,有记忆能力,性价比高,推动优质口语教育,或重塑教育行业。

量子位
产品应用8

大涨240%,Doc-Researcher确立多模态文档深度研究新范式

在ChatGPT引领的AI革命中,大语言模型面对专业复杂文档常“束手无策”。Doc-Researcher提出三位一体解决方案,构建M4DocBench评测,性能远超现有方案,还适用于多产业场景。

PaperAgent
新闻资讯8

马斯克狂烧14万亿,5000万H100算力五年上线!终极爆冲数十亿

马斯克宣布5年内实现5000万张H100的算力,成本超2万亿美元。他已有Colossus超算集群,Grok系列模型也展现强大实力。目前Colossus 2在分批落地,供电采取多元化措施。

新智元
开源动态8

腾讯混元开源游戏AI生成新工具!RTX 4090就能制作3A级动态内容

腾讯开源游戏视频生成框架Hunyuan - GameCraft,基于混元视频生成搭建,操作简单,输入单张场景图、文字描述和动作指令就能生成高清动态游戏视频,解决传统工具瓶颈,性能优于主流模型。

量子位
产品应用8

刚刚,奥特曼放出ChatGPT「统一智能体」!惊呼真AGI,最卷打工人来了

奥特曼带队直播发布ChatGPT agent,它融合三大技术优势,可自主工作,还能上网直出PPT、Excel。在多项测试中刷新SOTA,2025年将成全新AI杠杆,解锁「超级个体」模式。

新智元
推荐文章7

为 Agentic AI 的黎明构建地基

文章指出大语言模型虽耀眼,但企业级解决方案需坚实数字底座。在 Agentic AI 时代,数据范式、基础设施哲学都要重塑,智能体模式崛起带来挑战与机遇,技术决策者要做好底座构建。

AIGC开放社区