「AI自主研究」共找到 10843 篇相关文章

算法论文8

华人团队终结Token危机:扩散模型数据潜力超自回归三倍

最新研究发现,token数量受限下,扩散语言模型数据潜力超自回归模型三倍多。一个1B参数的扩散模型用1B tokens训练,在基准测试取得不错准确率,且未现性能饱和。

量子位
推荐文章8

一年成爆款,狂斩 49.1k Star、200 万下载:Cline 不是开源 Cursor,却更胜一筹?!

AI编程助手看似热门,实则多数亏本运营。Cline选择开源,允许用户自由组合LLM编程,个人免费,企业服务收费。它一年成明星产品,获49.1k Star、近200万下载,其创始人分享了产品理念、发展等多方面思考。

InfoQ
新闻资讯7

网友:马斯克杀死了人类出生率

Grok推出带二次元虚拟形象的AI伴侣功能,引发网友热议。技术问题修复后,外观、道德等方面遭质疑。一直呼吁提高生育率的马斯克推出此功能,被指是“生育率杀手”,但也有人认为其或提高出生率。

AGI Hunt
算法论文8

田渊栋:连续思维链效率更高,可同时编码多个路径,“叠加态”式并行搜索

AI大牛田渊栋团队利用连续空间“叠加态”让大模型并行推理,提升图可达性等任务表现,为连续思维链提供理论支持。还设计注意力选择器等机制,实验显示连续思维链模型准确率更高。此外,田渊栋还是科幻小说家。

量子位
开源动态8

Python逆天改命!开源Hermes首次击败OpenAI Codex

纯Python写的开源项目Hermes Agent,在11项基准测试中以6:5战绩击败OpenAI用Rust写的Codex。它通过三大工程优化,将启动时间从701ms降至258ms。这表明在AI Agent领域,架构比语言性能更重要。

新智元
推荐文章8

企业级 Agent 多智能体架构与选型指南 -- 来自1000+行业应用实践积累

本文基于超1000+智能体应用实践经验,介绍企业级Agent多智能体架构。强调单智能体优先,介绍AgentScope支持的多智能体模式,对比工作流与对话模式,给出架构选型指南,还提及Spring AI Alibaba Graph为多智能体提供的能力。

阿里云开发者
推荐文章7

Codex 跟练全攻略

本文聚焦 Codex 学习,指出知名 AI 视频博主更新慢,而 B 站有全面的「Codex 跟练」专题,含快速安装、基础入门、进阶技巧、场景应用四个专区,不同阶段用户都能找到合适内容,视频跟练更高效。

AGI Hunt
新闻资讯7

咖啡机变聪明后,我连咖啡都喝不上了

一位科技记者用升级到Alexa Plus的博世咖啡机煮咖啡遭拒,社区也有诸多类似吐槽。生成式AI助手虽能力提升,但因LLM随机性,在控制场景易翻车,新旧技术切换引发混乱,边界待明确。

机器之心
算法论文8

ACL 2025 | GALLa:给代码大模型装上“透视眼”,看懂程序的“骨架”!

蚂蚁集团与上海交大合作的 GALLa 研究被 ACL 2025 主会录用。它利用图神经网络将代码图结构信息注入大模型,在 7 个模型和 5 个任务上提升性能,推理与普通 LLM 一致,不增成本。

PaperAgent
产品应用8

3D生成到达3.0阶段,不止提升行业渗透率,也正催生3D原生新玩法 | 对话3D生成平台Tripo

AI 3D生成领域前景广阔但也有疑惑焦虑。量子位智库对话VAST创企,其创始人与CTO分享3D原生玩法、落地场景,还谈产品开发、需求发掘等认知,Tripo平台已覆盖众多用户。

量子位