「通用推理模型」共找到 8517 篇相关文章
Data Agent如何帮助企业打造懂你的“电子牛马”?|数势xSelectDB
本文邀请数势科技谭李和飞轮科技肖康探讨数据Agent。谈到懂业务的Agent特点、与传统BI差异,还提及数据库挑战及应用场景,指出Agent能激活数据、提升交互效率,未来将催生新角色。
2025 ToC AI产品:仅有3%用户愿意付费,29%的父母每天使用
Menlo Ventures发布《2025年消费级AI现状报告》,基于对5031名美国成年人调研,揭示AI使用图景。如61%美国成年人半年内用过AI,仅3%愿付费;29%父母每日用,是非父母群体1.9倍等,还指出未来六大趋势。
盘一盘,2017年Transformer之后,LLM领域的重要论文
本文梳理2017年Transformer后LLM领域重要论文。如提出Transformer架构的论文成现代AI基石;介绍GPT - 3的论文确立‘大模型 + 大数据’缩放定律,引领LLM军备竞赛等。还列举各论文内容与影响。
成立 5 年最高估值超百亿,摩尔线程之后,又一家AI芯片独角兽争当“国产 GPU 第一股”
6月23日,沐曦集成电路IPO辅导完成,离A股上市更近一步。它成立于2020年,专注高性能GPU,产品应用广,还与书生・浦语3.0合作。虽曾被曝裁员,但已完成8轮融资。当下国产GPU厂商扎堆IPO,适配DeepSeek或带来机遇。
ICML 2025 | 千倍长度泛化!蚂蚁新注意力机制GCA实现16M长上下文精准理解
在大语言模型发展中,长文本建模挑战大。蚂蚁研究团队提出注意力机制GCA,可端到端学习检索相关片段,实现超长序列处理与泛化,其Triton kernel实现已开源,论文被ICML 2025接收。
“看懂”指令并做动作!Motion-R1结合COT让角色动起来
大语言模型为文本驱动动作生成带来新可能,但现有方法有局限。GigaAI提出Motion - R1框架,融合“思维链”机制,能分解指令、优化动作合成,虽有不足,但在测试中表现优于主流方法。
3D多光照场景渲染!GRGS带来真实感重光照
哈工大提出通用3D高斯框架GRGS,用于多样光照下高保真人体新视角合成。它采用前馈监督策略,支持可编辑光照,结合物理着色与神经网络推断,合成逼真效果,但处理透明材质和纤薄结构欠佳。
Anthropic CEO:人的幻觉比AI 更多!这是真的吗?
Anthropic公司CEO称AI幻觉比人类少,创业公司ColdIQ联合创始人Alex Vacca用虚构故事喂给ChatGPT、Claude和Gemini,测试它们识破谎言的能力,实验结果显示各模型表现不同,AI幻觉短期内难消失。
这些关于研发提效的深度实践,值得每一位开发者关注 | AICon
6月27 - 28日AICon北京站上,一线大厂技术大牛将分享“AI赋能研发提效”经验,涉及AI编程范式革新、代码智能化落地、研发流程优化等多方面,呈现技术演进与落地路径。
OpenAI 详解 GPT-Live 架构如何实现了连续的有状态语音交互
本文是InfoQ翻译的OpenAI技术分享,详细公开GPT-Live实现连续有状态低延迟语音交互的架构设计,分享了架构拆分、协议优化、上线测试等实践经验与设计权衡。