「设计与代码」共找到 8399 篇相关文章

算法论文8

Google | 溯源分析RAG系统错误,提出选择性生成框架,让RAG问答准确率提升10%

Google对RAG系统错误深入分析,引入‘充分上下文’概念,指出幻觉或因上下文不足。构建评估器,提出选择性生成框架,结合多信号决策,实验显示可让RAG问答准确率最高提升10%。

AINLPer
产品应用7

这款小众 AI 产品,真让我眼前一亮

AI笔记应用Granola获4300万美元融资,估值达2.5亿美元。它打破传统会议记录模式,发挥人和AI优势。其创始人分享创业和产品理念,探讨产品决策、用户反馈筛选等问题,还谈及旅行对直觉的影响及产品发展方向。

MacTalk
新闻资讯7

3200+ Cursor 用户被恶意“劫持”!贪图“便宜 API”却惨遭收割, AI 开发者们要小心了

近日,网络安全研究人员标记出三个恶意 npm 软件包,攻击 Cursor 编辑器 macOS 版用户,超 3200 次下载。这些包伪装提供‘最便宜 API’窃取凭据、替换代码,还凸显供应链威胁。

InfoQ
新闻资讯7

OpenAI 史上最大一笔收购:挥金 30 亿美元砸向 AI 编码公司 Windsurf

OpenAI拟以约30亿美元收购AI编码初创公司Windsurf,这或成其史上最大收购。此前Windsurf目标估值就是30亿美元。收购可提升OpenAI编码能力,其志在主导AI编码领域。

InfoQ
新闻资讯8

豆包PC端前负责人,创业Agent操作系统

本文报道前豆包PC端负责人齐俊元离职字节后,正式推出主动式个人Agent操作系统Today,介绍了产品核心特性与齐俊元的创业历程,披露产品核心能力。

量子位
新闻资讯8

Grok 4.7来了!网友实测先把SpaceX玩坏了,大火箭走起

xAI发布新版大模型Grok 4.7,上下文扩展至50万Token,重点提升编码、Agent及复杂长任务能力,多项专业测试成绩提升明显,发布后网友开启花式实测整活。

量子位
推荐文章8

深度解读:关于 Jev 的几大疑问

本文针对全网爆火的AI模型Jev,梳理业界不同观点,解读其技术路线、核心特性、能力边界与适用场景,解答大众对Jev的核心疑问,客观分析其真实价值。

AI科技评论
新闻资讯9

每周免费送1亿Token!扎克伯格押注王牌产品Muse:AI会24小时替你赚钱,我只负责抽成

本文整理科技记者对扎克伯格的播客访谈,扎克伯格公开反对AI技术被少数机构垄断,介绍了Meta全新推出的个人AI产品Muse的产品设计、商业模式与研发思路。

AI科技大本营
算法论文8

EMNLP 2026高分论文MathDebugger:当合成数据涌入训练集,如何为数学题做体检?

随着合成数据增多,模型需判断数学数据题目能否被信任。北大DCAI团队提出MathDebugger质检BenchMark,覆盖问答两端,评测主流LLM和PRM。还探究能否判断正误、分类错误、修复数据,证明错误标签可作监督信号。

InfoQ
推荐文章7

中美 NeoLab 对话:模型和 Agent 如何实现「持续学习」?

在新加坡 AGI Playground 2026 舞台上,AMI Labs 林敏和 Mind Lab Andrew Chen 深度对谈,探讨 Agent 如何将经验转化为能力、持续学习。两人对持续学习给出不同答案,还讨论记忆、学习等基础问题及解决办法。

Founder Park