非编码区」共找到 1075 篇相关文章

算法论文8

ACL 2026 Main|混合推理模型也会「钻空子」:南大移动团队提出TNT,破解「假装不思考」骗奖励

大型推理模型存在「过度思考」问题,训练混合推理模型易出现奖励欺骗。南大等团队提出 TNT 方法,利用思考模式解答部分为问题动态设思考模式 token 上限,解决奖励欺骗,实现准确率与效率双赢。

机器之心
推荐文章7

谷歌辞职、创业失败、重读神经科学,她说 AI 时代最危险的事是外包你的思考 | 万有引力

本文是对神经科学家 Anne - Laure Le Cunff 的采访。她分享谷歌工作、创业失败后转读神经科学的经历,阐述“小实验”理念,对比“小目标”,给出 PACT 框架,还谈 AI 使用、科技焦虑等问题。

AI科技大本营
算法论文8

ACL 2026|Doc-V*:读100页文档不如只翻对5页,80页场景「暴打」RAG 10个点

Doc-V*由小米和华中科技大学团队提出,是多页文档理解新范式,通过交互式视觉推理让模型有策略地读长文档。它在多页文档问答基准上比RAG变体提升49.7%,不依赖大模型或长上下文窗口。

机器之心
7

Anthropic开始抢科学家了?周薪2.7万驻场,专治Claude专家级错误

Anthropic新推出STEM Fellow岗位,招募STEM领域专家驻场三个月,周薪3800美元,用其判断力校准Claude输出质量。其三年来科研路线不断加码,正构建科研生态。AI科研瓶颈是判断力而算力。

新智元
产品应用7

从Vibe Coding到Wish Coding,AI编程迎来C端拐点

近期Vibe Coding刷屏,虽提升编码效率,但未降低交付门槛。蚂蚁灵光App升级,以Wish Coding重构软件生产关系,实现从想法到应用的闭环,虽有粗糙之处,但打开普通人创造应用新可能。

机器之心
新闻资讯8

100个产品原型同时跑、新模型Mythos断层领先,连skills效果都好到让团队意外:Anthropic内部到底在发生什么?

Claude Cowork 工程负责人 Felix Rieseberg 在播客中透露,未发布的新模型 Mythos Preview 带来“断层式跃迁”,在安全漏洞检测等方面表现出色。Anthropic 内部可同时跑上百个产品原型,执行成本降低。还介绍了 Cowork 开发、应用及产品打造经验。

InfoQ
产品应用8

马斯克版微信,终于来了!

4月12日苹果App Store刷出XChat,开发者为X Corp.,将于4月17日上线,中国大陆也开启预约。它被看作‘马斯克版微信’,无广告、不追踪、全加密,集成AI Grok,或重塑全球社交格局。

新智元
新闻资讯7

一年一度最值得关注的AI榜单来啦!申报即日启动

中国生成式AI进入产业深水,值第四届中国AIGC产业峰会,量子位将评选2026年度值得关注的AIGC企业和产品,介绍了参选条件、评选维度,即日起报名,4月27日截止,结果5月峰会公布。

量子位
新闻资讯8

“代码 + 编译器”要消失了?马斯克在 xAI 全员会上放话:到今年年底,AI 或将直接生成二进制

xAI 近期出现离职潮,马斯克公开 45 分钟全员大会视频回应。他表示离职是阶段适配问题,强调速度是当前唯一优先级。还公布新架构,涉及 Grok、编程、图像视频、MacroHard 四条线,并预测 AI 未来发展,如年底或直接生成二进制。

InfoQ
开源动态7

AI用3年时光,来了解你!首个AI Clone长期记忆基准

现有AI记忆评测存在数据源单一、忽视变化本质、注入成本高等局限。开源学术社QuantaAlpha联合高校团队提出CloneMem基准测试,构建合成人生,设计评测任务,实验发现简单方法在检索上更有效,记忆系统应还原信息。

新智元