「核心能力标准」共找到 4778 篇相关文章
ACL 2026|答得更准还写得更短?华为泰勒实验室提出SHAPE,给LLM推理装了个「推理税」
华为泰勒实验室等团队提出 SHAPE,给推理链装「里程碑 + 推理税」机制。它分三步,能统一势能增益度量、阶段难度感知和 token 效率约束。实验显示,它提升准确率、降低 token 消耗,还解决了推理坍缩等问题。
特斯拉开源硬件,中国公司回应来了:直接把机器人大脑开源了
特斯拉开源硬件专利后,智平方于4月22日发布AlphaBrain Platform开源社区,拿出含具身前沿技术等的“顶配全家桶”。介绍了世界模型、RL Token等5大技术亮点,还说明其用途及智平方过往开源成果与公司实力。
Mythos逼谷歌再拉红色警报!布林连夜成立Coding突击队
Claude Mythos来势汹汹,谷歌拉响红色警报,布林和CTO成立Coding特攻队。团队重点提升模型复杂编程任务表现,还将内部代码纳入训练数据,且推动员工用编程工具。
Mythos架构被22岁小伙“逆推”开源了!MoE和注意力借鉴DeepSeek
22岁小伙Kye Gomez将Claude Mythos架构整合开源成OpenMythos,实现带MoE路由的循环深度Transformer(RDT)。该架构仅用一半参数,就能获与传统模型同等效果,吸引学界关注。
懂方言,通诗词,精通30国语言,阿里发布语音识别大模型Fun-ASR1.5
阿里发布语音识别大模型Fun - ASR1.5,可精准识别30种语言,覆盖中文七大方言体系及二十余种地方口音,强化古诗词诵读专项识别,后处理环节优化标点预测和文本归一化,降低人工成本。
Q:Lab · 龙虾季 | 直播预告
InfoQ中国推出AI产品测评直播栏目「Q:Lab」,第一季“龙虾季”聚焦AI Agent产品,有3期直播,分别在4月21、23、27日,每期围绕职业场景测评多款产品,还有AICon 2026会议推荐。
你的「龙虾」真记得你吗?剑桥发布长期个性化记忆基准ATM-Bench
剑桥大学团队开源面向AI个人助理的长期记忆基准测试ATM - Bench,评估AI面对真实生活数据时能否「记住你」。实验结果不佳,专用和通用智能体系统准确率低,凸显长期个性化记忆问答难题。
Notion Custom Agents复盘:三年重写5次,Notion 历史上最成功的新功能之一
Notion 的 AI 工程负责人 Sarah Sachs 和技术负责人 Simon Last 在采访中分享 Agent 探索思考。Custom Agents 是 Notion 历史上转化率高的新功能,开发三年重写 5 次。他们还谈及产品路线、模型评估、技术方向等内容。
刘壮陈丹琦新作:开源通用视觉推理RL框架,0思考数据刷新SOTA
普林斯顿刘壮团队、陈丹琦参与推出开源通用视觉推理RL框架Vero。它构建的视觉推理器在30多项测试达8B视觉语言模型SOTA,解决了开源RL方案的问题,所有数据、代码、模型均已开源。
OpenClaw热潮之后,倒计时最后一天 | 线上预约、线下报名
OpenClaw热潮活动倒计时最后一天,由NICE、上海交大人工智能创新协会主办,2026.4.11 14:00 - 17:00举办。多位嘉宾分享,涉及Agent安全防御、智能体身份与通信、大模型进化及个人智能体发展等内容。