协同解码策略」共找到 1342 篇相关文章

算法论文8

ICLR 2026 Oral|大模型总爱「想太多」? DECS从源头消除冗余思考,实现推理token减半且性能不降反升

以DeepSeek - R1等为代表的大型推理模型存在过度思考问题,造成大量冗余计算。复旦大学等团队在ICLR 2026 Oral论文中揭示‘长度惩罚’局限性,提出DECS框架,在多基准测试中实现推理长度减半且性能提升。

机器之心
新闻资讯7

英特尔:CPU的痛就像送外卖

英特尔将优化CPU痛点比作送外卖,推出二进制优化(IBOT)技术,还升级硬件酷睿Ultra 200HX Plus。数据中心方面,英特尔DCG老大Kevork Kechichian认为Agentic AI使CPU重回舞台中央,并分享转型思路。

量子位
算法论文8

去掉像素中介!上海交大让AI边看边想边画,用同一个“大脑”跨模态推理

上海交大等团队提出LatentUM架构,摒弃像素解码中介,在共享语义潜空间跨模态思考。它用MBAQ技术转化视觉特征,设计MoME架构,还能自我反思、规划路线、模拟世界演变,表现出色。

AIGC开放社区
新闻资讯7

堆推理链全错了!林俊旸离职首曝:曾在阿里 Qwen 踩中一个“致命”技术误区

阿里千问技术负责人林俊旸离职后发声,复盘 Qwen 训练尝试,指出合并 thinking 和 Instruct 模式不理想。他认为大模型未来应从‘推理思维’走向‘智能体思维’,并阐述了智能体思维的特点和挑战。

AI前线
推荐文章7

OpenClaw 闭门局:和 30 位创业者一起聊聊,真正值得关注的 Agent 生态位在哪?

OpenClaw带火了Agent,带来整个Agent生态重建机会。在第四期AI产品市集Meetup上,30多位创业者探讨创业机会,涉及Token消耗、支付、硬件、记忆等方面,还讨论了创业策略

Founder Park
新闻资讯7

程序员岗位暴增11%,华尔街研报击碎失业恐慌:你的饭碗比想象安全

一份‘AI末日论’报告引发华尔街恐慌,软件股市值蒸发超2000亿美元。Citadel Securities报告反驳,用数据表明软件工程师招聘增11%,失业率仅4.28%,指出AI普及慢且有物理边界,不是就业末日,能对冲经济下行。

新智元
新闻资讯7

阿里正式批准林俊旸辞职!将成立基础模型支持小组、坚持开源、加大人才投入

Qwen负责人林俊旸突然离职引发关注,阿里官方回应,CEO吴泳铭在内部邮件中称已批准其辞职,还将成立基础模型支持小组,坚持开源策略,加大AI研发及人才投入。

机器之心
产品应用7

Gemini 3.1 Flash-Lite Preview发布:Google完成AI模型分层布局

Google发布Gemini 3.1 Flash-Lite Preview,针对企业和开发者场景优化,速度快,有‘思考级别’功能。基准测试表现不错,价格比Claude 4.5 Haiku便宜,但开发者社区反应复杂,面临市场定位问题。

AI工程化
推荐文章8

AI 开发时代的“能力暴露与禁止空间”方法论:TPDD 与高层测试闭环

文章指出大模型加速软件开发范式演进,AI 深度介入开发带来新生产路径,但也放大风险。作者提出 TPDD 方法论,通过提前定义测试点与边界条件,平衡能力利用与风险控制,确保系统可控、安全、可持续。

InfoQ
新闻资讯8

我们真的变成巫师了:OpenAI API 负责人谈 AI 如何重塑软件工程

OpenAI API 负责人 Sherwin Wu 在 Lenny's Podcast 上分享,OpenAI 内部 95% 工程师用 Codex,100% PR 由其审查。他谈了 AI 重塑软件工程的现状、未来趋势,提及管理变化、创业效应、部署问题等,也为创业者给出建议。

宝玉AI