「解码策略」共找到 980 篇相关文章
去掉像素中介!上海交大让AI边看边想边画,用同一个“大脑”跨模态推理
上海交大等团队提出LatentUM架构,摒弃像素解码中介,在共享语义潜空间跨模态思考。它用MBAQ技术转化视觉特征,设计MoME架构,还能自我反思、规划路线、模拟世界演变,表现出色。
OpenClaw 闭门局:和 30 位创业者一起聊聊,真正值得关注的 Agent 生态位在哪?
OpenClaw带火了Agent,带来整个Agent生态重建机会。在第四期AI产品市集Meetup上,30多位创业者探讨创业机会,涉及Token消耗、支付、硬件、记忆等方面,还讨论了创业策略。
程序员岗位暴增11%,华尔街研报击碎失业恐慌:你的饭碗比想象安全
一份‘AI末日论’报告引发华尔街恐慌,软件股市值蒸发超2000亿美元。Citadel Securities报告反驳,用数据表明软件工程师招聘增11%,失业率仅4.28%,指出AI普及慢且有物理边界,不是就业末日,能对冲经济下行。
阿里正式批准林俊旸辞职!将成立基础模型支持小组、坚持开源、加大人才投入
Qwen负责人林俊旸突然离职引发关注,阿里官方回应,CEO吴泳铭在内部邮件中称已批准其辞职,还将成立基础模型支持小组,坚持开源策略,加大AI研发及人才投入。
Gemini 3.1 Flash-Lite Preview发布:Google完成AI模型分层布局
Google发布Gemini 3.1 Flash-Lite Preview,针对企业和开发者场景优化,速度快,有‘思考级别’功能。基准测试表现不错,价格比Claude 4.5 Haiku便宜,但开发者社区反应复杂,面临市场定位问题。
AI 开发时代的“能力暴露与禁止空间”方法论:TPDD 与高层测试闭环
文章指出大模型加速软件开发范式演进,AI 深度介入开发带来新生产路径,但也放大风险。作者提出 TPDD 方法论,通过提前定义测试点与边界条件,平衡能力利用与风险控制,确保系统可控、安全、可持续。
速度提升,能力却暴跌?扩散模型做智能体的残酷真相
南洋理工大学陶大程教授团队联合发布评测报告,揭示扩散语言模型在智能体能力上有系统性缺陷,落后自回归模型。还分析其失败原因,提出评测框架,明确能力边界并给出研究建议。
从斑马鱼到机器鱼:机器人实验重塑神经行为研究
瑞士联邦理工学院、美国杜克大学与葡萄牙高等理工大学联合团队用机器人替代动物做生理学实验。他们基于斑马鱼构建模型,用机器鱼实验揭示运动机制,成果发表于《科学・机器人》。
DeepSeek-OCR 2再进化,对图像理解已经像人一样逻辑推理了
DeepSeek-OCR 2升级,保持前代高效压缩率和解码效率,引入DeepEncoder V2,模仿人类视觉因果流机制,将图像理解转为逻辑推理,在文档解析领域实现逻辑重构,性能显著提升。
卢宗青团队新作:人类先验打底,统一动作对齐,通用机器人模型正在落地
机器人行业核心问题是让机器在真实世界稳定行动。卢宗青团队论文《Being - H0.5: Scaling Human - Centric Robot Learning for Cross - Embodiment Generalization》给出通用操控路线,系统性解决多形态平台部署问题。