「研究框架」共找到 3289 篇相关文章
11篇顶会论文之外,美图影像研究院做了一件事:让大众爱用AI
过去两年,AI 生成图片、视频变得容易,但让 AI 理解并按创作者意图创作很难。美图影像研究院过去几年围绕高频创作场景痛点展开研究,11 篇论文被国际顶会接收,成果通过产品落地转化为 AI 影像能力。
世界模型迎来因果升级:CD-LAM仅用几千步微调即可显著增强动作控制
Aether AI与加州大学圣地亚哥分校研究发现现有世界模型会无视动作控制信号,根源是隐动作模型受视觉混杂因素污染。团队提出CD - LAM,从上游净化隐动作表征,实验显示其能降动作误差、提画面质量,降低后训练开销。
华为韬定律拆解:等效 1.4nm 是真是假,产业格局怎么变
华为半导体业务部总裁何庭波提出韬(τ)定律,引发市场热议。文章从多层面剖析,介绍其核心、与摩尔定律差异,分析技术突破与包装话术,探讨全球产业链影响、国内板块格局及估值,还给出分析框架与观察要点。
不可思议!400B大模型在iPhone上跑起来了
一个跑在 iPhone 17 Pro 的 A19 Pro 芯片上的 400B 大模型 Qwen3.5 - 397B - A17B 引发关注。这源于 Flash - MoE 开源项目,它摒弃现代 AI 框架,回归底层开发,实现消费级硬件上大模型交互级速度运行。
三年连下三癌,阿里AI跑通了多癌筛查
4月21日,阿里达摩院和广东省人民医院等机构研究登《肿瘤学年鉴》。其研发的AI模型DAMO COCA从平扫CT揪出5例漏诊肠癌,准确率超医生。此前,该团队已推出胰腺癌、胃癌筛查模型,跑通‘平扫CT+AI’多癌筛查路线。
Anthropic 深夜发布 Claude Design,一句话生成 UI,百亿美元市值 Figma 股价跌了 4.6%
Anthropic 发布新产品 Claude Design,由 Claude Opus 4.7 支持,以研究预览形式向部分用户开放。它定位为设计师“搭子”,覆盖多设计工作流。网友评价高,但也有人指出其生成结果有同质化问题,对传统设计工具冲击待察。
不止Deep,更要Wide:清华、无问芯穹发布多智能体系统WideSeek-R1,4B模型比肩671B模型!
清华与无问芯穹的RLinf团队提出「广度扩展」,发布多智能体系统WideSeek-R1。它采用「Lead-agent-Subagent」框架,经MARL端到端训练,4B模型在广度搜索任务表现比肩671B模型,且在标准QA任务也出色。
突破一亿Token极限:EverMind提出MSA架构,实现大模型高效端到端长时记忆
机器之心发布文章介绍,大模型长期记忆能力受限于上下文长度。《MSA: Memory Sparse Attention for Efficient End-to-End Memory Model Scaling to 100M Tokens》提出MSA架构,突破扩展性、精度和效率的不可能三角,实现100M长度的大模型长时记忆框架。
Vibe Coding“血洗”开源,社区吵翻了:封杀菜鸡 AI 开发者?不如给维护者打钱!
多位研究人员在预印本论文中指出,氛围编码或摧毁开源生态,使官网访问量下滑、社区论坛使用量骤减。研究称要维持开源规模需改革维护者报酬方式,同时分析了其对开发效率、开源软件可持续性的影响,社区对此看法不一。
因为AI编程,Tailwind CSS差点死了
2026年,备受AI智能体欢迎的Tailwind CSS框架团队却陷入困境,创始人Adam Wathan透露已裁掉75%成员。因AI写代码,人类不访问文档,付费产品无人买单,流量降40%、收入损失80%。虽有公司赞助,但仍需探索新商业模式。