「文心快码」共找到 906 篇相关文章
与DeepSeek-OCR不谋而合,NeurIPS论文提出让LLM像人一样读长文本
NeurIPS 2025 论文提出 VIST 框架,为大语言模型长文本推理提供视觉方案,与 DeepSeek - OCR 理念不谋而合。它模仿人类阅读,有快 - 慢路径协作,在多任务表现优,还让模型‘用眼看文字’,优势明显。
更少的token生成更好的图!香港大学联合阶跃星辰等让AI绘画真正理解了再画
香港大学、阶跃星辰等用VFMTok新方法,让图像生成模型借用顶级视觉AI的眼睛看世界,实现更快、高质量图像生成,且无需复杂引导技巧。它改变图像理解方式,将像素死记硬背转为语义理解。
Agnes:不做通用型智能体丨对话全民AI应用平台Agnes AI
量子位智库对话Agnes AI创始人Bruce Yang,探讨多智能体在AI产品的应用。Agnes AI以Multi Agent架构为核心,上线四月日活破20万。其介绍了核心功能、单多智能体差异、评估维度等,还谈及目标人群、市场规模等内容。
这一次,天玑9500的端侧AI能力,友商赶不上了
9月22日,联发科推出天玑9500芯片,展示新形态端侧AI应用,推动端侧AI实用化。其性能强、功耗低,还支持端侧模型训练。多家手机厂商将发布搭载该芯片的手机,展现新AI趋势。
Talking-Critic奖励模型带来更自然的音频驱动肖像
近期音频驱动肖像动画技术发展快,但现有方法存在嘴型声音不对、动作不自然等问题。阿里提出Talking - Critic奖励模型,构建Talking - NSQ数据集,还提出TLPO优化框架,提升多维度表现,实验超现有SOTA方法。
训练时间减半,性能不降反升!腾讯混元开源图像生成高效强化方案MixGRPO
混元基础模型团队提出全新框架MixGRPO,结合SDE和ODE,简化MDP优化流程,提升效率与性能。还推出更快变体MixGRPO - Flash。MixGRPO训练时间降近50%,MixGRPO - Flash再降71%,效果和效率优于DanceGRPO。
马斯克偷偷憋了个大招!Grok秒出《阿凡达》画质,好莱坞瑟瑟发抖?
马斯克又放大招,Grok即将推出「Imagine」视频功能,能加音效、配画面,支持多风格生成,可把图像转换为视频。它挑战谷歌Veo 3,生成速度快,操作体验好,还支持多方式创作。
两周反转:Anthropic「闪电」夺回被Cursor挖走的核心编程大将
本月初 Anthropic Claude Code 两位负责人被 Cursor 开发商挖走,两周后又被聘回。Anthropic 虽烧钱但赚钱能力变强,投资人愿超千亿美元估值投资。Claude Code 增长快,而 Cursor 更新引不满,用户外流。
Unify:9个月两轮融资估值2.6亿美元,AI 自动化销售赛道跑出新独角兽
AI销售自动化平台Unify完成4000万美元B轮融资,投后估值2.6亿美元。其核心产品解决销售数据孤岛等痛点,20 - 30%营收来自自用。虽面临竞争,但有独特优势,未来挑战与机遇并存。
吴恩达YC演讲:AI创业如何快人一步?
吴恩达在YC演讲为AI创业者建议,强调执行速度是衡量创业公司成功的重要指标。他探讨AI技术加速工程和产品反馈等,还谈及AI创业机会在应用层,给出提升创业公司速度的方法等。