「跨模型协作」共找到 8342 篇相关文章
刚刚,李飞飞空间智能新成果震撼问世!3D世界生成进入「无限探索」时代
斯坦福大学教授李飞飞创业公司 World Labs 发布限量开放测试预览版空间智能模型 Marble。输入单张图片或文本提示,它就能生成可无限探索的 3D 世界,与谷歌 Genie 有显著区别,还支持导出高斯点云等。
刚刚,Thinking Machines Lab首次发长文,揭开LLM推理不确定性真相
Thinking Machines Lab发长文《克服LLM推理中的不确定性》,指出大语言模型推理不确定性的真正元凶是缺乏批次不变性,还解释核函数计算中数字加法顺序问题,介绍使核具有批次不变性的方法并给出实验结果。
具身智能猛将再狂揽近6亿融资!机器人Moz1卷入办公室,全力冲刺万亿赛道
2025年具身智能赛道爆发,全球科技巨头与初创公司竞技。千寻智能获近6亿PreA+轮融资,其商用机器人Moz1实力强,自研Spirit v1与OneTwoVLA模型表现出色,以独特商业策略布局万亿市场。
GPT-5得分不到0.4!法律+金融最大规模基准:1.9万+专家评估准则
新推出的PRBench基准可测AI在金融和法律领域表现。它有19356条专家评估准则,是该领域最大公开基准。顶尖大模型在困难子集得分低,还独创经济路径分析维度,约30%任务为多轮对话,揭示了AI在专业领域的不足。
压缩即是全部 —— 菲尔兹奖得主给数学和 AI 的一封信
2026年3月,菲尔兹奖得主Michael Freedman发表论文《Compression is all you need》,用代数模型回答人类构建数学、人类与形式数学区别、人类数学家与AI协作三个问题,答案是“压缩”。文章还探讨了压缩在多领域的体现及对AI的意义。
CVPR 2026 | 从视觉Token内在变化量出发,实现VLM无损加速1.87倍
随着高分辨率图像与长视频处理需求增长,大型视觉语言模型推理效率成瓶颈。V²Drop从视觉Token内在变化量出发,采用多阶段渐进式剪枝策略,实现无损加速,在图像和视频理解场景表现卓越。
Qwen-Image-2.0: 字字清晰,张张细腻
阿里云推出Qwen-Image-2.0图像生成基础模型,具专业文字渲染、细腻真实质感等特色。在AI Arena盲测中表现优越,能精准生成复杂内容,文字渲染有准、多、美、真、齐特点,图像编辑能力也得到增强。
兵临OpenAI!谷歌集结2500人「复仇」,Gemini 3夺回AI王座
谷歌发布Gemini 3欲夺回AI主导权。谷歌DeepMind的CTO与AI Studio产品负责人剖析其发布盛况等,称这是与全球用户共建AGI的实验,还谈到模型发展、应用及多模态等问题,也承认仍有提升空间。
AI Agent的“祛魅与归真”:当超级智能体开始懂行|甲子光年
AI Agent正迎来“祛魅”时刻,市场关注焦点从“模型有多大”转向“业务有多懂”。甲子光年智库分析,其角色进阶为“数字员工”,重塑人机协作模式。众安信科深耕企业级场景,构建闭环体系,其AI Agent成效显著。
AutoGLM 2.0 深度解析:云端智能体的技术跃进与现实挑战
2025 年 GUI Agent 赛道升温,多数产品依赖本地执行。智谱 AI 在 8 月 AutoGLM 2.0 闭门交流会上展示新路径,其由国产模型驱动,具多能力,在 Agent 云端执行架构、训练方式等方面有突破,也面临一些挑战。