「Gemini 2.5 Deep Think」共找到 3731 篇相关文章
Agent 2.0时代来了,首批「工业级智能体」正在核心位置上岗
近日科技圈感叹AI工具提升效率,谷歌工程师分享使用智能体经历。1月7日阿里云百炼全面升级,开启智能体‘工业化流水线’时代,解决技术落地问题,发布企业版,推动人机协同时代到来。
矩阵乘法可以算得更快了!港中文10页论文证明:能源、时间均可节省
香港中文大学10页论文提出新算法RXTX,用于计算矩阵与其转置的乘积XXᵗ。该算法结合机器学习搜索和组合优化技术,能源可节省5%-10%,时间节省5%,对多领域有深远影响。
AI最尴尬的短板,中国科学院出手了
7月24日,中科院计算所“知境”团队发布知境社会心智大模型技术体系,为现有大模型补社会心智短板。其建评测体系SoMBench,设计训练系统Zing,用部署架构Actio,在多评测超越GPT - 5.5等,应用前景广。
Meta刚刚开源的SAM 3D火爆全网,未来2D=3D。
近日AI圈热闹,Gemini、GPT、Grok相继更新,Meta虽未更新小羊驼,却发布开源3D模型SAM 3D。它能精确重建人或物体3D模型,有真实三维感知,有两模型,性能强,应用场景多。
阿里智能体多轮推理超越GPT-4o,开源模型也能做Deep Research
通义实验室推出自主信息检索智能体WebDancer,其通过系统化训练范式为构建智能体提供路径,也为在开源模型上复现Deep Research系统提供指导。它在多数据集测试中表现出色,团队还对其未来应用做了展望。
感知错误率降低30.5%:隐式感知损失让模型主动“睁大眼睛” | UIUC&阿里通义
伊利诺伊大学香槟分校与阿里通义实验室推出多模态推理强化学习算法PAPO。它用隐式感知损失设计,解决感知与推理脱节问题,在多基准测试中表现优,但有KL_prcp Hacking现象。
领先于Transformer!新架构首个1200万上下文模型SubQ,成本仅Opus的5%
Subquadratic公司提出SubQ模型,核心是SSA亚二次稀疏注意力机制。该机制改变注意力计算分配,让模型真正读长文档。SubQ是首个有1200万token上下文窗口的前沿模型,成本低、速度快,有望革新大模型扩展路径。
超越MLA!新架构MLRA百万token,解码最高2.8倍速 | ICLR'26
大语言模型处理长文本时,自回归生成受限于显存带宽。为减少KV缓存开销,业界尝试多种方法,但MLA有缺陷。宾夕法尼亚州立大学等研究人员提出MLRA,拆分KV缓存为四个并行分支,降低显存占用,实现4路张量并行,性能更优。
算力都去哪儿了?这个 Seedance 2.0 生成的梗视频给出了答案
有人用Seedance 2.0将Anakin and Padmé梗做成AI视频讽刺AI行业。视频对话暗示算力用途与宣称不符,最后几秒AI将帕德梅形象处理成擦边画风,揭示算力真实去向。
居然 11.5K star 了,这个一人公司的秘密项目有啥魔力!
做自媒体和内容运营重复工作多、效率低。开源项目`AiToEarn`用AI+自动化整合内容创作、发布等环节,支持多平台,有11.5k+ star,还介绍了安装使用方法。