「并行协同推理」共找到 2552 篇相关文章
OpenAI发布新模型 GPT-Rosalind:专攻生物学、药物发现和转化医学
OpenAI发布生命科学前沿推理模型GPT - Rosalind,目标是生物学研究等领域。它是生命科学模型系列首款产品,在多方向表现强。当前以研究预览版向特定合作机构开放,有意机构可申请。
Claude有的,国产也有!紫东太初科研龙虾ScienceClaw,已经把Harness卷进实验室
Claude发布的Managed Agents让“Agent Harness”概念受关注,而国内紫东太初ScienceClaw早有相关思路并落地。它全链条覆盖科研,能7x24小时优化,具透明执行优势,还覆盖通用场景,架构有创新。
西湖大学张驰团队:从视觉合成到空间理解,视频 AI 正在「转向」丨CVPR 2026
过去两年视频生成发展近成熟,但多数模型缺乏空间结构稳定建模能力。西湖大学AGI Lab团队提出论文,将问题落回推理阶段,让相机轨迹成约束条件,推进视频生成到三维结构约束建模。
首个用户生活「长程模拟器」来了!LifeSim 重新定义大模型个性化评测
现有个性化助手评测基准与真实用户-助手交互脱节,来自复旦大学等的研究人员提出 LifeSim 框架及 LifeSim-Eval 评测方法。实验显示主流 LLM 处理显性需求尚可,隐性意图识别等方面短板明显。
Claude最新模型Mythos意外泄露,性能远超Opus
Anthropic内容管理系统配置失误,近3000个未发布资产泄露,Claude最新模型Mythos提前公开。它在软件编码、学术推理和网络安全等测试中远超Opus,网络安全能力尤其危险。2026年初Anthropic产品密集发布。
刚刚,英伟达革了自己的命:智能体自主进化7天,干掉所有算子工程师、GPU专家
英伟达新研究AVO构建了新型进化变异算子,用自主编码智能体取代经典方法。智能体7天自主进化,优化MHA内核,性能超cuDNN和FlashAttention - 4,还能快速适配GQA,展现强大泛化能力。
一场关乎纯度99.9999%的国运之战
2026年,一场围绕电子特种气体纯度的“国运之战”正激烈展开。其纯度要求已严苛至6N乃至更高,这关乎国家科技自立、产业安全。当前中国电子特气市场虽扩大,但本土产业面临外资封锁,国产化突围道阻且长。
科研虾LabClaw接管实验室!斯坦福和普林斯顿重新定义人机协作边界
斯坦福和普林斯顿团队构建完整AI生态,LabClaw有206个科研技能,可部署为实验室代理;LabOS结合计算与实验,能自我进化;MedOS模仿人类认知用于临床。三者协同重新定义人机协作边界。
迈向原生全模态AI智能体:人大&小红书发布OmniGAIA新基准
中国人民大学等团队推出 OmniGAIA 新基准及 OmniAtlas 训练框架。OmniGAIA 含 360 个高难度任务,覆盖多领域。实验显示闭源与开源模型差距大,OmniAtlas 显著提升开源模型表现,并指出未来全模态智能体发展方向。
Anthropic重磅更新skill-creator:创建skill全面告别“草台班子”时代
Anthropic升级skill - creator,让普通人创建skill更友好且有效。将测试等机制引入创作,能验证skill有效性。还支持多智能体并行测试、A/B测试,优化触发描述,为未来自然语言定义skill过渡。