成本性能」共找到 6938 篇相关文章

产品应用8

豆包专业版实测:2亿人都可以体验干活的Agent了!

6月24日,豆包上线专业版,搭载首个Agent驱动的办公任务模式。实测显示其在办公场景交付质量对标Claude Opus 4.6。2亿日活用户可体验,免费用户功升级,专业版满足复杂任务额度需求。

新智元
新闻资讯8

深度|Karpathy为何突然加入Anthropic,只当Dario的「-2」?

5月19日,OpenAI联合创始人Andrej Karpathy宣布加入Anthropic预训练团队。他将组建新团队,用Claude加速预训练研究。文章分析了他加入的原因,以及Anthropic招聘他的动机,还指出这一变动标记着技术拐点。

新智元
算法论文8

上海AI Lab新研究:SFT泛化,只要满足这三个条件

上海人工智实验室等团队研究指出,“SFT泛化力差”定论有局限。SFT泛化力受优化过程、数据质量与结构、模型基础力共同制约,研究还揭示其训练中的现象及副作用。

量子位
算法论文8

本降九,准确率100%!MIT反常识架构挑战硅谷信仰

慕尼黑工业大学等研究者指出企业AI落地问题源于数据乱。RUBICON架构用AQL查询语言,把操作权交用户,让LLM在精确范围工作。测试中它准确率100%,本低,优于现有智体AI方案。

AIGC开放社区
算法论文8

Transformer可以改装Mamba了:苹果把推理本直接打线性

苹果将Transformer改造Mamba,采用‘两步走’策略,先造中间形态,再转Mamba,避免性崩塌。实验显示,新方法性几乎没掉,本逻辑改变,为模型降本重构提供新可

机器之心
算法论文8

CVPR 2026|DROID-W:复杂室外动态场景,也稳定SLAM

苏黎世联邦理工与微软团队提出 DROID - W 动态 SLAM 框架,即将发表于 CVPR 2026。它不预设动态物体,从多视角观测识别不可靠区域,还提出交替优化方案,在多个数据集表现优。

机器之心
新闻资讯7

美国2月9万裁员狂潮,超过去一年!亚马逊甲骨文最大刽子手

2026年2月美国已裁9万个岗位,超2025年全年。亚马逊、甲骨文、Block等公司因AI裁员,如甲骨文为建数据中心,亚马逊为“去官僚化”。AI重写用人公式,威胁流程型白领等三类人。

新智元
新闻资讯7

鼠标点3下就锁定打击?五角大楼曝光美军AI大脑

美国国防部首席数字与人工智官Cameron Stanley演示Maven系统,将美军杀伤链从小时压缩到分钟。Maven整合多系统,Palantir的AIP嵌入大模型改变战争决策逻辑。Anthropic因坚守安全红线与五角大楼冲突。

新智元
产品应用7

Legora、Mercor 都在用,Reducto 为独立的 LLM 数据入口吗?

当前企业AI落地瓶颈在数据质量,Reducto聚焦数据准确性,以文档解析API提供Agentic OCR力。它获多轮融资,估值达6亿美元,但面临多模态模型竞争及定价等问题,其未来走向待察。

海外独角兽
开源动态8

测试时也RL,英伟达等提出全新范式:TTT-Discover

近日,斯坦福、英伟达、Together AI 等联合开源全新测试时新范式 TTT - Discover,在测试阶段用强化学习微调模型,以刷出 single best 结果,用几百美元就刷新诸多领域 SOTA。

PaperAgent