「可微分联合优化」共找到 2239 篇相关文章
1052篇文献!上海AI Lab发布科学LLM综述:从数据基础到Agent前沿
上海AI Lab主导,25家研究机构共同梳理270+训练集、190+评测集,提出科学数据分层框架与智能体闭环科研新范式。还介绍了模型演进、数据情况、评估基准等,指出数据缺陷并展望走向科学家智能体的三步。
第一家被收购的AI浏览器公司,43亿成交,产品还在内测
全球第一家被收购的AI浏览器公司诞生,Atlassian以6.1亿美元收购The Browser Company,重点是尚在内测的Dia浏览器。收购早有预谋,The Browser Company为获资源,Atlassian看好Dia潜力。
Claude Sonnet 4 API 支持百万上下文:解锁真正的生产级AI工程
Anthropic宣布Claude Sonnet 4支持100万Token上下文窗口,容量是之前5倍。长上下文支持已向部分客户公测,将推给更多用户。该功能已在亚马逊Bedrock公测,也将登陆Google Cloud。还介绍了用例、定价及早期用户好评。
突破40年Dijkstra算法瓶颈,清华教授等颠覆教科书!斩获STOC最佳论文
清华大学教授段然提出最短路径新方法,击败经典Dijkstra算法,突破40年排序瓶颈。该算法不依赖排序,运行更快,摘得STOC最佳论文,团队正优化追求更快速度。
代码碾压一切!OpenAI神秘模型o3-alpha一夜刷屏,却遭41岁大神绝地反杀
OpenAI神秘模型o3 - alpha曝光,代码能力强大,疑似在编程大赛获亚军,不敌人类选手Psyho。ChatGPT Agent也实力惊人。比赛组织者指出AI代码优化强,但缺人类创造力。
无Tokenizer时代真要来了?Mamba作者再发颠覆性论文,挑战Transformer
Mamba作者之一Albert Gu参与的论文提出分层网络H - Net,用动态分块取代tokenization。Tokenization虽能压缩序列但有缺点,H - Net在多方面表现出色,或预示无需Tokenizer训练时代到来。
亚马逊发布新AI大模型,部署机器人突破100万
全球电商、云计算巨头亚马逊宣布推出新AI基础大模型Deep Fleet,部署机器人超100万。该模型可提升机器人车队出行效率,还能协调机器人移动,带来交付快、成本低等好处。
全球首个历史基准!普林复旦打造AI历史助手,AI破圈人文学科
普林斯顿大学AI实验室与复旦大学历史学系联手推出全球首个历史领域评测基准HistBench及AI助手HistAgent。HistBench含414道题,能检验AI深度认知能力;HistAgent集成多种工具,在测试中表现优异。
视觉感知RAG × 多模态推理 × 强化学习 = VRAG-RL
数字化时代视觉信息愈发重要,传统RAG方法处理视觉信息面临挑战。阿里巴巴通义实验室的VRAG - RL将强化学习引入多模态智能体训练,革新检索生成范式,提升视觉语言模型多方面能力,代码已开源。
“烧掉94亿个OpenAI Token后,这些经验帮我们省了43%的成本!”
作者以月耗94亿OpenAI Token实战经历,分享优化成本经验,如选对模型、用提示词缓存、设账单预警等,降低成本43%,不过网友对此有不同看法。