「自动化工作流系统」共找到 2441 篇相关文章
复旦等推出「第一人称视听基准」,补齐多模态模型「听觉拼图」
多模态大模型在真实世界会“失聪”,现有第一人称视频问答/理解基准长期偏“视觉中心”。复旦等团队推出首个系统评测第一人称声音理解能力的基准EgoSound,能让模型听懂世界,评测显示当前模型与人类差距大。
大模型微调评测入门:看懂这些指标,才知道模型好不好
文章指出大模型微调中很多新手重“调”轻“评”,评测是决定模型落地的关键。介绍分类和生成任务评测指标,给出实操步骤,还说明如何综合判断模型好坏,最后展望评测技术朝自动化等方向发展。
硅谷深夜不写一行代码!放羊大叔Ralph引爆奇点,睡一觉AI全跑通
放羊大叔Ralph Loop掀起生产力革命,无需手写代码,AI就能搞定软件开发。它把任务拆到最小颗粒度解决普通AI崩溃痛点。还介绍融入工作流的方法、运行方式及成本,强调掌握此技能的重要性。
DeepSeek深夜炸场,开源了一个新项目&论文,V4打前站?
凌晨,DeepSeek开源新项目Engram并公开论文。Engram用可扩展的O(1) N - gram记忆替Transformer早期层节省算力,在多方面实验表现出色,如推理任务增幅大于知识任务,还分析了其机理和系统效率。
被骂疯了!微软CEO刚甩出年终反思:“今年别说AI垃圾了”,“模型滞后”新定义遭痛批,网友:你是真脱离现实
微软CEO Satya Nadella发布年终反思博文,定位2026年为‘AI关键之年’,提出‘模型滞后’,划定三件关键事,却遭网友痛批。同时微软推进AI融入Windows,引发对其动机和市场前景的质疑。
Target 公司借助生成式 AI 推荐将“加入购物车”互动率提升 11%
Target公司为应对零售目录中配套产品组合复杂挑战,部署基于生成式AI的配件推荐系统GRAM。它用大模型分析产品数据,结合人工审核,A/B测试显示提升了互动率和转化率,已全面投入生产。
句子级溯源+生成式归因,C²-Cite重塑大模型可信度
在人工智能发展背景下,大模型内容可信度成焦点。北邮百家AI与小米团队提出溯源大模型C² - Cite,首创上下文感知归因生成技术,解决现有归因模型缺陷,已被WSDM 2026收录。
从 1000 万 App 下载到 1 亿桌面:千问与夸克合体成 AI 浏览器了
阿里千问 App 公测 7 天下载量破千万,其基于强大的 Qwen 模型。11 月 26 日,千问与夸克 AI 浏览器深度融合发布 6.0 版本,借助夸克超 1.1 亿的装机量,千问成系统级桌面智能助理。
谷歌Agent正在憋大招:AI科学家内测,锦标赛制“炼”想法,一次跑40分钟
谷歌正为Gemini Enterprise开发多智能体系统,能扮演联席科学家提炼想法,实现研究自动化。工作时以锦标赛形式评估想法,一次运行约40分钟,还准备了“想法生成”“联席科学家”等智能体。此外还有“与文档对话”功能。
我给在上学的弟弟做了个论文版抖音
作者弟弟被海量论文困扰,作者为其做了像刷短视频一样刷论文的工具,用了 Claude Code 和星辰 Agent 社区版,还介绍了系统逻辑、搭建过程,对比了不同平台,最后工具开源,鼓励按需改进。