「低标注需求」共找到 1835 篇相关文章
LLM近期重大架构进化一览:从Gemma 4到DeepSeek V4
近期大模型长上下文需求增长,成本问题凸显。Google Gemma 4、Poolside Laguna XS.2、Zyphra ZAYA1 - 8B、DeepSeek V4 等模型各有架构优化,如 Gemma 4 跨层 KV 共享和 PLE,以降低长上下文推理成本。
两个哈佛女生用AI做电池故障排查,数月的工作量被缩到了几分钟
哈佛毕业女生 Eva Tuecke 和 Catherine Yeo 创立 Altara 公司,获 700 万美元种子轮融资。其系统能整合电池等物理科学领域分散数据,将故障排查时间从数月缩至几分钟,还能确保输出可审查,适应不同机构需求。
ChatGPT正式上线广告主平台,AI产品从今天开始走向分裂。
今日凌晨,OpenAI更新ChatGPT,上线非推理模型GPT - 5.5 Instant,还官宣向企业主全量上线广告平台。此前广告已在部分地区测试,付费和未成年用户无广告,免费用户可选择关闭但功能受限。投放端向美企开放,出价高,这或成AI产品宿命。
流式意图检测+永久记忆,NUS&NTU发布Pask:把贾维斯AI拉进现实
南洋理工大学谢之非团队提出Pask,采用「底层小模型流式意图检测」+「上层Agents执行」架构,实现实时、有深度、基于个人全局记忆自进化的主动智能体。它包含需求检测、长期记忆和主动系统模块,经测试效果良好。
全球顶尖大模型一夜惨遭血洗!最难测试人类拿满分,AI第一名得0.2%分
全球最难AGI测试ARC - AGI - 3上线,人类满分通关,最强模型Opus 4.6仅得0.2%。测试从静态题变为互动游戏,评分看效率。前沿大模型得分低,非LLM方案表现更好,AI缺乏元认知能力。
“聊天干活”只需扫个码:微信配WorkBuddy,自家出品就是快
微信推出 ClawBot 插件,与腾讯自研 WorkBuddy 适配,接入门槛低。它像统一“任务入口”,可让用户在微信下达任务。适用于媒体记者信息预处理、深度研究、灵感沉淀等场景,使微信从“信息容器”变“任务容器”。
Cursor 套壳、Cloudflare 上架、老黄邀请,中国模型杀进了硅谷的 AI 供应链
3月19日,Cursor发布新模型Composer 2,后被发现底层基于中国Kimi开源模型K2.5微调。此外,Cloudflare将K2.5上架到边缘计算平台,成本降77%;黄仁勋邀Kimi创始人演讲;马斯克两度点赞Kimi。
代码Agent的苦涩教训!首次拆解上下文检索,直指自动化软件瓶颈
ContextBench首次从「过程」评测代码智能体,揭示当前模型多读少用、被关键词误导等深层问题。它基于真实问题修复任务,由专家标注「黄金上下文」,用多指标评估。研究显示,复杂架构未必效果好,模型重召回轻精确等。
ICLR 2026 | 异常需要定义!中传团队提出开放世界视频异常检测新范式
现有视频异常检测(VAD)方法泛化能力不足,无法适应开放世界需求。中传吴晓雨团队在ICLR 2026发表论文,提出LaGoVAD模型,联合建模视频与异常定义,解决样本密度下降等问题,实验显示泛化性强。
ChatGPT的第一块广告位,被谁买走了?OpenAI:别骂,我们这次所有底线都招了
OpenAI宣布将在ChatGPT测试广告,以标注“赞助”链接形式出现在回答底部,不影响回答内容。广告仅对免费版和Go套餐用户展示,OpenAI称广告收入占比将低于总收入一半,还说明了广告原则等情况。