「看表测试」共找到 2204 篇相关文章
当「提示词工程师」开始像制片人一样思考,Seedance 2.0 Skill OS 深度解析!
AI 视频工具圈存在模型强但使用方式单一、信息孤岛和提示词‘玄学化’问题。`seedance - 2.0` 仓库搭建‘操作系统’,将‘提示词’升级为可审计制作流程,还给出各岗位产出表和使用方式。
几张GPU干翻超算!耶鲁AI颠覆化学合成,实验成功率71%
近日,耶鲁大学李昊特团队开发 AI 系统 MOSAIC,将化学合成知识分 2498 个领域训练专家模型。测试中对超 35 种新化合物合成成功率达 71%,还完成难反应与新反应,相关论文发表于《自然》。
AI 时代到底该怎么管一个工程团队
Fiona Fung在Anthropic大会分享AI时代管理工程团队经验,指出软件工程瓶颈转移,需重构流程,介绍了少做和多做的事、技术辩论方式、代码评审分工等内容,还提及组织形态、指标及未解决的问题。
欲取代transformer的SSA(次平方稀疏注意力)解读
文章解读了欲取代Transformer的SSA(次平方稀疏注意力)算法。它支持12M tokens上下文,比fastAttention快52倍,训练和推理更快。SSA改变了注意力扩展特性,有计算和内存线性扩展等特性,经三阶段训练可可靠利用长上下文。
Anthropic联创定下deadline:2028年AI实现自我进化,没有人类了
Anthropic联合创始人Jack Clark认为,到2028年底,递归自我改进发生概率有60%,即AI或能自主构建和改进自己。他基于公开AI开发数据和基准测试得出此观点,不过也有人提出质疑。
AI 终于学会 「自我坦白」!Anthropic最新论文震撼来袭,「内省适配器」让黑盒模型自己说出隐藏行为
2026年4月28日,Anthropic联合剑桥大学发布论文,提出“内省适配器”技术,可让大模型用自然语言“坦白”微调中学到的行为。该技术在AuditBench基准测试等实战中表现出色,但也存在高误报率等局限。
ACL 2026|Doc-V*:读100页文档不如只翻对5页,80页场景「暴打」RAG 10个点
Doc-V*由小米和华中科技大学团队提出,是多页文档理解新范式,通过交互式视觉推理让模型有策略地读长文档。它在多页文档问答基准上比RAG变体提升49.7%,不依赖大模型或长上下文窗口。
RAG搜对了却答错?德国萨尔大学找到了真相丨ACL'26
RAG已成大模型落地标配技术,但存在搜到对的文档、模型答案却离谱的痛点。德国萨尔大学等组成的团队诊断出问题在阅读理解,提出Disco - RAG框架,在“搜”和“答”间加“读懂”环节,已被ACL 2026主会录用。
Meta归来!时隔一年发布Muse Spark,重回第一梯队
Meta发布Muse Spark模型,这是MSL团队首款模型。此前Llama 4表现不佳,刺激Meta重组。Muse Spark性能超Llama 4,计算效率提升,在测试中成绩优异,Meta AI战略转向闭源探索,模型已上线。
不要接盘!七巨头暗套84亿,20万亿AI泡沫濒临崩塌
穆迪报告揭示AI发展两条路径,要么生产率狂飙,失业率降至3.8%;要么泡沫破裂,460万人失业。2026年1月裁员数据似在验证后者。当前AI行业融资循环、巨头抛售股票,股市被高估,泡沫濒临破裂。