评估问题」共找到 3739 篇相关文章

算法论文8

AI自动写学术综述:10分钟生成6万字,成本不到四块钱

上海人工智能实验室等单位提出SurveyForge框架,能自动化生成高质量学术综述论文。它有双数据库协同驱动的大纲生成机制、学者导航代理SANA和并行生成与协调机制。还有SurveyBench评估框架,实验显示其效果好,应用前景广。

量子位
产品应用7

怎么回事?刚被OpenAI收购,Windsurf就发了个自己的模型

5月初,刚被OpenAI收购的Windsurf发布AI编程模型SWE - 1,该模型针对软件工程全流程,核心是流动感知,实现人机自然交接。它有三个系列,已上线可免费使用,开发灵感源于编辑器,在评估和实测中表现良好。

Founder Park
新闻资讯8

重磅!华为何庭波正式提出τ缩放定律,晶体管密度直指1.4纳米,麒麟2026首发验证

2026年,华为何庭波提出τ缩放定律,主张将时间常数τ作为半导体演进首要优化目标。该定律在手机端和AI数据中心验证有效,还涉及产业结构变化,但仍有工具链、工艺变异等问题待解。

AI寒武纪
产品应用7

看屏幕、用键鼠,我的 OpenClaw「睁眼」了

2026年5月11日,OpenClaw上线macOS桌面操控工具Peekaboo,提供像素级截图、UI元素识别和GUI自动化能力。它打破Agent局限,可接管桌面操作,部署简单,普通人也能用,还有安全保障,但也存在坐标偏移等问题

AI科技评论
算法论文8

谷歌Jeff Dean和多位图灵奖得主合著论文,全面剖析了AI

谷歌Jeff Dean和图灵奖得主John Hennessy等联合发布报告《塑造AI对数十亿人的影响》,拒绝AI极端观点,选择务实。报告剖析打破“饭碗焦虑”、重塑教育医疗等内容,Laude研究所也开展实战评估项目。

新智元
产品应用7

AI+直播的新玩法! StreamDiffusionV2让创意零延迟

生成模型改变直播行业,但此前模型难保证时间一致性、有延迟等问题。加利福尼亚大学推出StreamDiffusionV2,通过智能调度和缓存机制优化,支持多GPU并行,可灵活调画质和延迟,实现实时直播。

带你学AI
开源动态8

HumanSense:探索多模态推理边界,打造「察言观色会共情」的全模态交互伙伴

蚂蚁集团与西安交通大学联合提出并开源 HumanSense,含评估基准与推理模型。通过细粒度评测、全模态消融等研究,提出优化策略,项目已在 GitHub 和 HuggingFace 开源,推动 AI 交互体验革新。

机器之心
算法论文8

Flash-Searcher:Web Agent的并行革命

当下Web智能体用顺序执行链解决复杂任务存在执行和信息利用率低的问题。为此提出Flash - Searcher,以DAG并行执行机制为核心,提升执行吞吐与速度,在多基准上表现优,代码已开源。

深度学习自然语言处理
推荐文章7

OOM排查之路:一次曲折的线上故障复盘

文章复盘了整合Paimon数据湖与RocksDB的系统三次OOM故障排查过程,分享曲折经历,介绍MAT、NMT等排查工具,还给出内存问题排查思路,望为相似技术栈者提供启发。

阿里云开发者
产品应用7

蓝湖悄咪咪在海外做了个 AI 设计产品,4 个月拿下 500w ARR

特工宇宙团队试用多款AI界面生成工具,发现多数距真实开发落地有差距。4月注意到Readdy.ai,操作简单、界面精致。其开发团队是蓝湖,上线4个月ARR达500万美元,解决用户真实问题

特工宇宙