传统工程」共找到 1728 篇相关文章

算法论文8

MIT工科生跨界AI,独作论文登Nature:只需3.5小时修复600年前名画

MIT理工男Alex Kachkine跨界艺术,独作论文登Nature。他设计的AI算法将名画修复时间从数月/数年压缩至几小时,提出“以数字方式修复一幅画,并在物理上实现效果”的新方法。

量子位
算法论文8

视频扩散模型新突破!清华腾讯联合实现高保真3D生成,告别多视图依赖

清华大学联合腾讯提出Scene Splatter,基于视频扩散模型,从动量视角引导其生成满足三维一致性的视频片段,提升三维场景生成效果,解决了传统方法在单张图片重建三维场景的难题。

量子位
开源动态8

字节开源多模态复杂文档解析模型!Dolphin:页面与元素并行解析,精准解析复杂文档!

多模态AI与文档解析兴起,传统OCR解析复杂文档常出错。字节跳动开源多模态模型Dolphin,通过两阶段机制精准解析,有多种功能,安装使用友好,适用于多场景,降低了复杂文档解析门槛。

开源星探
开源动态8

太顺手啦,这款开源框架让AI助手秒级接入应用,狂揽20.5K星!再见繁琐AI开发

CopilotKit是基于React的开源框架,开发者能以极简代码将智能助手集成到Web应用。它有三分钟集成、场景感知等优势,具备五大核心功能,适用于多场景,三步即可入门,比同类项目更有优势。

小华同学ai
新闻资讯7

谷歌·搜索:献给AI的第一个「祭品」?

谷歌正用AI重塑搜索,AI Overviews和AI Mode改变传统架构,从信息入口变终点,侵蚀开放网站流量。虽在AI创新有进步,但搜索广告垄断及商业模式岌岌可危,2026年或不复往昔。

新智元
开源动态7

一键式训练端到端Agent,Qwen3+MCP工具集高效集成!

RLFactory是开源的端到端RL后训练框架,将环境与RL后训练解耦,有极致易用、高效训练等特点。它让用户专注奖励逻辑和工具配置,还能提升训练效率,用Qwen3和MCP工具可快速训练DeepSearch模型。

GiantPandaLLM
新闻资讯8

OpenAI狂砸65亿,挖走苹果设计教父!GPT豪赌下个iPhone时刻

OpenAI斥资65亿美元全股权收购前苹果传奇设计师Jony Ive的AI设备初创io,想定义下一代AI计算机。首款产品预计2026年亮相,奥特曼称其会很酷炫。这对苹果威胁大,AI硬件竞争也白热化。

新智元
新闻资讯7

ChatGPT的记忆机制被公开了

OpenAI推出ChatGPT聊天历史记录记忆功能,默认关闭需手动开启,因未全面开放,技术大佬逆向工程破解机制。记忆系统分保存记忆、聊天记录等,体验反馈两极分化,有优势也有诸多bug。

量子位
开源动态7

ICML25 | 让耳朵「看见」方向!仅依靠360°全景视频,就能生成3D空间音频

空间音频技术成提升沉浸式体验关键,但现有技术未充分利用360°全景视频空间信息。OmniAudio研究可直接从360°视频生成空间音频,相关代码和数据集已开源,虽有局限但前景好。

量子位
算法论文8

长程 Agent 越跑越乱?ContextPilot 用细粒度 RL 教会模型主动管理上下文

长程 Agent 推理时,传统方法使上下文臃肿、推理成本高。清华、腾讯等团队提出 ContextPilot 框架,扩展管理工具集、采用新采样和信用分配方法。实验显示其用短上下文获高分,降低推理开销。

深度学习自然语言处理