「超体」共找到 3438 篇相关文章
超越ZIP的无损压缩来了!华盛顿大学让大模型成为无损文本压缩器
华盛顿大学SyFI实验室提出LLMc,利用大型语言模型进行无损文本压缩。基准测试显示其压缩率优于传统工具,且项目已开源。不过,当前版本存在效率、吞吐量等问题,应用范围也主要在自然语言。
微调已死?Agentic上下文工程登场,无需微调实现模型进化
斯坦福大学等团队提出 Agentic Context Engineering 技术,让语言模型无需微调自我提升。它将上下文视为作战手册,引入三种协作角色与三项创新,实验显示其在两类任务上表现优异,成本和延迟显著下降。
Paper2Video:学术研究论文讲解视频自动生成
学术演示视频制作耗力,Show Lab提出Paper2Video基准数据集和PaperTalker多智能体框架,可从学术论文自动生成演示视频。还引入定制化评价指标,衡量学术演示视频效果。
又来了!OpenAI 发布 Sora 2,同时推出 AI 版Tiktok
9月30日,OpenAI发布新一代视频生成模型Sora 2,相比Sora 1有显著提升。同时推出iOS社交应用Sora,类似TikTok。应用有安全措施,已在美加iOS平台邀测。社区反应两极分化,OpenAI野心大但或面临挑战。
腾讯重磅开源:端到端文档转换VLM,中英文错误率双料最佳!
腾讯开源端到端文档转换视觉模型POINTS - Reader,可将文档图片转结构化文本。它基于POINTS1.5架构,支持中英文。在OmniDocBench基准上,中英文错误率暂列最佳,具零后处理简单等亮点。
Sora 2 即将发布?
OpenAI官方发预热推文,暗示Sora 2即将发布,众人纷纷猜测。有人认为它将超越Veo3,也有人保持冷静。此外,还爆料OpenAI正打造AI视频媒体平台,大家看法不一,有人期待,有人焦虑。
EMNLP2025 | 解耦视觉与推理,港大探索视觉语言模型"眼智分离"新范式
当前大视觉语言模型处理复杂推理任务时,常过分依赖语言知识,忽视图像关键信息。港大等团队提出ProReason框架,其蒸馏的ProReason - VL和ProReason - Q3模型性能提升显著,为LVLMs发展提供方向。
OpenAI最新硬件2026年底亮相!狂挖苹果20+老将,首款神秘设备或将颠覆iPhone
OpenAI硬件野心浮出水面,收购io后从苹果挖来二十余名工程师,预计2026年底推出首款消费级设备。它还利用苹果供应链,同时在算力上投入巨资解决瓶颈问题。
吴恩达:自动化测试在 AI 编程时代将变得极其重要
吴恩达分享团队用AI编程助手的经历,如Agent删代码。他认为AI辅助编程时代,自动化测试愈发重要,智能体测试能发挥作用,还强调优先测试基础设施代码,后端测试更关键。
史上最大升级!7亿周活ChatGPT逼宫,谷歌慌了,这次要把AI整个塞进Chrome
Chrome迎来史上最大AI升级,谷歌将大模型Gemini全面接入,从内置AI助手到安全防护等多方面改写使用范式。谷歌急于部署,因ChatGPT周活达7亿,AI重塑上网体验,谷歌有危机感。