非结构化文本」共找到 1497 篇相关文章

新闻资讯8

不读博士,照样进OpenAI!o1核心成员现身说法了

OpenAI研究员Noam分享Keller Jordan、Sholto Douglas等“典型”研究员经历,他们主动性强、公开研究,无博士学位也进入前沿AI实验室。现在进大厂,博士学位必需,尽早进厂更好。

量子位
产品应用7

剪辑 Agent 字幕升级:99% 正确率的字幕,一条指令直接推进剪映

作者成峰重做剪辑 Agent 字幕功能,结合 capcut - mate 项目,接入语音识别服务等优化流程。字幕准确率最高达 99%,还介绍了 5 步使用方法,解决技术用户使用门槛问题。

AI产品自由
开源动态7

9.6k Star,这三个开源Claude Cowork火了

前几天Anthropic推出Claude Cowork,供程序员写文档、回邮件等。开源社区很快出现替代品,PaperAgent整理三个有代表性项目,最高9.6k Star,还介绍了Claude Cowork技术栈。

PaperAgent
开源动态7

Kimi K2基于DeepSeek V3构建

从Hugging Face模型配置文件可知,月之暗面未设计全新模型结构,而是选Deepseek V3作基座模型,用自身高质量数据、独特方法做大量‘微调’和‘后训练’。

AI寒武纪
算法论文8

轻量高效,即插即用:Video-RAG为长视频理解带来新范式

现有视觉语言模型处理长视频面临诸多难题,厦门大学等联合提出轻量高效、无需微调的 Video-RAG 框架,采用多模态辅助文本检索增强生成,解决长视频理解问题,适用于多场景。

机器之心
推荐文章7

ACL'25首届博士论文奖 | 重新思考 LLM 中的数据使用

近日,第一届 ACL 计算语言学博士论文奖获得者是 Sewon Min,其论文《重新思考大型语言模型中的数据使用》围绕大型语言模型如何使用训练所用的庞大文本语料库展开研究。

PaperAgent
推荐文章7

面向Agent设计的CLI,你要注意这几件事情!

当前面向Agent设计软件成热点,但多数CLI设计对Agent不友好。Eric Zakariasson给出设计建议,如交互、示例比描述重要等,强调要兼顾人类和机器,否则人味界面将被自动化绕开。

AI工程化
新闻资讯7

OpenAI深夜甩出GPT-5.1,称更热情,更智能!网友狂吐槽:我不想和它聊天,只想用它工作

OpenAI发布GPT-5.1,包括Instant和Thinking两个版本,称更智能、对话更愉快,还增加“个性/语气”选项。但网友质疑“强化个性”方向,想要高效工具而“虚拟朋友”。

InfoQ
算法论文7

无需训练!让VLM同时具备「视觉」与「推理」能力,数学题得分暴涨30%

当前视觉语言模型(VLM)像‘视力好但数学差的学生’,论文指出问题根源是数据不足和能力分布不均。提出‘模型合并’方案,实验显示在数学基准测试中表现亮眼,还通过实验揭示层间能力分布。

深度学习自然语言处理
开源动态8

中科院甩出多模态“核弹”!类GPT-4o多模态模型开源!支持语言-视觉-语音任意组合交互!

中国科学院计算技术研究所(ICTNLP)开源类GPT - 4o多模态模型Stream - Omni,支持文本、视觉和语音任意组合交互,核心是高效模态对齐技术,少量多模态数据即可训练,有多种使用场景。

开源星探