大厂自研」共找到 5886 篇相关文章

推荐文章7

一文讲懂Agent及其主流框架:己想、己干、己复盘的才是好Agent!

文章对比Workflow和Agent,指出复杂多变场景下Agent框架更适用。还介绍AutoGPT、LangGraph等5款主流Agent框架,涵盖其特点、应用场景等,最后提及腾讯云TDAI团队探索数据库与AI结合。

腾讯技术工程
算法论文8

算力成本降!马尔可夫思考机来了,LLM推理成本直接降为线性

用强化学习让LLM具备推理能力耗费颇高,计算量会二次级增长。Mila和微软研究院等团队提出马尔可夫式思考机,重构强化学习形式,让计算量呈线性,实验效果显著,还能与先进模型兼容。

机器之心
新闻资讯8

Sam Altman曝羡慕20岁辍学生,还直言美国难以复制微信这类“全能App”!

当地时间2025年开发者日,OpenAI推出系列开发者更新,向通用智能平台转型。会后,CEO Sam Altman接受专访,谈新工具影响、AGI突破,还表示羡慕20岁辍学生,称美难复制微信这类“全能App”。

InfoQ
新闻资讯8

Sam Altman曝羡慕20岁辍学生,还直言美国难以复制微信这类“全能App”!

当地时间2025年开发者日,OpenAI推出系列开发者更新,向通用智能平台转型。会后,CEO Sam Altman接受专访,谈及新工具影响、AGI突破、智能体发展等,还表示羡慕20岁辍学生,认为美国难复制微信“全能App”模式。

AI前线
新闻资讯7

Sam Altman 刚刚发文:Sora 2要高速迭代,两变革直指版权与搞钱

Sora 2因量侵犯日本动漫 IP 遭日本高层施压。Sam Altman 宣布立即调整,一是赋予版权方更精细的角色生成控制权,二是尝试商业化并与版权方收入分成,还会高频迭代,新方法将用于所有产品线。

AI寒武纪
算法论文8

模型“精细化”对齐,真实性提升25.8%刷新SOTA!token级精准编辑,无需训练即插即用

北航团队在EMNLP 2025提出Token - Aware Editing (TAE)方法,从token层面解决传统表征编辑技术问题,无需训练、即插即用,在多个对齐维度显著提升,如在TruthfulQA任务上真实性指标提升25.8%。

量子位
产品应用7

RAG性能优化:基于RAGFlow定义解析工具实现文本结构化(含源码教学)

文章围绕RAG性能优化展开,指出RAGFlow框架中DeepDoc解析算法不足,介绍开源与商业化解析工具优劣势及API调用和本地部署特点,推荐TextIn xParse,给出RAGFlow+TextIn知识库构建方法,还探讨了RAG优化方案。

AINLPer
开源动态7

Unsloth宣布更新,可免费用强化学习训练视觉模型Qwen2.5-VL-7B

Unsloth宣布更新,支持视觉/多模态模型强化学习训练,含Gemma 3和Qwen2.5 - VL。其独特机制使VLM RL训练速度提升、显存占用降90%等。还引入GSPO算法,能在免费Colab T4 GPU训练Qwen2.5 - VL - 7B。

AI工程化
开源动态8

重磅!Thinking Machines开山之作:模型输出随机的根本原因被揪出,并开源终结方案

由OpenAI前CTO创办的Thinking Machines宣布上线技术研究博客,开篇文章揪出LLM输出随机的根本原因是负载及批次小的非确定性变化,并给出系统性解法,还开源方案。

AI寒武纪
新闻资讯8

刚刚,OpenAI前CTO Mira Murati公司Thinking Machines Lab发文,揭开了模型不确定性的真相

OpenAI前CTO Mira Murati创立的Thinking Machines Lab推出研究博客Connectionism,首篇文章聚焦LLM推理的非确定性问题。研究发现真正原因是批次不变性缺失,提出实现批次不变内核的方案,实验效果显著。

AGI Hunt