「自研模型」共找到 8402 篇相关文章
MeshCoder:以大语言模型驱动,从点云到可编辑结构化物体代码的革新
生成式AI在三维空间面临挑战,传统3D生成成果粗糙难编辑。团队推出MeshCoder,将三维输入翻译成结构化代码,有分部件生成等优势。介绍其实现路径、实验性能,也指出局限并展望未来。
总成本降低30倍,告别昂贵后训练,在线策略蒸馏敲开大模型后训练的未来
明星公司Thinking Machines由前OpenAI首席技术官联合创立,其研究团队提出在线策略蒸馏的LLM后训练方法。该方法结合在线策略训练与蒸馏优势,解决后训练两难困境,成本降30倍,还为持续学习和个性化打开新大门。
一文讲懂Agent及其主流框架:自己想、自己干、自己复盘的才是好Agent!
文章对比Workflow和Agent,指出复杂多变场景下Agent框架更适用。还介绍AutoGPT、LangGraph等5款主流Agent框架,涵盖其特点、应用场景等,最后提及腾讯云TDAI团队探索数据库与AI结合。
Sam Altman自曝羡慕20岁辍学生,还直言美国难以复制微信这类“全能App”!
当地时间2025年开发者日,OpenAI推出系列开发者更新,向通用智能平台转型。会后,CEO Sam Altman接受专访,谈新工具影响、AGI突破,还表示羡慕20岁辍学生,称美难复制微信这类“全能App”。
Sam Altman自曝羡慕20岁辍学生,还直言美国难以复制微信这类“全能App”!
当地时间2025年开发者日,OpenAI推出系列开发者更新,向通用智能平台转型。会后,CEO Sam Altman接受专访,谈及新工具影响、AGI突破、智能体发展等,还表示羡慕20岁辍学生,认为美国难复制微信“全能App”模式。
大模型“精细化”对齐,真实性提升25.8%刷新SOTA!token级精准编辑,无需训练即插即用
北航团队在EMNLP 2025提出Token - Aware Editing (TAE)方法,从token层面解决传统表征编辑技术问题,无需训练、即插即用,在多个对齐维度显著提升,如在TruthfulQA任务上真实性指标提升25.8%。
RAG性能优化:基于RAGFlow自定义解析工具实现文本结构化(含源码教学)
文章围绕RAG性能优化展开,指出RAGFlow框架中DeepDoc解析算法不足,介绍开源与商业化解析工具优劣势及API调用和本地部署特点,推荐TextIn xParse,给出RAGFlow+TextIn知识库构建方法,还探讨了RAG优化方案。
重磅!Thinking Machines开山之作:大模型输出随机的根本原因被揪出,并开源终结方案
由OpenAI前CTO创办的Thinking Machines宣布上线技术研究博客,开篇文章揪出LLM输出随机的根本原因是负载及批次大小的非确定性变化,并给出系统性解法,还开源方案。
刚刚,OpenAI前CTO Mira Murati公司Thinking Machines Lab发文,揭开了大模型不确定性的真相
OpenAI前CTO Mira Murati创立的Thinking Machines Lab推出研究博客Connectionism,首篇文章聚焦LLM推理的非确定性问题。研究发现真正原因是批次不变性缺失,提出实现批次不变内核的方案,实验效果显著。
AI低质代码泛滥、API经济盛行,老牌科技厂商 F5 如何应对大模型应用“后遗症”?
F5亚太区CTO Mohan Veloo指出AI编程工具带来安全、低质代码、‘黑盒子’等问题。F5调查显示企业业务AI驱动下,安全成挑战。F5推出ADSP平台应对,还发布AI Gateway、AI助手等产品。