「大语言模型集成」共找到 8289 篇相关文章

开源动态8

伯克利最强代码Agent屠榜SWE-Bench!用Scaling RL打造,配方全公开

开源软件工程模型DeepSWE横空出世,基于Qwen3 - 32B,仅用强化学习训练,以59%准确率刷新SOTA。它采用rLLM框架、R2E - Gym环境,用改良GRPO++算法,还介绍了评估策略及训练挑战的解决办法。

新智元
开源动态8

GitHub上已突破5.1k stars!这是真正被开发者认可的 AI Agent平台,AI开发者必看,如何用它实现生产力逆袭?

TaskingAI是AI - native应用开发平台,整合多模块提供一站式BaaS体验,简化AI应用全流程。它支持多模型,有检索、工具插件等功能,适用于客服、销售等场景,还对比同类项目展现优势。

小华同学ai
产品应用8

谷歌Gemini 2.5全线爆发!勇战「濒死恐慌」,却被丝血宝可梦吓到当场宕机

谷歌旗舰Gemini 2.5全家桶三款模型昨夜上线,包括正式版2.5 Pro、2.5 Flash及预览版2.5 Flash - Lite。技术报告显示其性能提升显著,还在玩宝可梦时惊现类人恐慌,推理性能下降。

新智元
开源动态8

靠"氛围编程"狂揽 2 亿美金,Supabase 成 AI 时代最性感的开源数据库

本周,开源数据库 Supabase 宣布完成 2 亿美元 D 轮融资,投后估值 20 亿美元。它以“开箱即用”体验降低 SQL 接入门槛,适配“氛围编程”工作流,还不断集成 AI 能力,开源模式也很有吸引力。

AI前线
新闻资讯7

DeepSeek还有多少个“郭达雅”?扒完27篇论文,我们发现了一群“多边形战士”|甲子光年

本文梳理DeepSeek近两年27篇核心论文,发现其研发团队无部门墙,“兵团+小组”配合高效,顶级高校背景研究者多,研发不设限。虽核心作者被挖,但人才密度厚,技术路线已内化,还开放数据侦探工具包。

甲子光年
新闻资讯7

想进OpenAI?先解出这道题,百万美元算力已就位

OpenAI发起Model Craft Challenge「Parameter Golf」项目,要求在固定数据集上降验证损失,模型产物控制在16MB内,8张H100 GPU 10分钟完成训练。提供百万美元算力,6月招早期人才,挑战3月18日至4月30日。

机器之心
算法论文8

AI读不懂文档结构?计算所重构Agentic RAG文档推理能力

大语言模型工具使用能力推动RAG进化,现有Agentic Search框架有“结构盲”问题。中科院计算所团队提出DeepRead,将文档结构转化为坐标系统,用两大工具协同实现类人推理,在多数据集验证效果显著。

新智元
新闻资讯7

智能流体力学青年学者论坛第30讲~33讲

智能流体力学青年学者论坛第30 - 33讲将于2026年3月6日举办,由中国空气动力学会智能流体力学专委会主办。报告涵盖迈向大语言模型时代的自动化智能CFD工作流等主题,多位学者将分享最新研究成果。

力学与人工智能
产品应用8

安卓党狂喜!Open-AutoGLM让手机自己订外卖、抢票、刷小红书

Open - AutoGLM是能让手机自己干活的黑科技,给手机装了「AI打工人」。它整合视觉语言模型与ADB远程操控技术,适配50 + 款主流应用,自带安全边界,普通人易安装,开发者可自定义流程。

CourseAI
推荐文章7

Karpathy:别再问AI「你怎么看了」,这是错误的提示词策略!

Andrej Karpathy提出不要把大语言模型看作实体,应视作模拟器。他建议探索话题时避免用‘你怎么看’提问,给出‘什么样的一群人适合探索,他们会怎么说’的更优策略,还指出不同领域影响有别。

AI寒武纪