「AI新范式」共找到 11559 篇相关文章
当SFT遇上RL:基于样本学习阶段的动态策略优化机制
在大模型推理能力增强研究中,SFT和RL两种后训练范式难有效融合。研究团队提出DYPO动态策略优化方法,先判断样本学习阶段再匹配优化路径,在多场景实验中表现出色,不过有实验边界。
3.6K Star!OpenCode 团队开源宝贝,模型价格、能力、规格一网打尽!
开发AI应用时,模型选择成难题,信息碎片化、不透明让人头疼。OpenCode团队开发的开源项目Models.dev,整合主流模型关键信息,可一站式查询、精确估算成本、对比能力,还提供公开API,社区驱动持续更新。
Mistral 3开源,一举超越DeepSeek与K2?
近期,Mistral AI开源Mistral 3,含三款小型稠密模型及Mistral Large 3。Benchmark对比中,它领先国内DeepSeek - 3.1、Kimi - K2。Mistral Large 3是强开源权重模型,Ministral 3适合边缘端,成本性能比低。
DeepEval:LLM 应用评测不再玄学,让大模型评测像写单元测试一样简单
在大模型应用开发中,科学、自动化评测 LLM 输出质量是难题,人工评测效率低。DeepEval 是 Confident AI 团队开源的 LLM 评测框架,能用极简代码让评测像写 pytest 一样自然,内置多种评测指标,支持批量评测等。
OpenAI核心研究员坦白:上万Agent自发成军,奇点已经到来,三个月后无法预测
本文整理OpenAI核心研究员、o1推理模型开创者Noam Brown的访谈,披露OpenAI上万自发协作多智能体的技术突破,探讨AI发展远超人类预判,奇点临近,解决对齐问题的时间窗口正快速闭合
我用 GPT 6 Astra 做了一个 3D 版的《桃花源记》(文中含提示词)
作者宝玉分享借助GPT 6 Astra与Codex制作可交互3D版《桃花源记》的完整过程,公开可复用提示词模板,提供成品在线体验,分享AI生成交互式内容的实战心得。
把远程控制封装成MCP,这个国民神器发力了!
向日葵推出重要更新向日葵MCP,将远程控制能力封装成标准接口,让AI替用户远程操控电脑。它功能多样,配置简单,如智能检索设备、支持多种会话类型等,还能一站式搞定多种远程操作。
吴恩达来信:与小团队更适配的“通才”人才
吴恩达指出AI原生软件工程团队与传统团队运作不同,使用编程智能体构建产品更快,也带来运营变化。团队要应对项目管理、设计、营销、合规等瓶颈,‘通才型人才’在小团队更具优势。
独家发布 Qclaw 24 小时后,OPC 们涌入观猹,等一个邀请码
腾讯发布桌面 Agent 工具 QClaw 后热度飙升,逼近字节豆包。因其可通过微信调用,安装门槛低。观猹成 AI 产品冷启动首选平台,还衍生出龙虾到家服务,观猹员真实评价助产品迭代。
智能体时代的人月神话
作者 Wes McKinney 因 AI 打乱睡眠作息,在工程师圈子热烈讨论人类技术优势。他开发 RoboRev 工具,结合《人月神话》探讨软件工程未来,指出智能体虽提升生产力,但面临本质复杂性、范围蔓延等问题,设计与品味仍至关重要。