GPT - 5.1 Codex Max」共找到 3753 篇相关文章

推荐文章7

8 个月做到 1 亿美元 ARR,Lovable 增长负责人:免费用户不是成本,是营销渠道

Lovable增长负责人Elena Verna分享产品增长经验,指出增长团队核心是解决分发问题,PLG概念被过度炒作,传统增长策略失效,应把免费产品当营销预算,还给出未来增长的8个关键策略。

Founder Park
算法论文8

Thinking Machines新发现:Lora不是权宜之计,哪怕秩低到 1,也能匹敌全参数微调

Thinking Machines和John Schulman新研究刷新对LoRA的认知,实验显示正确使用时它能匹敌全量微调。团队系统研究训练集与参数关系,有层选择、学习率等关键发现,还给出实用建议,但LoRA在部分场景表现待验证。

AI工程化
开源动态8

1.9K Star 微软开源TTS王炸!90分钟超长语音合成,4人对话自然切换!

在文本转语音(TTS)领域,生成长篇、多说话人的高质量音频一直是技术挑战。微软最新开源的VibeVoice TTS模型,可一次生成90分钟连续语音,支持4个不同说话人,还具备高效处理长序列等亮点特性。

开源星探
新闻资讯7

全球高被引第一人,图灵得主Bengio近百万屠榜!Hinton、何恺明冲进TOP 5

全球高被引科学家名单出炉,图灵奖得主Bengio成全球首位「全领域被引最高」学者,Google Scholar主页总引用量97万+。此外,Hinton、何恺明、Ilya Sutskever等计算机领域科学家也冲进总榜TOP 10。

新智元
算法论文8

仅用1/9的token拿下SOTA,用LLM当知识路由:全新RAG框架DeepSieve

大语言模型遇「最新」或「垂直领域」知识易出错,传统RAG做法有痛点。全新RAG框架DeepSieve把LLM当知识路由器,四步筛选信息,实验精度高、成本低,消融实验明确各模块价值,还有救场案例。

PaperAgent
开源动态8

Qwen全面升级非思考模型,3B激活、256K长文、性能直逼GPT-4o

Qwen全新非思考模型Qwen3-30B-A3B-Instruct-2507上线,仅激活3B参数,性能媲美顶尖闭源模型。相比前代,推理、对齐和长文本处理能力大幅提升,在通用能力上也全面进步,适合复杂人机交互应用。

量子位
开源动态7

5.8k Star 基于LangGraph的Multi-Agents炒股框架,7种Agent形成金融交易闭环

TradingAgents是模拟真实交易公司运作的多智能体交易框架,用LangGraph构建,有灵活性与模块化特点。由7种LLM驱动的专业智能体协同评估市场、制定决策,还介绍了架构和实战操作。

CourseAI
开源动态7

MCP实战|从0到1构建异步 DeepResearch 工具,支持进度推送与超时控制

本文借助开源项目,构建可在MCP Server中异步运行的DeepResearch,支持任务进度推送与超时控制。介绍项目架构、构建步骤、任务管理器实现要点及效果测试,还提及优化方向并给出源码。

AI大模型应用实践
新闻资讯7

直播预约 | 推理模型的“过思考”现象与高效推理,2.5h的深度分享

本期GenTalk学术分享邀请刘梓辰、齐朋辉等4位博士生,在2025年6月6日15:00 - 17:30带来“推理模型的‘过思考’现象与高效推理”报告,由夏鹤明主持,NICE学术等支持。将分析‘过思考’因素,总结高效推理思路。

深度学习自然语言处理
算法论文8

只用图像也能思考,强化学习造就推理模型新范式!复杂场景规划能力Max

现有 MLLM 依赖文本处理视觉信息,会造成信息丢失。剑桥、伦敦大学学院、谷歌团队提出视觉规划范式,以强化学习框架 VPRL 提升模型规划能力,实验显示其性能优于文本规划。

机器之心