多阶段推理系统」共找到 4051 篇相关文章

新闻资讯8

Meta 143亿挖角后的首个作品:Alexandr Wang 推出闭源模型,杨立坤点赞

沉寂9个月后,Alexandr Wang带队的Meta发布新一代模型Muse Spark。它是原生多模态推理模型,性能媲美Gemini Pro和GPT 5.4,在多领域有应用潜力。不过闭源引争议,且在部分领域有短板。

InfoQ
新闻资讯8

黄仁勋,开启智元(Token)时代

全球大模型进入千万亿智元(Token)时代,OpenRouter年化智元用量突破一千万亿,对应推理支出约10亿美元。黄仁勋在GTC大会提出「智元(Token)经济学」,智元成AI时代核心经济标尺,重塑产业规则。

新智元
推荐文章8

AI 开发时代的“能力暴露与禁止空间”方法论:TPDD 与高层测试闭环

文章指出大模型加速软件开发范式演进,AI 深度介入开发带来新生产路径,但也放大风险。作者提出 TPDD 方法论,通过提前定义测试点与边界条件,平衡能力利用与风险控制,确保系统可控、安全、可持续。

InfoQ
开源动态7

狂涨12.6K star!Shell命令即搞定可视化监控,超级6~~

开源君分享简单轻量的开源项目Sampler,它能通过YAML配置文件实现系统指标监控与可视化,支持多平台,收获12.6K star。其有简单易用、跨平台等特色,安装后创建配置文件即可使用。

开源先锋
算法论文8

刚刚!UCLA杨林团队证明:仅凭提示词,Gemini 2.5 Pro就可以拿到IMO2025金牌

加州大学洛杉矶分校杨林和黄溢辰撰写论文,阐述利用Gemini 2.5 Pro解决2025年IMO竞赛5道题达金牌水平。设计解题者和验证者构成的自我验证流水线,用双提示词系统迭代,还规避数据污染问题。

AI寒武纪
新闻资讯7

数学题干带猫AI就不会了!错误率翻300%,DeepSeek、o1都不能幸免

研究发现,在数学题后加如“猫一生绝大多数时间都在睡觉”这类话术,会让大模型答错概率翻3倍,DeepSeek - R1、OpenAI o1等推理模型中招。研究探索攻击方式,总结出三种攻击模式。

量子位
产品应用8

揭秘夸克首个高考志愿大模型!蒸馏数百名人类专家经验、Agent 可完整生成志愿报告

6月12日,夸克发布国内首个高考志愿大模型,上线‘高考深度搜索’等三大核心功能。其‘志愿报告’以Agent运行,能输出完整报告;模型经多阶段训练,搭载最大高考知识库,为考生提供精准志愿填报服务。

AI科技大本营
推荐文章8

WaveSpeedAI 成泽毅:AI Infra 本来就是一门能挣钱的生意

WaveSpeedAI成泽毅本在大厂做Infra,后创业。他先在社区验证技术价值,创业首日就定全球化策略。WaveSpeedAI团队小而灵活,用利他思维合作,在视频生成领域降成本,验证了推理基建有市场。

Founder Park
推荐文章8

/phodal-writer:如何把十年写作经验整理成一个 Skill

作者Phodal分享将十年写作经验整理成写作Skill的过程。指出用AI写作输出不稳定,问题在于未将写作决策工程化。经样本整理、模式提取、规则改写等步骤,形成可复用的写作系统,强调其可放大经验可迁移性。

phodal
7

AI战争机器Palantir创始人彼得·蒂尔,今日举办绝密集会,反AI监管

彼得·蒂尔在罗马举办绝密集会,反对AI监管,将监管呼声视为威胁,称监管者是“反基督”。这与教皇对AI风险的警告相悖,反映出科技资本与政治力量深度绑定,AI竞争进入争夺“未来秩序”解释权阶段

新智元