「非确定性」共找到 666 篇相关文章
Claude Opus 4.6推出极速模式:速度提升2.5倍,价格狂飙6倍
Anthropic官方宣布Claude Opus 4.6极速模式上线,速度比标准版快2.5倍,已向Claude Code和API用户开放。它非新模型,是重配置,价格更高,官方有优惠,还介绍使用方法、场景及限制。
2026开年王炸模型MiroThinker 1.5实测:Google和GPT没做到的事,被它做到了
自媒体从业者实测开源模型MiroThinker 1.5,它不拼参数规模,注重去伪存真。在多场景测试中表现出色,如投资决策、内容查证等。其技术揭示大模型未来或在于外部交互,而非参数膨胀。
字节手里的牌,比收购 Manus 更狠 - AnyGen 体验一周有感
本文作者分享使用字节海外推出的通用AI Agent产品AnyGen的体验,介绍其功能亮点、多场景测试效果,对比竞品,认为它定位职场场景,性价比高,或引领通用Agent竞争转向用户体验。
检索做大,生成做轻:CMU团队系统评测RAG的语料与模型权衡
CMU团队在最新ECIR接收论文中,系统评估RAG语料规模与生成模型规模替代关系。实验表明,语料扩容可让小模型追上大模型,提升主要来自证据覆盖。研究为RAG系统提供更具性价比提升路径。
Vibe Coding 产品最大的错觉,是以为自己真的有护城河
Base44创始人Maor Shlomo认为Vibe Coding工具易被复制,技术护城河难寻。他指出真正的护城河是“垂直整合”,构建全栈平台很关键。还谈到市场竞争、软件发展趋势、公司策略等多方面内容。
模型汤新做法!Meta|提出“类别专家汤”:SoCE,大幅提升模型性能,刷新SoTA!
大语言模型领域,提升性能常需高算力、大量数据和长时间训练。Meta提出新型模型汤技术SoCE,通过分析类别相关性操纵模型权重,在BFCL上刷新SOTA记录,为开源社区指明低成本进化之路。
LangChain 不看好 OpenAI AgentKit:世界不需要再来一个 Workflow 构建器
OpenAI发布工具集AgentKit,含可视化画布Agent Builder。LangChain创始人Harrison Chase锐评,市场不需要这种可视化工作流构建器,因其不是真正的Agent构建器,且面临高低复杂度问题挤压。
剑桥揭开大模型翻车黑箱!别再怪它不懂推理,是行动出错了
剑桥大学等机构研究指出,大模型执行长时任务易翻车,问题不在推理而在执行能力。研究人员评估多个指标,发现单步准确率提升可让任务长度指数增长,还研究了自条件化等影响及模型规模的作用。
The Batch: 880 | 用 AI 学 2 小时 vs. 跟老师学 6 小时
Alpha School用AI驱动教学,将传统6小时课程替换为2小时个性化学习,让学习速度翻倍,学生考试成绩优异。但部分教育委员会拒绝其分校申请,批评者称缺乏严格证据。此外,美国多地也在进行AI教育尝试。
DeepMind哈萨比斯最新认知都在这里了
谷歌DeepMind CEO哈萨比斯在访谈中谈AGI,称若未来十年实现,将开启科学黄金时代。他指出当前AI瓶颈,如非真正“博士级智能”、无“真正创造力”,还介绍公司多模型进展及机器人战略等。