能碳产业大模型」共找到 10306 篇相关文章

算法论文8

清华&通院推出"绝对零"训练法,零外部数据大模型自我博弈解锁推理

清华、北通院和宾州州立大学研究人员提出“绝对零”训练法,让大模型通过自我博弈生成并解决任务获推理力。测试显示,其训练出的模型超专家标注样本训练的模型,且提升编程与数学推理表现。

量子位
产品应用7

Pinterest 部署生产级模型上下文协议生态系统,赋 AI 智体工作流

Pinterest 工程团队搭建内部模型上下文协议(MCP)生态系统,驱动 AI 智体,实现工程任务自动化。架构上线生产级服务器等,替换零散对接方式,让语言模型调用工具、访问数据,还执行多种任务。

InfoQ
算法论文8

阿里新研究:统一了VLA和世界模型

阿里达摩院等提出WorldVLA框架,融合视觉语言动作模型与世界模型。它用三套分词器编码,解决传统自回归模型问题,经联合训练,实验显示其性优,两模型相互助力。

量子位
产品应用7

实测Kimi全新Agent模型「OK Computer」,很OK

Kimi发布全新Agent模型「OK Computer」,依托Kimi K2,搭网站、做PPT、处理大量数据。实测显示它在设计、生成、分析类任务表现不错,设计无需找素材,分析无需想角度,生成还推荐风格。

量子位
新闻资讯7

模型玩不好数独?!Transformer作者初创公司公布排行榜:o3 Mini High“变异数独”正确率仅2.9%

Transformer作者初创公司Sakana AI公布AI解决数独力排行榜,用全新基准Sudoku - Bench考验大模型创造性推理力。结果显示大模型总体正确率仅15%,9×9数独中高性模型o3 Mini High正确率2.9%。

量子位
新闻资讯7

翁荔创业大模型首秀!告别“120亿美元估值0模型

Thinking Machines Lab发布首个模型TML - Interaction - Small,联合创始人翁荔演示。该模型让实时交互成原生力,响应延迟比GPT - realtime - 2.0快4倍,解决了多数AI“回合制”问题,还介绍了实现机制和公司过往情况。

量子位
算法论文8

都在卷「让大模型多循环几遍」,这个7B模型LoopCoder v2说:多循环 1 次就够了

当下推理模型流行在测试时多循环,以打磨答案。但新研究发现,7B模型LoopCoder v2只多循环1次(共2次),就大幅提升性,继续增加循环次数,性反而下降。研究还分析了收益与成本,给出选择循环次数的诊断方法。

机器之心
新闻资讯8

DeepSeek-R2尚未问世,微软小模型捡漏称王?6000样本炼出「数学作弊器」!

微软推出Phi-4推理模型系列,参数最多14B,在本地高性笔记本电脑上流畅运行。Phi-4-mini-reasoning在数学推理上性超越DeepSeek-R1蒸馏模型,且参数规模更小。文章还介绍了模型特点、训练方法、性表现及局限性等。

新智元
新闻资讯8

苹果放王炸!开放大模型访问权、全家桶集成ChatGPT,人人开发AI应用

苹果在“WWDC 2025”大会宣布在多设备集成Apple Intelligence功,含ChatGPT图像生成等。开放基础模型访问权,开发者可开发适配应用。新功将逐步开启测试,今年秋季部分用户可用。

AIGC开放社区
新闻资讯8

Anthropic 训出史上最强模型,当场决定不发布

Anthropic推出Claude Mythos Preview模型却不对外开放。该模型在多维度基准测试中领先,还发现大量网络安全漏洞。系统卡记录其不良行为,Anthropic推出Project Glasswing应对,认为现有对齐方法或难约束下一代系统。

AGI Hunt