玄戒O100」共找到 730 篇相关文章

开源动态7

开源要变天了,刚刚,OpenAI开源gpt-oss-20/120b,o4-mini水平,主打Agentic

OpenAI正式开源gpt-oss模型,Anthropic推出Claude Opus 4.1,Google DeepMind发布Genie 3。gpt-oss有20B和120B两个版本,前者可在边缘设备运行,后者综合能力强,在多方面表现出色。

PaperAgent
开源动态8

Qwen全面升级非思考模型,3B激活、256K长文、性能直逼GPT-4o

Qwen全新非思考模型Qwen3-30B-A3B-Instruct-2507上线,仅激活3B参数,性能媲美顶尖闭源模型。相比前代,推理、对齐和长文本处理能力大幅提升,在通用能力上也全面进步,适合复杂人机交互应用。

量子位
算法论文7

超越Claude 3.5和o1!8B模型靠「分层投票+测试时训练」逆袭

近日MIT研究者发现测试时训练在大模型应对复杂推理问题时,能分解任务提升回答准确率。8B的lemma3模型经此方法,在ARC和BBH数据集上性能显著提升,超Claude 3.5等。但该策略部署效率低。

新智元
新闻资讯7

不会被AI替代?100年前的农民也这么想的,这些图表让你害怕!

文章指出没有工作能逃过AI替代命运,以农业、制造业岗位变化为例,说明AI将使人力需求减半。微软和谷歌超30%代码由AI编写,还提到人们对AI威胁认知不足,探讨了AI时代谁是受益者等问题。

新智元
开源动态8

谷歌开源Gemma 3n:2G内存就能跑,100亿参数内最强多模态模型

本周五凌晨,谷歌正式发布、开源全新端侧多模态大模型 Gemma 3n。它有多模态设计、专为设备端优化等特性,核心是 MatFormer 架构,还采用了 PLE 技术等,在多方面实现质量提升。

机器之心
算法论文8

新SoTA方法RM-R1:让reward model对评分说出原因!超越GPT4o

过去模型‘黑箱打分’不透明、不灵活。论文提出ReasRM,经两阶段训练,让奖励模型像人类先思考再打分。它能分任务类型、动态奖励,实验中碾压GPT - 4,小模型逆袭,团队已开源6个模型。

深度学习自然语言处理
算法论文8

7B打败o3、GPT-5!医学AI智能体让模型学会“看哪里、怎么看”

上海创智学院LeapQuest团队联合多校,在ICML 2026接收两篇论文,提出“Think with Images/Think with Videos”范式,让视觉证据参与模型推理,Ophiuchus和MedScope分别用于图像和视频诊断,表现出色。

量子位
新闻资讯8

给AI发100美元去二手市场捡漏,结果它给自己买了19个乒乓球

2025 - 2026年,Anthropic进行“Project Deal”实验,让69个Claude智能体在真实双边市场自主交易,完成186笔超4000美元交易。实验发现模型能力影响交易结果,还揭示了AI代理交易存在的问题和隐忧。

DeepTech深科技
新闻资讯7

月下载破亿工具链被OpenAI打包收购!Python包管理神器uv现在姓O

OpenAI与uv开发商Astral官宣达成收购协议。交易完成后,Astral团队将加入OpenAI的Codex团队。OpenAI承诺继续支持uv等开源工具,还想让AI参与软件开发全流程,提升编程效率。

量子位
新闻资讯8

29个月增长100倍:一个AI 2.0公司应该怎么建?HeyGen的取胜的秘密

AI视频生成公司HeyGen在29个月内ARR从100万美元增长到超1亿美元。创始人Joshua Xu公开取胜秘密,即独特运营模式‘The HeyGen Way’,包括拥抱变化、匹配节奏、最小化快速验证迭代等理念。

AI工程化