手机智能体」共找到 5206 篇相关文章

产品应用8

阿里电影级视频模型万相2.6系列上线,功比Sora2还全,人人都当导演

12月16日,阿里发布通义万相2.6系列模型,5款新模型同时上线,覆盖图像到视频多环节。它是国内首个支持角色扮演的视频模型,功比Sora2全,已上线阿里云百炼和万相官网。

AI前线
产品应用7

Qwen“半成品”推理模型刷下AIME满分,俘获大批国外开发者!实测碾压GPT-5 Thinking、还写侦探小说

阿里发布 Qwen3-Max-Thinking 早期预览版,虽是‘半成品’,在数学推理竞赛中达 100% 正确率。Qwen3-Max-Preview 多项测试领先,速度超 ChatGPT,还成 AnyCoder 默认选项,但未开源。实测表现有优有劣。

AI前线
算法论文8

告别微调!腾讯提出Training-Free GRPO:无需更新参数,还保证泛化性,成为传统RL的有力替代

大型语言模型在专业领域表现不佳,传统微调方法成本高、易过拟合。腾讯优图实验室提出Training - Free GRPO,无需更新参数,通过上下文学习提升性,成本低且泛化性好,是传统强化学习有力替代。

深度学习自然语言处理
开源动态8

马斯克转发字节Seed&哥大商学院新基准:大模型搞金融,连查个股价都出错

字节跳动Seed团队与哥大商学院推出开源金融搜索与推理基准测试FinSearchComp,含635个问题。评测显示大模型处理金融任务有差距,凸显金融AI力评估重要性,还揭示了关键力差距。

量子位
算法论文8

突破具身智“专家困境”!北大新方法让宇树G1靠单一框架掌握跳舞和侧

北京大学与BeingBeyond团队联合研发的BumbleBee系统,用创新的‘分治 - 精炼 - 融合’三级架构,实现人形机器人在多样化动作中的稳定控制,破解传统控制策略的‘专家困境’与‘现实鸿沟’。

量子位
新闻资讯7

喜当爹后,奥特曼自曝神经化学骤变!养娃为人类做出更优AI决策

OpenAI CEO奥特曼喜当爹后称优先事项改变,神经化学有骤变。其决策力曾受争议,现恰逢OpenAI推进“星际之门”计划,他还将AI发展比作看孩子成长,也提及行业或有泡沫。

新智元
产品应用8

16 年老程序员用 Claude Code 搞副业:我只敲了 1000 行,剩下 95% 代码靠自动生成

Anthropic公司的AI编码助Claude Code推出4个月吸引11.5万开发者,单周处理代码量达1.95亿行,预估年化收入约1.3亿美元。开发者Indragie用其构建macOS应用,2万行代码中写不到1000行,还分享使用技巧与体验。

InfoQ
算法论文8

AI一眼认出95万物种,还分辨雄雌老幼,2亿生物图像炼成“生命视觉”大模型

俄亥俄州立大学团队用2亿生物图像训练BioCLIP 2模型,取得最优物种识别性。它在无相应监督信号的非物种任务中,准确率远超DINOv2,还涌现出物种间生态对齐、物种内差异分离等生物学理解。

量子位
开源动态8

项目在GitHub上已获得约3600+star,探秘 ChatDoctor:LLaMA 微调后的 AI 医生,真在线问诊?

现代医疗资源不均、问诊效率低,ChatDoctor应运而生。它基于LLaMA微调,有医学对话微调等亮点,技术优势多,适用于在线问诊等场景,与同类对比优势明显,开源助力医疗对话模型发展。

小华同学ai
算法论文8

AI玩宝可梦找出30年前代码Bug!谷歌论文介绍AI通关全过程,复杂任务都

谷歌Gemini 2.5系列技术报告花长篇幅介绍Gemini 2.5 Pro玩《宝可梦蓝》,它通关游戏,展现出创造力与长期规划力,还发现游戏代码Bug,但也有幻觉、思维定势等问题。Claude 4已加入比赛。

量子位