深度研究智能体」共找到 5421 篇相关文章

开源动态8

DeepSeek开源的不仅仅是个新OCR模型。。。

DeepSeek开源3B参数的新OCR模型,重新思考AI处理长文本方式,用视觉token压缩文本信息。核心组件有DeepEncoder和DeepSeek3B - MoE解码器,实验效果好,成本降低,还解决了一些算法和工程问题。

AI工程化
产品应用8

阿里发布Qwen3-TTS:跨语言混合无缝切换,方言音色全面覆盖!

TTS技术从单一合成进化到多模态表达,但传统模型在跨语言/方言混合场景有不足,商业工具费用高且不开源,开源方案训练数据少。阿里推出Qwen3 - TTS,实现人类级自然度和表现力,功能强大,应用场景多。

开源星探
新闻资讯7

万象入模 风起琶洲 | 甲子光年

9月23日下午,「第四届琶洲算法大赛大模型前沿技术分论坛暨琶洲模方孵化项目展示」将在广州琶洲举行。届时,亚洲科学院院士等将分享见解,知名投资机构将齐聚,还有企业展示成果、进行辩论,共探AI产业未来。

甲子光年
产品应用7

释放创造力:解密 AI 贴纸生成器的“神级”提示词模板

文章介绍日本网友分享的 Gem 应用,可上传照片生成各种风格贴纸。详细阐述提示词模板概念、规律特点,还给出波普艺术、日式复古火柴盒等多种贴纸风格提示词库及可用情绪列表,最后鼓励读者动手尝试。

宝玉AI
算法论文8

每周7亿人都在如何用ChatGPT?OpenAI最全报告来了

OpenAI联合哈佛大学经济学家发表论文《How People Use ChatGPT》,基于内部对话数据,分析ChatGPT从2022年11月上线到2025年7月的使用情况。截至7月,周活超7亿,每周发消息180亿条。

量子位
算法论文8

告别随机性:Thinking Machines Lab如何实现了LLM推理的完全确定性?

文章指出LLM推理非确定性根源并非GPU并发和浮点非结合性,而是批大小变化致核函数非不变性。作者提出实现批不变操作的策略,实验验证有效,还阐述其对训练、系统可靠性等方面的意义。

深度学习自然语言处理
算法论文8

OpenAI解释LLM为什么会有幻觉

OpenAI和佐治亚理工联合论文《Why Language Models Hallucinate》深入探讨LLM幻觉根源,指出预训练阶段统计本质和评估体系激励扭曲是主因,还提出改革评估体系引入显式置信度目标的解决方案。

深度学习自然语言处理
算法论文8

首篇WebAgents综述:大模型赋能AI Agent,实现下一代Web自动化

互联网任务重复繁琐,香港理工大学研究人员从架构、训练和可信性等角度,总结WebAgents代表性方法,梳理研究进展。WebAgents能根据用户指令完成网页任务,其发展预示人机关系新纪元。

新智元
新闻资讯7

Karpathy戳破强化学习神话,首提AI复盘式进化!暴力试错将死

AI大神Karpathy发文指出强化学习(RL)有局限,效率随任务时长下降,与人类学习机制差异大。他提出复盘式进化Scaling范式,虽有很多细节待完善,但认为还有更多S型增长曲线待发现。

新智元
开源动态8

大模型首次直接理解代码图:不用Agent自动修bug,登顶SWE-Bench开源模型榜单

蚂蚁开源新模型CGM,首创将仓库代码图模态融入大模型,不依赖闭源模型和复杂Agent,仅需4步就能快速定位、生成补丁。它在多个测试基准中领先,技术论文等均已开源。

量子位