人在回路」共找到 8750 篇相关文章

新闻资讯7

顶模 Fable 5.1发布,到底强了多少?

昨晚,Anthropic发布Fable 5.1和Mythos 5.1,这代沿用Fable 5参数,性能提升聚焦长任务,还降低缓存读取价。它游戏、视频等多个领域表现出色,与同类模型对比进步明显,虽价格贵,但能力、速度有提升。

鲸选AI
开源动态8

腾讯混元开源 4 个小尺寸模型,主打 Agent 和长文

8月4日,腾讯混元开源四款小尺寸模型,参数为0.5B、1.8B、4B、7B,消费级显卡可运行,适用于低功耗场景。模型具备推理快、性价比高特点,亮点是Agent和长文能力,已腾讯多业务应用。

InfoQ
算法论文8

谢赛宁团队新基准让LLM集体自闭,DeepSeek R1、Gemini 2.5 Pro都是零分

纽约大学等8家机构研究者提出LiveCodeBench Pro竞技编程基准测试,评估了Gemini 2.5 Pro等前沿大模型。发现当前模型有显著不足,无外部工具时,高难度题通过率为0,LLM与类大师级水平差距明显。

机器之心
算法论文8

Meta「透视」AI思维链:CRV推理诊断,准确率达 92%!

Meta FAIR团队论文中提出CRV方法,可实时观察AI思维过程。它通过改造模型大脑结构,让推理可见。算术推理实验中,检测精度提升到92.47%,还能让模型修正错误。不过该技术落地尚面临诸多挑战。

新智元
新闻资讯8

云计算一哥,刚刚重新定义了AI Agent的玩法

亚马逊云科技纽约峰会上重新定义AI Agent部署方式,发布Amazon Bedrock AgentCore工具包,还推出Marketplace中的AI Agents和工具、Amazon Nova定制化功能等,数据层和编程应用也有新动作,展现其AI Agent战略布局。

量子位
新闻资讯7

LLM会梦到AI智能体吗?不,是睡着了也要加班

新智元报道,Bilt部署数百万智能体,让AI“睡眠”中整理记忆,评估互动,决定信息存储位置。AI记忆与脑差距大,Bilt和Letta实验展现“主动智能”雏形,提高模型表现。行业也突围AI记忆缺陷问题。

新智元
开源动态8

DeepSeekV3.2技术报告还是老外看得细

ChatGPT三岁生日时,DeepSeek两款开源模型DeepSeek-V3.2和DeepSeek-V3.2-Speciale引发热议。它们智能体评测中表现出色,缩小了开源与闭源模型差距,还降低了成本,给硅谷闭源AI公司带来压力。

量子位
开源动态8

不止于快!美团新推理模型正重新定义「实用主义AI」

美团发布并开源推理模型 LongCat-Flash-Thinking,它权威测评表现突出。该模型有多项创新,能更快、更能干、更可靠。其将技术实力转化为业务服务能力,实战测试表现佳,体现美团实用主义 AI 路径。

InfoQ
产品应用7

拍我AI V5模型发布,AI视频的“不可能三角”被解开了?

拍我AI推出V5模型,一上架就到Artificial Analysis榜单前列。它多维度升级,维持速度和性价比优势,试图解开AI视频生成“不可能三角”。文章实测其运动、二次元、商业等场景表现,还提及速度与价格优势。

花叔
新闻资讯7

甲小姐对话黄伟:一边“找死”,一边活下去 | 甲子光年

云知声创始黄伟创业13年、筹备上市5年,其经历反映中国AI企业生存真相。他分享云知声上市波折、战略选择、应对竞争策略等,如‘等死’与‘找死’间抉择,认为市场分散利于创业公司,AI 2.0竞争更激烈。

甲子光年