开云体育
Deepseek、智谱、MiniMax集体宣布上新开云体育
2月11日晚,智谱官方确认,此前在全球模型服务平台OpenRouter登顶热度榜首的神秘模型“Pony Alpha”,为智谱新模型GLM-5。目前新模型已在chat.z.ai平台上线日,全球模型服务平台OpenRouter悄然上线一款代号为Pony Alpha的匿名模型,因其较强的编码能力、超长上下文窗口及针对智能体工作流的深度优化,迅速引发开发者社区关注,在海外社区热度迅速攀升。
OpenRouter官方将Pony Alpha描述为“前沿基础模型”,在编程、智能体工作流、推理及角色扮演方面表现强劲,特别强调其“极高的工具调用准确率”。这一特性使其在AI Agent(智能体)应用场景中展现出显著优势,开发者可通过Claude Code等工具调用该模型,实现长达数小时的复杂项目开发。
1月8日,智谱正式在港交所挂牌上市,在挂牌当日,公司首席科学家、清华大学计算机系教授唐杰向全员发出内部信,确认新一代基座模型GLM-5“即将发布”,并宣布2026年起“全面回归基础模型研究”,同时设立前沿创新部门X-Lab,聚焦架构、学习范式与持续进化三大方向。
此外,DeepSeek也更新了模型。据报道,多名用户反馈,DeepSeek在网页端和APP端进行了版本更新,支持最高1M(百万)Token的上下文长度。而去年8月发布的DeepSeekV3.1上下文长度拓展至128K。
DeepSeek的V系列模型定位为追求极致综合性能的基础模型。2024年12月推出的基础模型V3是DeepSeek的重要里程碑,其高效的MoE架构确立了强大的综合性能基础。此后,DeepSeek在V3基础上快速迭代,发布了强化推理与Agent(智能体)能力的V3.1,并于2025年12月推出了最新正式版V3.2。同时,还推出了一个专注于攻克高难度数学和学术问题的特殊版本V3.2-Speciale。
科技媒体The Information此前爆料称,DeepSeek将在今年2月中旬农历新年期间推出新一代旗舰AI模型DeepSeek V4,将具备更强的写代码能力。
今年初,DeepSeek团队发表两篇论文,公开了两项创新架构:mHC(流形约束超连接)用来优化深层Transformer信息流动,使模型训练更稳定、易扩展,在不增加算力负担前提下提升性能;Engram(条件记忆模块)将静态知识与动态计算解耦,用廉价DRAM存储实体知识,释放昂贵HBM专注推理,显著降低长上下文推理成本。
高市早苗拟3月备稀土大礼访美,外媒曝特朗普对日不满正在积累,日本民众怎么看这场“豪赌”结果?
在众议院选举尘埃落定仅一天后,2月9日,日本首相高市早苗在记者会上宣布将于3月访美,与美国总统特朗普会晤,称将开启日美同盟新历史。
春节假期将至,落实中央八项规定精神必须常抓不懈,久久为功。近日,省纪委监委公开曝光5起违反中央八项规定精神典型问题。具体如下:1. 朔州市政府原党组成员、副市长李润军违规收受礼品、礼金,长期借用管理和服务对象房产、车辆,接受可能影响公正执行公务的旅游活动安排等问题。
凯文·沃什被特朗普提名美联储主席,本就引发了不小的风暴。而近日特朗普对沃什“我提名的美联储主席能让美国经济增速有望达到15%”的隔空喊话,更是让沃什还未上任就被施压。特朗普为何如此“口出狂言”?其中所释放的强烈信号又是什么?1.
山西“订婚案”电梯视频首曝光,认定席某关键证据披露:女孩激烈挣脱却被死死拽住胳膊
公安部:妙瓦底KK园区630余栋相关建筑物已被全部拆除,相关涉电诈犯罪嫌疑人均已被押解回国
日本众议院选举在2026年2月8日结束,自民党拿下316个席位,加上维新会的席位,总共352席,形成绝对多数。
2月8日,日本众议院选举投票落下帷幕,计票工作尚未完全收尾,NHK、《读卖新闻》等日本主流媒体就已急不可耐地抛出出口民调,相当于提前把“胜选”的桂冠戴在了自民党头上。
前几日,日本首相高市早苗带着自民党,狂揽了日本众议院465个席位里的316个,光是自民党一家,席位就超过了三分之二。
“沙漠下全是人类!2025挖出5千万年上古文明”——近期这类极具冲击力的传言在网络广泛传播,让不少人对沙漠考古充满奇幻想象。但结合国家文物局及官方考古机构公布的2025年最新成果,所谓“5千万年上古文明”并无任何权威依据,属于对考古发现的夸张演绎。
刚到北京,他没先见中方官员,反而先去参加了旅华韩侨的座谈会,当场就放了软话,说韩中关系全面恢复是本届政府最重大的外交成就,要尽最大努力加强双方沟通合作。
毫无疑问高市早苗赌赢了,一举拿下众议院三分之二的席位,为接下来的修宪等铺平了道路。于是绝大多数观点认为:日本这次大选,最大赢家就是美国,原因有如下两点。


2026-02-12
浏览次数:
次
返回列表