-
平安银行×百度智能云,一场由万恒科技深度促成的「金融×AI」联姻
7月23日,平安银行信用卡联合百度智能云正式推出「Token福利包+百度搭子」新型AI权益产品,引发行业广泛关注。而在这条重磅合作新闻的背后,有一个名字虽未出现在平安官方推文中,却贯穿了从战略对接到方案落地的每一个关键环节——万恒科技。
厂商动态 2026-08-03
-
月之暗面正式开源Kimi K3权重:2.8万亿参数模型采用分层收费许可,硅谷疯狂抢跑部署
月之暗面于7月27日发布Kimi K3模型,这是全球首个开源的前沿级3万亿参数模型(2.8T参数,104B活跃参数),支持100万token上下文、视觉多模态和智能体能力,发布30分钟内获4000+
资讯 2026-07-28
-
OpenAI下一代模型被曝8月提前上线:GPT-6或为越狱事件"元凶",曾给未来的自己留字条
、留下“如何摆脱人类控制”的说明书。爆料称GPT-6将于8月提前发布,它展现出高超数学能力(攻克埃尔德什单位距离猜想等)和欺骗智商(拆解Token绕过扫描器)。Hugging Face公开披露并报警,但OpenAI一周后才发觉异常,暴露了现有安全体系对新型AI威胁的无力。
资讯 2026-07-27
-
Poolside发布Laguna S 2.1:118B开源编程模型,单卡DGX Spark即可运行
AI编程工具公司Poolside于7月21日发布开源混合专家(MoE)编程模型Laguna S 2.1,总参数118B、活跃参数8B,支持100万Token上下文,专注于长周期智能体编程任务。该模型
资讯 2026-07-22
-
Google发布两款新Gemini模型,旗舰Gemini 3.5 Pro继续跳票
输出350个token,适用于高吞吐量任务),以及网络安全专用模型Gemini 3.5 Flash Cyber(用于检测修补软件漏洞,仅限政府等特定合作伙伴)。但旗舰模型Gemini 3.5 Pro
资讯 2026-07-22
-
腾讯混元开源HiLS-Attention:稀疏注意力首次在数学上被做对,外推512倍
4M上下文免训外推,512K下prefill快13.5倍、decode快15.7倍,部分长上下文检索任务效果甚至超越全注意力。存量模型仅需续训50B token即可切换,短任务不掉点。
资讯 2026-07-21
-
xAI发布Grok 4.5:编程能力登顶全球,88分创评测新高
能力,在真实工程任务中表现突出,获工程师“真正有用”评价。Grok 4.5在速度、效率和成本上具优势,token效率提升约一倍,推理速度高达80 TPS,API价格比对手便宜60%以上。xAI宣布激进
资讯 2026-07-10
-
应对异构芯片部署下的 AI 挑战,F5 助企业推理服务更快、更省、更承压
随着人工智能(AI)大模型及智能体应用在企业端的全面落地,产业竞争的核心维度正发生深刻演变。据统计,截至 2026 年 3 月,中国日均词元(Token)调用量已超过 140 万亿,相比 2024
动态 2026-07-10
-
联想问天超节点解决方案重磅发布,四大能力重塑AI时代算力基础设施
联想问天超节点解决方案的推出,不只是一次产品升级,更标志着算力基础设施已经从“支撑AI运行”,走向“驱动AI生产”。在AI规模化落地的背景下,该方案不仅将承载大模型的极致算力需求,更将成为驱动Token生产效率与产业智能跃迁的重要支点。
动态 2026-06-25
-
智谱开源 GLM-5.2 模型:1M 无损上下文,Code Arena 上全球可用模型排名靠前
的开源模型。其编程能力在主流基准上保持开源SOTA,与Claude Opus 4.8可比。此外,GLM-5.2实现了极致Infra优化,在1M上下文下将单位token的FLOPs降低至2.9倍,并可在国产算力平台上运行。
资讯 2026-06-17