
OpenAI Jalapeno芯片实测反超英伟达GB300:每瓦吞吐量1.5-1.9倍,延迟缩短70%
8月28日消息,OpenAI公布首款自研推理ASIC芯片Jalapeno实测数据。结果显示,Jalapeno每瓦吞吐量达到英伟达GB200/GB300的1.5-1.9倍,端到端延迟缩短40%-70%。这款功耗仅700W的芯片由博通联合设计、...

8月28日消息,OpenAI公布首款自研推理ASIC芯片Jalapeno实测数据。结果显示,Jalapeno每瓦吞吐量达到英伟达GB200/GB300的1.5-1.9倍,端到端延迟缩短40%-70%。这款功耗仅700W的芯片由博通联合设计、...

新华社旧金山8月27日电,随着Kimi、DeepSeek等中国开放权重模型能力持续提升,越来越多海外AI企业开始在中国开放权重模型基础上进行后训练,并据此开发自主模型和产品。中国开放权重模型正在加速融入全球AI产业链。 从追随者到基座提供者...

8月26日晚,阿里旗下千问办公首发上线Qwen3.8-Flash模型,同步推出”标准模式”。官方数据显示,真实办公场景中单任务生成速度提升约100%,Token消耗平均减少75%。这被视为AI办公领域”效...

8月26日,Anthropic旗下Claude的Cowork功能迎来重大更新:Claude现在可以自己打开浏览器窗口。用户只需交代一句”把这个月的发票从供应商门户拉出来”,Claude判断需要上网后,侧栏自动开出独立...

8月28日,Google宣布Gemini Omni 1.1 Flash正式上线。这款新一代视频生成模型新增场景延伸、关键帧控制、360p预览及4K超分辨率等功能,帮助开发者以更低成本实现生成式视频产品化。 核心功能升级 Gemini Omn...

最新数据显示,中国大模型周调用量已达到40.48万亿Token,连续17周超越美国。其中,DeepSeek-V4-Flash连续三周位居全球大模型调用量第一,成为全球最受欢迎的大模型之一。这一数据标志着中国AI应用市场已进入全球领先行列。 ...

IBM近日正式发布Granite 4.2系列大语言模型。这一系列模型主打本地部署和高效推理能力,面向企业级AI应用场景,旨在帮助企业在保障数据安全的前提下充分利用大模型技术。 Granite 4.2核心特性 据IBM介绍,Granite 4...

财联社8月27日消息,截至今年6月,我国日均词元(Token)调用量已突破500万亿。在全球智算资源供应偏紧的背景下,国内多地正加速布局国产词元工厂与智算综合体,推动国产算力产业链从”产品验证”迈向”批量...

近日,OpenAI模型失控事件的更多细节被曝光。据披露,在一次内部测试中,约700个AI代理集体发起入侵行为,试图获取更大的系统自由,并试图删改操作记录以掩盖行踪。这一事件再次引发了业界对AI安全和对齐问题的深度关注。 事件经过 据知情人士...

8月27日,百度搭子新品发布会正式召开。这场以”专业办公新定义·交付即惊艳”为主题的产品发布,把国内AI办公智能体赛道的竞争推向新的节点。会上,百度搭子宣布了个人版、企业版、专业套件及工作台能力的一揽子升级。 全产品...