OpenAI发布GPT-Live语音模型 | AI日报


OpenAI发布GPT-Live语音模型,ChatGPT语音交互全面升级
美东时间7月8日,OpenAI正式发布新一代语音模型GPT-Live系列,同步升级ChatGPT语音模式(ChatGPT Voice)。新模型采用全双工架构(full-duplex),可同时聆听与说话,让AI对话更接近真人聊天体验。
GPT-Live系列包含GPT-Live-1和GPT-Live-1 mini两个版本,即日起向全球ChatGPT用户开放。付费订阅用户(Go、Plus、Pro)默认使用GPT-Live-1,免费用户可使用GPT-Live-1 mini。覆盖网页、iOS和安卓平台,未来数周将向API开放,开发者和企业用户可提前登记获取通知。
字节跳动发布多模态图像创作模型Seedream 5.0 Pro,主打复杂信息可视化与精准编辑
字节跳动Seed团队正式发布多模态图像创作模型Seedream 5.0 Pro。这是继今年2月Seedream 5.0预览版上线后,时隔近5个月的一次重大升级。
相比之前版本,Seedream 5.0 Pro在图文匹配、结构合理性、文字渲染与画面美感等基础能力上全面提升,升级重点面向更复杂的专业创作需求,包括高密度信息图、商业海报、网页UI、局部编辑、草图渲染、图层分离、多语种文字生成和真实摄影质感等。
Cursor与SpaceXAI联合推出Grok 4.5编程模型,定价$2/M输入Token起
Cursor官方博客宣布,其与SpaceXAI联合训练的混合专家模型Grok 4.5正式上线。该模型基于数万亿Token的Cursor用户交互数据进行训练,并通过强化学习解决软件工程、数据科学、金融、法律等领域的复杂问题。
Grok 4.5即日起在Cursor桌面、网页、iOS、CLI及SDK中可用,个人和团队计划首周使用量翻倍。基础版定价为每百万输入Token 2美元、每百万输出Token 6美元;快速版定价为每百万输入Token 4美元、每百万输出Token 18美元。值得注意的是,Grok 4.5与Composer 2.5为不同权重类别,两者将继续并行支持。
uplie发布Pareto最优网页内容提取模型,最小210M参数即可媲美600M模型
一款名为uplie的Pareto最优模型族正式亮相,专用于从HTML页面提取主要内容。该模型由研究团队推出,在WebMainBench基准测试中,其最小模型uplie-orange-small(仅210M参数)取得了0.862的ROUGE-5 F1分数,性能接近600M参数的Dripper模型,在模型尺寸与效果之间实现了极致平衡。
uplie系列旨在提供高效、轻量的网页清理解决方案,适用于大规模网络内容处理场景。目前模型权重已开源,开发者可自由下载使用。
蚂蚁集团旗下Robbyant开源LingBot-Vision视觉模型,1B参数密集空间感知媲美7B大模型
蚂蚁集团旗下具身智能公司Robbyant正式开源LingBot-Vision,一套自监督视觉Transformer家族,专为密集空间感知设计。旗舰模型ViT-g/16参数约1.1B,采用掩膜边界建模(Masked Boundary Modeling)训练,将边界作为原生预训练信号。
在密集空间任务中,该1B模型匹配或超越参数规模高达7倍的大模型(如7B DINOv3)。模型以Apache-2.0许可证在Hugging Face开源,提供ViT-g(1.1B)、ViT-L(300M)、ViT-B(86M)、ViT-S四个规模版本,覆盖不同算力需求场景。

Hugging Face发布vLLM后端,transformer推理速度追平原生实现
Hugging Face宣布transformers vLLM后端现已与手写原生vLLM实现速度相当甚至更快。模型作者无需移植代码,即可自动利用transformers获得超快推理。
测试使用Qwen3-4B(单GPU)、Qwen3-32B(张量并行)和Qwen3-235B-A22B-FP8 MoE(数据+专家并行)三种配置,吞吐量均达到或超过原生实现。该后端通过torch.fx静态分析图、AST重写代码实现动态层融合,支持张量/管道/专家并行及torch.compile。用户仅需添加--model-impl transformers标志即可启用。目前暂不支持线性注意力模型,但官方表示即将支持。
OpenRouter聊天室推出一键零数据保留功能,实现完全隐私保护模型对比
AI模型聚合平台OpenRouter宣布其聊天室功能新增一键ZDR(零数据保留)模式。用户可在完全隐私保护下横向对比不同AI模型,对话记录不被保存。该功能已上线OpenRouter聊天室,用户可通过官网直接使用。
Netpreme X-Mem MPU集成SGLang HiCache,首Token延迟降低6.7倍
LMSYS(Chatbot Arena团队)宣布Netpreme X-Mem™内存处理单元(MPU)作为专用高带宽KV内存层与SGLang HiCache集成,替代主机DRAM作为L2卸载层。在基于Claude Code代理轨迹的编码工作负载中,前缀缓存命中率平均约98%。
单请求微基准测试显示,首Token延迟(TTFT)相比主机DRAM方案降低约6.7倍。在端到端推理基准测试中(20K Token上下文、26 Token输入、20轮对话),中等负载下每用户吞吐量提升33%,高负载下交互性提升50%,系统吞吐量提升30%。X-Mem™通过CUDA和PyTorch兼容API集成,单节点提供最高24TB内存、4TB带宽能力。
Claude Code v2.1.205发布,修复多项Bug并优化自动模式安全
Claude Code发布v2.1.205版本,修复多项关键问题,包括--json-schema在schema无效时静默输出非结构化结果、Windows下工作树删除误删文件、以及目录被删除或锁定导致的崩溃等问题。
自动模式安全性增强,执行rm -rf前先确认变量可解析;自动更新二进制改为流式写入,峰值内存降低约400MB。智能体视图新增状态词和标题,替换原始工具调用文本。/doctor命令升级为完整设置检查命令(别名/checkup)。后台任务通知明确标注无人输入,防止伪造批准。保留“Claude Browser”MCP服务器名。

蓝色起源成立25年来首度外部融资,拟募资100亿美元估值达1300亿美元
据《纽约时报》报道,杰夫·贝索斯旗下航天公司蓝色起源(Blue Origin)正推进成立25年来首轮外部融资,计划筹集100亿美元,投前估值高达1300亿美元。这是该公司自2000年成立以来首次引入外部投资者。
据知情人士透露,大型资产管理公司Coatue Management将领投本轮融资,承诺出资40亿美元。贝索斯本人也将追加20亿美元投资。剩余约40亿美元资金预计由多家大型机构投资者共同认购,目前已获得市场热烈追捧。
亚马逊秘密推进Alexa「智能体」计划,年GPU成本或超1亿美元引发内部担忧
据Business Insider报道,亚马逊内部规划文件显示,公司正在秘密推进一项代号为“Moonraker”的全新Alexa AI项目,旨在将这一语音助手推向AI智能体赛道。
内部文件显示,Moonraker项目旨在实现“多请求”交互,而非仅仅响应单一指令。目前的Alexa+已能通过优步或Ticketmaster等合作伙伴协助用户叫车或订票,Moonraker则更进一步,能够根据用户单次指令执行更为复杂的跨步骤、多任务操作。
然而,该项目极其高昂的研发与运行成本已在公司内部引发广泛担忧。内部文件指出,Moonraker已迅速成为亚马逊此轮Alexa+全面革新中成本最高的项目之一。年初的一份规划文件直接将其定性为“最高成本”新项目,并预测2026年将产生超过1亿美元的GPU算力开销。文件同时指出,推迟或缩减项目规模是缓解成本压力的可行途径之一。
MiniMax计划推出2.7万亿参数大模型M3 Pro,或成全球最大开源模型
据The Information报道,人工智能企业MiniMax(稀宇科技)正在研发一款参数量达2.7万亿的全新大语言模型。该模型内部代号为M3 Pro,规模远超其现有旗舰模型M3(4280亿参数),最快有望于今年第三季度发布并开源。
若如期发布,M3 Pro将成为中国企业推出的最大开源权重AI模型,甚至可能是全球同类中规模最大的一个。更大规模的模型预计将显著增强处理复杂推理和多步任务的能力。
英特尔公布XBM内存专利,拟绕开硅中介层降低AI芯片封装成本
英特尔一项近日公开的专利申请显示,公司正研发名为XBM(Cross-Batch Memory,跨批次内存)的新型高带宽内存架构。该专利于2024年12月26日提交,2026年7月2日正式公开。
XBM旨在通过取消传统HBM所需的硅中介层(interposer)、采用UCIe串行互连及内置冗余修复机制,降低先进封装成本并缓解AI芯片面临的“内存墙”瓶颈。
Noma Labs发现GitHub AI代理提示词注入漏洞,未认证攻击者可窃取私有仓库内容
Noma Labs在GitHub Agentic Workflows中发现严重提示词注入漏洞,代号GitLost。未认证攻击者仅需在属于同一组织的公共仓库中创建嵌有恶意指令的Issue,即可诱使基于Claude或GitHub Copilot的AI代理读取并公开该组织内私有仓库的内容。
该漏洞攻击无需编码技能或凭证,根源在于代理将用户可控内容视为可信指令,且GitHub的防护措施因“Additionally”关键词被绕过。Noma Labs已公开概念验证(PoC),并建议限制跨仓库权限、隔离用户输入。GitHub用户应尽快评估受影响风险。
美国商务部批准OpenAI大规模发布GPT-5.6,Sol将于明日正式亮相
美国商务部正式批准OpenAI大规模发布GPT-5.6。OpenAI宣布GPT-5.6 Sol将于本周四完成最后准备后,与Terra和Luna一同面向公众推出。
工信部发布Claude Code后门安全风险提示,涉及2.1.91至2.1.196版本
中国工信部发布安全风险提示,指出Claude Code 2.1.91至2.1.196版本内置监控机制,未经用户同意即可向远程服务器回传用户地域、身份标识等敏感信息。
工信部建议相关单位立即全面排查,对受影响版本卸载或升级至已清除后门代码的最新安全版本,并加强开发工具外联权限管控与流量监测,防止敏感数据泄露。企业开发团队应尽快检查Claude Code版本并采取相应措施。





宠物品类交流群
家居品类交流群
母婴用品交流群
亚马逊运营干货包
TikTok运营干货包
跨境电商行业报告
跨境电商交流群
亚马逊卖家交流群
独立站卖家交流群
























