OpenAI发布GPT-5.6系列模型 | AI日报


OpenAI发布GPT-5.6系列模型,编程跑分超越Claude Mythos 5
6月27日,OpenAI正式发布GPT-5.6系列模型,共推出旗舰版Sol、均衡版Terra和轻量版Luna三档。Sol定价为每百万Tokens输入5美元、输出30美元,Terra为2.5美元/15美元,Luna为1美元/6美元。不过应美国政府要求,该系列现阶段仅向少数"可信合作伙伴"提供预览权限,计划未来几周内公开上线。
此外,OpenAI还计划于7月在Cerebras上线GPT-5.6 Sol,速度最高可达每秒750 token。
DeepSeek联合北大发布DSpark推理加速框架,推理速度提升60%-85%
6月27日,DeepSeek联合北京大学正式发布DSpark推理加速框架,旨在解决大语言模型在高并发生产环境中的推理效率瓶颈。该框架已部署于DeepSeek-V4-Flash与DeepSeek-V4-Pro的预览版服务引擎中,相比此前生产环境采用的单token推测解码基线MTP-1,在同等吞吐量水平下可将单用户生成速度提升60%至85%。相关论文、训练代码等已在GitHub上开源。
新浪开源VibeThinker-3B:推理能力可压缩,事实知识仍需大参数
新浪近日开源了仅30亿参数的VibeThinker-3B模型,在AIME 2026数学基准和编程任务上表现持平DeepSeek V3.2等大200至333倍的模型,并在LiveCodeBench上超越所有20B以下模型,LeetCode竞赛中解决123/128题超过GPT-5.2和Kimi K2.5。但在知识密集型GPQA-Diamond评测中大幅落后。
该模型基于阿里Qwen2.5-Coder-3B,经过监督微调、强化学习和自蒸馏等多阶段后训练。研究团队提出“参数压缩-覆盖假说”,认为逻辑推理依赖少数可压缩模式,而广泛世界知识仍需大参数规模支撑。目前模型已全面开源。
Wayfinder Router发布:微秒级离线路由,无需调用模型即可决策
Wayfinder Router近日正式亮相,这是一款可在本地与托管大语言模型间进行确定性查询路由的工具。它通过分析提示词的结构特征(如长度、标题、列表、代码)和措辞(证明、数学、硬约束),在微秒级完成路由决策,完全离线运行且无需调用其他模型。相比依赖模型调用的RouteLLM、NotDiamond等路由器,它从根本上避免了延迟、成本和随机性问题。
该工具默认仅使用结构特征,词汇线索因查询未泛化而默认为关闭,用户可在自有数据上校准评分阈值。Wayfinder Router支持任何OpenAI兼容API,包括Ollama、Anthropic、Groq、vLLM等,可自托管部署,并提供终端和网页演示模式及基准测试工具。
Adrafinil上线:AI编码代理活跃时自动阻止Mac睡眠的菜单栏工具
Adrafinil是一款专为AI开发者打造的macOS菜单栏应用,其核心功能是在Claude Code、Codex、Cursor、Gemini CLI、Aider、Hermes、OpenCode、Cline、Pi等9种AI编码代理持有活跃会话时,自动阻止系统进入睡眠状态(包括合盖睡眠),而无代理工作时则恢复正常的睡眠机制,确保日常使用不受影响。

DeepSeek V4推出DSpark投机解码框架,推理速度提升80%
6月27日,DeepSeek V4迎来更新,推出全新投机解码框架DSpark,并同步开源全栈代码库DeepSpec。该框架基于DeepSeek-V4-Pro引入推测性解码模块,重点在于工程落地而非模型迭代,目前已部署于DeepSeek-V4(Flash和Pro)的真实线上流量中,大幅加速了LLM推理速度。
DSpark通过半自回归生成架构,将高吞吐量并行生成与负载感知验证结合,有效缓解传统草稿模型在后续位置上的接受率衰减问题,在高并发场景下显著降低端到端延迟。据官方数据,推理速度提升达80%,配套开源的DeepSpec则为训练和评估推测性解码草稿模型提供了全栈基础设施。
阿里千问输入法macOS版上线,支持AI自动润色与语音速记
6月27日,阿里旗下千问输入法macOS版正式上线官网,产品主打“说完即成稿”,支持最快300字/分的语音输入速度,并内置AI自动润色功能,可将口语化表达实时转换为工整文字。该版本还支持9种方言识别,宣称纯净无广告。
官方同步预告,iOS版、Android版及Windows版将于近日发布。据悉,千问输入法是千问团队推出的独立App,旨在填补其在移动端AI输入法赛道的空白,与PC端语音输入法形成差异化,在键盘操作和AI功能上更贴合手机端使用场景。
6月26日,新华社权威AI时政资讯智能体“新华语典”正式上线。
Grok 4.5在SpaceX和特斯拉开启私测,性能接近或超越Opus
马斯克于6月28日发文确认,xAI旗下最新大语言模型Grok 4.5已正式在SpaceX和特斯拉内部启动私测。该模型基于1.5万亿参数的V9基础模型,并在补充训练中加入了Cursor数据。初步评估显示其性能已接近甚至可能超越Anthropic的Claude Opus,强化学习仍在持续显著改进模型,Grok Build工具链也在日趋完善。
马斯克还透露,SpaceX在今年剩余时间里,每月都将发布完全从头开始训练的新模型。此次私测标志着xAI在模型迭代和实际应用部署上的又一关键进展。
Claude Code v2.1.195发布:新增鼠标禁用环境变量,修复hook匹配与语音输入bug
Anthropic旗下Claude Code迎来v2.1.195版本更新。
本次新增环境变量,允许用户在全屏模式下禁用鼠标点击、拖拽和悬停操作,同时保留滚轮功能,提升了终端使用体验。
修复方面,本次更新解决了hook匹配器将含连字符标识符(如code-reviewer、mcp_brave-search)按子串匹配的bug,改为精确匹配;同时修复了macOS语音听写在默认输入设备变更后长期会话中录入静音的问题。Linux版语音模式也得到改进,可区分“无麦克风”与“未安装SoX”两种状态。

传特朗普政府即将解禁Fable 5模型,最快本周恢复访问
据Axios援引知情人士消息报道,特朗普政府即将准许Anthropic公司重新开放其Fable 5大模型的使用权限。报道称,内部人士预计政府针对Fable 5的限制最早将于本周解除。
奥地利敦促欧盟引入Anthropic落地运营,以反制美国AI出口限制
近日,奥地利政府正式提议欧盟应考虑在境内引入人工智能公司Anthropic,以此反制美国此前阻止外籍人士使用该公司最先进AI模型的举措。
在奥地利政府公开的一封致欧盟技术事务专员汉娜·维尔库宁的信件中,奥地利数字化国务秘书亚历山大·普罗尔明确表示,确保欧洲不被隔绝于重大创新之外至关重要。他呼吁:“让我们共同探讨Anthropic在欧盟内部进行战略性布局及参与的可能性。我们将为其提供法律确定性、市场准入、资本支持,以及一套契合该公司的价值观体系。”
马斯克宣布Grok 4.5开启内部私测,性能或超越Claude Opus
马斯克当地时间6月28日发文称,最新一代大语言模型Grok 4.5已正式在SpaceX和特斯拉内部开启私测。该模型基于1.5万亿参数的V9基础模型打造,并在补充训练中特别加入了热门AI编程工具Cursor的数据。早期评测结果显示,其性能已接近甚至可能超越Anthropic的旗舰模型Claude Opus。
目前,强化学习仍在持续显著优化该模型,配套的“Grok Build”测试基准也在日趋完善。马斯克还透露,SpaceX在今年接下来的时间里,每月都将发布完全从头开始训练的新模型。
谷歌限制Meta调用Gemini算力,致其AI项目延期受阻
据英国《金融时报》报道,谷歌已对Meta调用其Gemini人工智能大模型实施使用限制,原因是Meta申请的算力规模超出谷歌供给能力。谷歌母公司Alphabet约在今年3月告知Meta无法满足其所需算力资源。
受此影响,Meta多项内部人工智能项目进度受阻、被迫延期。报道称,Meta已要求员工节约使用AI Token以应对资源紧张局面。
马斯克获FTC批准收购Mesh,加码AI数据中心光通信布局
美国联邦贸易委员会(FTC)当地时间6月25日披露文件显示,埃隆·马斯克收购高速光模块初创企业Mesh Optical Technologies的交易已获监管批准,扫清了主要反垄断障碍。FTC文件显示,收购方登记为马斯克个人,交易编号为20261601。公开文件尚未披露交易金额及交割时间。
惠普与OpenAI达成战略合作,全面部署Frontier平台加速企业转型
当地时间6月28日,惠普公司宣布与OpenAI达成战略合作,将在其全球业务中全面部署OpenAI Frontier平台,以推动惠普的转型与增长计划。根据双方协议,Frontier平台将被广泛应用于惠普的各项业务中,旨在全面提升面向客户的体验并优化内部运营流程。
韩国宣布2000万亿韩元投资计划,三星SK联手打造“半导体AI帝国”
韩国总统6月29日在青瓦台主持召开会议,三星电子会长李在镕与SK集团会长崔泰源共同出席,正式宣布未来十年内两大集团在韩国本土的投资总额将逼近2000万亿韩元(约合1.3万亿美元)。该投资体量相当于2025年韩国名义GDP(约1.87万亿美元)的超七成。此次计划被命名为“三大超级项目”,涵盖半导体、AI数据中心和物理AI三大领域,旨在打破首都圈产业集中模式,向以全罗道为中心的西南地区大举投资
国内首款AI短剧画质提升工具“蝶变3.0”将于7月1日公测
6月26日,超高清技术应用企业4K花园宣布,旗下AI短剧画质提升工具“蝶变3.0”将于7月1日正式上线开放公测。该工具是国内首款面向AI短剧创作者的专业画质提升产品,通过后置画质修复替代前置反复的高算力“抽卡”模式,可针对人物服装纹理、道具细节、文字标识及场景材质等关键区域进行自然的细节重建与清晰度增强,帮助创作者降低隐性成本。据参与内测的创作者反馈,使用该工具可节省约一半以上的算力成本。
AIIA词元(Token)服务工作组筹备启动,信通院联合22家单位共建高质量Token生态
中国人工智能产业发展联盟(AIIA)词元(Token)服务工作组的筹备工作已于6月25日正式启动。该工作组由中国信息通信研究院牵头,联合华为云、百度智能云、中国移动、中国电信、中国联通等22家单位共同发起,旨在凝聚产业上下游合力,构建“高质量Token服务”生态体系。
SpaceX注册“SpaceXAI”商标,xAI将解散并入SpaceX
据社交媒体消息,SpaceX已注册“SpaceXAI”商标。马斯克表示xAI将不再作为独立公司运营,而是整体并入SpaceX,未来AI产品将以SpaceXAI品牌推出。此举标志着马斯克在AI战略上的重大整合,xAI的Grok系列模型及技术团队将直接服务于SpaceX的航天与星链业务。
国家统计局:1-5月规上工业企业利润增长18.8%,电子行业利润飙升103.9%
国家统计局数据显示,今年1至5月全国规模以上工业企业利润同比增长18.8%。其中电子行业利润增幅达103.9%,对整体利润增长贡献率达43.1%,主要受益于全球AI技术变革推动高端算力芯片和存储芯片需求爆发。
此外,原材料制造业利润增长83.1%,高技术制造业增长44.7%,企业每百元营收成本同比下降0.59元,营收利润率5.56%,为2024年以来累计最高水平。
“Raise Us”计划启动:前美商务部长与四川合作筹集10亿美元应对AI就业冲击
一项名为“Raise Us”的计划近日启动,由前美国商务部长与四川省政府合作,目标筹集10亿美元资金,用于应对人工智能对就业市场的冲击。该计划旨在通过再培训、教育转型和新兴岗位创造,帮助劳动力适应AI带来的产业结构变化。
据悉,合作将聚焦于AI伦理、技能重塑及区域经济平衡发展,探索中美在AI社会治理领域的务实合作新模式。具体实施方案及资金使用细则尚待进一步披露。
纽约时报修订版权诉讼,指控微软为OpenAI建造侵权超级计算机
《纽约时报》本周四提交修订后的法庭文件,对OpenAI和微软的版权诉讼提出新指控,明确指称微软通过建造全球最强大的超级计算系统之一,主动鼓励OpenAI窃取其作品。此举基于最高法院在Cox案中确立的新帮助侵权标准,要求原告证明被告有意诱导非法行为。
《纽约时报》认为新证据显示该超级计算机专为帮助OpenAI未经许可训练AI而设计,其文章在训练数据中被加权处理。微软则回应称该修订是“挽救不利先例的最后手段”。与此同时,近400家美国报纸也联合起诉微软和OpenAI,指控其未经授权抓取新闻内容训练AI模型,版权纠纷持续升级。





宠物品类交流群
家居品类交流群
母婴用品交流群
亚马逊运营干货包
TikTok运营干货包
跨境电商行业报告
跨境电商交流群
亚马逊卖家交流群
独立站卖家交流群
























