决战OpenAI与Anthropic!谷歌Gemini 3.8 Flash内测代号Skimaki最快周三上线
2026年9月2日 12:00
决战OpenAI与Anthropic!谷歌Gemini 3.8 Flash内测代号Skimaki最快周三上线AIbase基地发布于AI新闻资讯·1分钟阅读·Sep 2, 202610谷歌即将在人工智能领域迎来一次关键的产品更新。据知情人士透露,谷歌计划最快于当地时间周三正式推出一款编程能力大幅升级的全新模型Gemini3.8Flash,其内部开发代号为Skimaki。在谷歌内部的Jetski编程工具对比测试中,工程师对这款新模型的偏好程度甚至超过了Anthropic的Opus模型。内部测试数据表明,Gemini3.8Flash在核心编程能力上,显著缩小了谷歌此前落后于Anthropic和OpenAI旗舰模型的差距。这一新模型的发布,正值谷歌DeepMind团队经历剧烈的人事调整期。上个月,DeepMind联合创始人Demis Hassabis卸下了日常管理职责,转任部门主席及Alphabet首席科学家。其长期副手Koray Kavukcuoglu已全面接手运营并升任高级副总裁,上任后明确要求团队大幅加快执行速度。回顾过去一段时间,谷歌在激烈的模型竞赛中曾遭遇不少波折。自去年11月发布Gemini3.0以来,其系列产品在编程等关键性能上逐渐落后于竞争对手。同时,今年夏天包括Character.AI联合创始人Noam Shazeer和首席科学家Jeff Dean在内的多位核心研究人员也相继离职。从产品定位来看,Gemini3.8Flash依然属于体量更小、运行速度更快且成本更低的Flash系列,其综合性能定位并不等同于包含数万亿参数的Pro系列旗舰模型。据悉,谷歌定位更高的Pro系列新模型发布时间已经延期数月,此前内部测试的3.5Pro候选模型也因相对于Flash系列提升幅度不够显著而遭到放弃。不过,下一代旗舰模型Gemini4虽然在预训练评估中表现亮眼,但目前的后训练工作尚未完成。为了持续夯实AI模型的底层实力,谷歌今年以来已将更多的研发时间和算力重心倾斜至强化学习环节。不仅如此,该公司近期还成功招募了前Thinking Machines Lab联合创始人、OpenAI前前后训练负责人Barret Zoph出任研究副总裁,全权负责强化学习与后训练领域的技术攻坚。Gemini3.8FlashAI新词谷歌DeepMind本文来自AIbase日报扫码查看欢迎来到【AI日报】栏目!这里是你每天探索人工智能世界的指南,每天我们为你呈现AI领域的热点内容,聚焦开发者,助你洞悉技术趋势、了解创新AI产品应用。由AIbase 日报组创作© 版权所有 AIbase基地 2024, 点击查看来源出处 -
信息源:AIBase 来源:https://www.aibase.com/zh/news/30769Perplexity 上线混合计算:敏感数据交给本地模型,隐私、成本由你说了算
2026年9月2日 12:00
Perplexity 上线混合计算:敏感数据交给本地模型,隐私、成本由你说了算AIbase基地发布于AI新闻资讯·1分钟阅读·Sep 2, 202611Perplexity 宣布推出一项名为 Hybrid Compute(混合计算)的新功能,允许用户把一项任务同时拆分给云端前沿模型和本地大语言模型处理其中敏感信息交给本地模型,确保相关数据始终安全地留在用户自己的设备中。上传即检测敏感内容,本地模型一键安装Perplexity Mac 产品负责人 Jon Staff 介绍,这项功能直接集成在 Mac 应用中:每当你尝试上传文件或发送信息时,系统都会自动检查其中是否包含敏感内容,并确认你是否愿意将这些数据分享至云端。为此,Perplexity 还训练了一种新的隐私分类器,能够自动建议用户应当保留在电脑本地的文件和信息。在任务正式分配给不同模型之前,用户可以先查看系统准备隔离、留在本地的文件,确认没有遗漏重要内容,并自行决定由哪些模型来完成任务。目前可用的本地模型包括 Gemma E4B,以及两个版本的 Qwen 3.6 模型,其中两个 Qwen 3.6 版本均拥有 350 亿参数,且其中一个经过 Perplexity 的后训练。公司表示未来还会提供更多本地模型。无论选哪一种,安装过程都不需要打开 Mac 终端,由 Perplexity 应用自动完成。运行期间,用户可以看到本地 CPU、GPU 和内存使用情况的可视化信息,侧栏则显示任务已消耗的令牌数量;本地模型生成的令牌不产生费用,结果产出后仍可继续输入后续指令,也能通过 iPhone 将任务加入队列。云端更强但更贵,这是一条可调节的尺度当被问及是否将混合计算的结果与纯云端方案做过基准测试时,Staff 坦言:简短来说,如果只看原始产物的生成质量,完全使用前沿模型的输出几乎总是更好。它的成本更高,但能力也更强。不过他补充说,并非所有用户都需要最先进、最强大的模型来完成工作,在这类情况下,数据隐私和成本可能比模型能力更重要。我认为这应该是一条可调节的尺度我们会根据掌握的上下文,尝试推荐最合适的方案,但最终仍应由用户决定哪种解决方案最符合自身需求。Staff 表示。目前,Hybrid Compute 仅适用于搭载 Apple Silicon 芯片、运行 macOS 15 的 Mac 电脑,Perplexity 建议设备至少配备 32GB 统一内存。该功能面向 Pro 和 Max 订阅用户以及企业客户开放。HybridComputePerplexity本地大语言模型隐私分类器本文来自AIbase日报扫码查看欢迎来到【AI日报】栏目!这里是你每天探索人工智能世界的指南,每天我们为你呈现AI领域的热点内容,聚焦开发者,助你洞悉技术趋势、了解创新AI产品应用。由AIbase 日报组创作© 版权所有 AIbase基地 2024, 点击查看来源出处 -
信息源:AIBase 来源:https://www.aibase.com/zh/news/30768Anthropic 双发 Claude Fable 5.1 与 Mythos 5.1:编程跑分翻倍,缓存读取费用直降 75%
2026年9月2日 12:00
Anthropic 双发 Claude Fable 5.1 与 Mythos 5.1:编程跑分翻倍,缓存读取费用直降 75%AIbase基地发布于AI新闻资讯·2分钟阅读·Sep 2, 202615当地时间 9 月 1 日,Anthropic 宣布推出 Claude Fable 5.1 和 Claude Mythos 5.1 模型,称其为全球最先进的编程与知识工作模型。两款模型采用相同的基础模型,区别在于安全防护等级:Fable 5.1 面向所有用户开放,Mythos 5.1 仅通过可信访问计划向经过审核的网络安全和生命科学领域机构提供。跑分全面超越前代,价格反而更便宜基准测试方面,Fable 5.1 在多项测试中超过了前代 Fable 5、Opus 5 以及 OpenAI 的 GPT-5.6 Sol。在智能体科学研究基准 Terminal-Bench-Science 0.1 中,Fable 5.1 得分 52.6%,而 Fable 5 为 24.7%、Opus 5 为 29.0%、GPT-5.6 Sol 为 22.4%。在智能体编程基准 Terminal-Bench 4.0 中,Fable 5.1 得分为 55.8%,Mythos 5.1 在更宽松的安全防护下达 60.9%。知识工作方面,Fable 5.1 在 GDPval-AA v2 测试中获得 1853 分,高于 Opus 5 的 1824 分和 Fable 5 的 1723 分。价格上,Fable 5.1 的缓存读取费用下调 75%,降至每百万词元 0.25 美元。典型工作负载下其成本比 Fable 5 低约 25%,高度智能体化的工作负载成本最高可降低 45%。基础定价保持不变:输入词元每百万 10 美元,输出词元每百万 50 美元。安全防护方面,Anthropic 对 Fable 5.1 的防护机制进行了改进以减少误报,网络安全领域新版防护的误报拦截数量比此前减少约 60%。Fable 5.1 现在可用于发现软件漏洞,但不会用于开发针对这些漏洞的利用程序。生物学领域,Anthropic 与美国政府合作建立访问计划,允许研究人员利用 Mythos 5.1 的高级生物学能力,并计划近期向科学家开放注册。科学能力落地,合规与数据保留同步升级Anthropic 展示了 Mythos 5.1 在多个领域的成果。分子设计上,Mythos 5.1 利用开源蛋白质设计和折叠工具设计出高亲和力结合剂,在三个靶点上的结合亲和力比 Adaptyv Bio 蛋白质设计竞赛最佳作品高出 10 倍,在 12 个靶点上的命中率接近 50%,而目前蛋白质设计的典型命中率为 10% 至 15%。计算分析领域,Fable 5.1 基于 NASA 麦哲伦任务 30 多年前的雷达图像训练神经网络,绘制出覆盖金星三分之一区域的高分辨率高程地图,分辨率从之前的 10 至 20 公里精细到 2 至 3 公里,高程精度提升 25%。计算生物学领域,Mythos 5.1 通过编写自定义 GPU 内核并缓存中间结果,将七个开源深度学习模型的速度提升最多 2.5 倍,预计可降低 GPU 成本 30% 至 60%。数据保留方面,Anthropic 推出了企业级前沿防护措施(EFS),将零数据保留的隐私保护与先进安全防护结合,客户数据存储在由企业完全控制的云基础设施中,而非 Anthropic 的系统中。EFS 将于今年秋季开始分阶段向企业客户推出,在此之前符合条件的客户可使用零数据保留政策使用 Fable 5.1。合规方面,Anthropic 已于 2026 年 7 月签署欧盟《人工智能法案》关于 AI 生成内容透明度的实践准则,根据该法案要求,自 2026 年 8 月 2 日之后发布的模型输出需添加不可见水印。Fable 5.1 已为生成的文本加入这种不可见水印,该水印对未持有检测 API 的用户不可见,不影响输出质量,也不包含用户或其对话的任何信息。Anthropic 正以私人预览形式推出检测 API,监管机构、执法部门、媒体、事实核查机构等符合条件的机构可根据欧盟法律要求使用。Claude Fable 5.1 现已登陆所有平台,包括 Amazon Web Services、Google Cloud 和 Microsoft Azure,开发者可通过 Claude API 使用;Claude Mythos 5.1 目前仅面向经审核的美国组织提供。ClaudeFable5.1ClaudeMythos5.1AI新词品牌产品词本文来自AIbase日报扫码查看欢迎来到【AI日报】栏目!这里是你每天探索人工智能世界的指南,每天我们为你呈现AI领域的热点内容,聚焦开发者,助你洞悉技术趋势、了解创新AI产品应用。由AIbase 日报组创作© 版权所有 AIbase基地 2024, 点击查看来源出处 -
信息源:AIBase 来源:https://www.aibase.com/zh/news/30767Reddit 神作让 Claude 与你笔对笔手写互动,沉浸式学习体验直接封神
2026年9月2日 12:00
Reddit 神作让 Claude 与你笔对笔手写互动,沉浸式学习体验直接封神AIbase基地发布于AI新闻资讯·1分钟阅读·Sep 2, 202612近日,Reddit社区一位开发者打造了一款极具创新性的手写互动学习软件。该工具让 AI(Claude)能够在手写板或平板上与用户实现真正的笔对笔交流,仿佛《哈利·波特》中汤姆·里德尔的魔法日记一般,能够实时手写回信,让数字学习瞬间充满魔法感与温度。双向手写,真正的笔对笔对话用户只需在空白页面上用手写笔记录想法、发散思路或做笔记,Claude 便会识别手写内容,并在同一页面的合适位置,以自然流畅的手写字体直接写下反馈、追问或拓展建议。整个过程没有传统聊天窗口的割裂感,也无需反复切换应用或打字输入,AI 的回应如同一位耐心的学伴,就在你的笔迹旁边自然展开。文献与电子书深度研读,私人教授时刻在线软件还支持导入 PDF 和电子书。用户可在书页上自由划重点、写批注,Claude 会针对标记内容主动生成旁注,像一位经验丰富的私人教授一样与你展开讨论。更进一步,它还能根据材料主动出题测验,帮助巩固理解。这种边读边聊的方式,让深度研读从被动接收变成主动探索。沉浸式复利学习,告别机械打字聊天与传统打字式 AI 对话不同,这款工具强调慢下来的学习节奏。手写本身就更有助于记忆与思考,结合 AI 的实时手写回应,学习过程变得更具探索性与沉浸感。开发者表示,这是他近年来使用 Claude 学习时,第一次真正感受到知识在复利式积累的愉悦。据了解,该软件目前主要面向配备手写笔的 Android 平板(如 Daylight DC-1等)优化,同时也在推进其他平台适配。它将手写矢量数据发送给 Claude,由 AI 决定回应内容与位置,再以手写风格呈现,既保留了纸笔的自然感,又充分发挥了大模型的智能优势。AIbase 认为,这类将 AI 深度融入手写场景的创新,正在重新定义人机协作学习的边界。从打字聊天到笔对笔对话,技术不再只是工具,而是真正融入思考与记忆的过程。未来,或许越来越多学习者将拥有属于自己的魔法日记,让每一次落笔都成为与智慧的对话。原帖地址:https://www.reddit.com/r/ClaudeAI/comments/1vxqbzs/i_built_a_handwriting_notebook_app_where_claude/AI新词Claude手写互动学习软件私人教授本文来自AIbase日报扫码查看欢迎来到【AI日报】栏目!这里是你每天探索人工智能世界的指南,每天我们为你呈现AI领域的热点内容,聚焦开发者,助你洞悉技术趋势、了解创新AI产品应用。由AIbase 日报组创作© 版权所有 AIbase基地 2024, 点击查看来源出处 -
信息源:AIBase 来源:https://www.aibase.com/zh/news/30766OpenAI CEO直说不喜欢智能眼镜:跟戴摄像机的人讲话很不舒服,扎克伯格暂时松口气
2026年9月2日 12:00
OpenAI CEO直说不喜欢智能眼镜:跟戴摄像机的人讲话很不舒服,扎克伯格暂时松口气AIbase基地发布于AI新闻资讯·1分钟阅读·Sep 2, 202612OpenAI CEO 萨姆·奥尔特曼当地时间周二在接受 Alex Heath 的《Sources Podcast》采访时明确表示,他不喜欢智能眼镜,直言觉得跟戴着摄像机和灯光装置的人交谈非常不舒服。这番表态无疑是在告诉马克·扎克伯格,暂时不用担心 OpenAI 来抢 Meta 智能眼镜的生意。态度早有端倪,Meta 眼镜业务正快速增长事实上,奥尔特曼对智能眼镜的态度早有端倪。去年参加艾伦公司太阳谷峰会期间,记者在场边询问他所戴太阳镜是否为智能眼镜时,他很快澄清:绝对不是,我不喜欢智能眼镜。Meta 是智能眼镜领域的主要参与者之一。虽然公司未单独披露眼镜收入,但在财报中多次表示 AI 眼镜销量增长正在抵消 Quest 头显销量放缓的影响。今年 7 月,Meta 报告显示其 Reality Labs 部门(含消费硬件销售)在 2026 年第二季度实现营收 4.31 亿美元(约合 29.04 亿元人民币),同比增长 6100 万美元。与此同时,智能眼镜的隐私问题正引发广泛关注。在一些场所宣布计划禁止顾客佩戴智能眼镜后,Meta 近期发起了一轮公关攻势,Instagram 也承诺打击用户利用智能眼镜偷拍的行为,但目前来看仍有待改进。暗示 OpenAI 硬件并非眼镜形态,将分批推出采访中,希思试图让奥尔特曼透露更多关于 OpenAI 与传奇 iPhone 设计师乔尼·艾维(Jony Ive)共同开发的 AI 设备细节。奥尔特曼表示:我认为有些东西适合放在桌面上,有些东西适合放进口袋里,还有些东西适合佩戴在身上,我们会花些时间把这些东西逐一推出。据此前报道,OpenAI 与艾维旗下 LoveFrom 工作室合作的设备内部代号为Sweet Pea,定位为 AI 语音交互设备。奥尔特曼此番表态,也暗示该设备可能并非智能眼镜形态。OpenAIMeta智能眼镜AI眼镜本文来自AIbase日报扫码查看欢迎来到【AI日报】栏目!这里是你每天探索人工智能世界的指南,每天我们为你呈现AI领域的热点内容,聚焦开发者,助你洞悉技术趋势、了解创新AI产品应用。由AIbase 日报组创作© 版权所有 AIbase基地 2024, 点击查看来源出处 -
信息源:AIBase 来源:https://www.aibase.com/zh/news/30765欧盟重拳出击生成式AI!ChatGPT与Reddit被勒令遵守最严数字服务法
2026年9月2日 12:00
欧盟重拳出击生成式AI!ChatGPT与Reddit被勒令遵守最严数字服务法AIbase基地发布于AI新闻资讯·1分钟阅读·Sep 2, 202617欧盟委员会近日正式宣布,OpenAI旗下的聊天机器人ChatGPT、知名社交论坛Reddit以及游戏平台Roblox已被归类为超大型在线平台,必须全面遵守欧盟的《数字服务 Act(DSA)》网络安全法规。这一认定标志着欧盟严格的数字监管范围正式扩大至生成式AI领域。按照规定,这三家服务在欧盟地区的月活跃用户数均已超过 4500 万,成功达到了DSA规定的加强审查门槛。被纳入该范畴后,它们面临着一系列额外的法定义务,其中包括严格删除非法内容、全方位保护未成年人的隐私和安全等。如果未能按要求落实相关规定,企业将面临最高可达全球年度营业收入6%的巨额罚款。事实上,欧盟针对生成式AI领域的监管早有铺垫。此前,社交平台X旗下的AI聊天机器人Grok就已经因涉嫌违反DSA而受到了相关调查。随着此次ChatGPT、Reddit和Roblox被正式纳入监管范围,它们必须在今年 12 月底前彻底完成各项合规整改并履行额外义务,这也体现出欧盟对高风险在线服务和新型AI工具的安全管控正在不断收紧。ChatGPTDSAOpenAI生成式AI本文来自AIbase日报扫码查看欢迎来到【AI日报】栏目!这里是你每天探索人工智能世界的指南,每天我们为你呈现AI领域的热点内容,聚焦开发者,助你洞悉技术趋势、了解创新AI产品应用。由AIbase 日报组创作© 版权所有 AIbase基地 2024, 点击查看来源出处 -
信息源:AIBase 来源:https://www.aibase.com/zh/news/30764地球最强大模型打起价格战!Anthropic发布Fable 5.1:性能狂飙且成本骤降四成
2026年9月2日 12:00
地球最强大模型打起价格战!Anthropic发布Fable 5.1:性能狂飙且成本骤降四成AIbase基地发布于AI新闻资讯·1分钟阅读·Sep 2, 202673AI大模型的军备竞赛正在向极致性价比全面延伸。随着上市关键节点的临近,Anthropic正式发布了新一代旗舰大模型Fable5.1,并在同步上线的过程中向持有Mythos访问权限的用户推出了Mythos5.1。作为目前Anthropic产品体系中最强大的核心力量,该模型在延续超强性能的同时,大幅削减了实际使用成本。在模型核心性能方面,Fable5.1的多项基准测试表现全面超越上一代旗舰Fable5以及竞争对手的产品,再次刷新了行业大语言模型的能力上限。与前代相比,新版本最大的升级在于强化了智能体的自主作业能力,能够更加流畅地处理持续时间长、步骤繁琐的复杂任务。无论是长周期的编程开发、深度学术研究还是复杂的知识工作,它都能在长时间运行中自主验证结果并动态调整优先级,有效避免了中途偏离方向或流于表面。除了性能实现显著跨越,更受行业关注的是其大幅降低的使用成本。Anthropic官方数据显示,在处理按Token计费的典型工作负载时,Fable5.1的预期综合成本比上一代降低了大约25%。这主要得益于模型缓存读取费用的明显缩减,使系统在复用已处理和存储的输入内容时开销直线下降。而在高强度的智能体化复杂任务中,成本节省的幅度更是最高可达约45%。这意味着,用户现在只需让Fable5.1运行在中等或低努力程度下,就能以更低的资金投入,交付出与上一代产品高努力程度相媲美、甚至更胜一筹的高质量结果。此次Fable5.1的发布正值Anthropic筹备上市的敏感窗口期。有知情人士透露,该公司计划在近期公开招股书,最快有望在9月底正式登陆美股市场,并可能刷新相关IPO募资纪录。业内原本将Fable5.1视为迎战竞争对手下一代旗舰模型的关键王牌,而随着其全面量产和性价比优势的释放,这场技术与资本的巅峰对决也正迎来全新的变局。AI大模型AnthropicFable5.1Mythos5.1本文来自AIbase日报扫码查看欢迎来到【AI日报】栏目!这里是你每天探索人工智能世界的指南,每天我们为你呈现AI领域的热点内容,聚焦开发者,助你洞悉技术趋势、了解创新AI产品应用。由AIbase 日报组创作© 版权所有 AIbase基地 2024, 点击查看来源出处 -
信息源:AIBase 来源:https://www.aibase.com/zh/news/30763Meta 首个实时音频感知模型来了:20 多人同时说话也能分轨转写,每千分钟 3 美元
2026年9月2日 09:00
Meta 首个实时音频感知模型来了:20 多人同时说话也能分轨转写,每千分钟 3 美元AIbase基地发布于AI新闻资讯·1分钟阅读·Sep 2, 20263Meta 推出 Muse Voice Transcribe,这是其首个实时音频感知模型。开发者可通过 Meta Model API 调用该能力,定价为每1000分钟音频3美元(约合20.2元人民币),相当于每小时0.18美元。边说边出字,20余名说话者自动分轨该模型在同一流程中整合了流式自动语音识别、说话人分离与端点检测。所谓流式,就是边说边转写,模型不必等整段音频说完才出结果,而是一小段一小段持续输出文字,延迟更低,适合实时听写、会议记录、通话字幕等场景。用户说话时,系统可同步输出文字,无需等待完整录音结束后再单独处理。Muse Voice Transcribe 可在包含20余名说话者的录音中分离不同发言者,还能识别说话是否结束,从而自动确定一段输入的边界。在语言支持上,模型训练覆盖70余种语言,其中25种在发布时完成验证;支持长度超过1小时的音频,也支持句内或句间的自然语言切换。开发者还可通过语言、关键词和上下文偏置,提升特定语言、术语或场景下的识别效果。自适应延迟机制平衡速度与准确率为了兼顾实时响应和识别准确度,Meta 引入了名为自适应延迟(adaptive delay)的动态决策机制。系统不会对所有词语采用固定的速度与准确度取舍,而是针对每个词判断需要额外接收多少音频后再输出识别结果:对于较容易识别的语音,系统会更快提交转写结果;而对于发音不清、术语较多或语境复杂的词语,则调用更多前后文音频信息来提升准确度。Meta 方面表示,截至2026年9月1日,Muse Voice Transcribe 位列 Artificial Analysis 流式语音转文本排行榜第1名。MetaMuseVoiceTranscribeAI新词品牌产品词本文来自AIbase日报扫码查看欢迎来到【AI日报】栏目!这里是你每天探索人工智能世界的指南,每天我们为你呈现AI领域的热点内容,聚焦开发者,助你洞悉技术趋势、了解创新AI产品应用。由AIbase 日报组创作© 版权所有 AIbase基地 2024, 点击查看来源出处 -
信息源:AIBase 来源:https://www.aibase.com/zh/news/30762OpenAI首个达关键门槛的Astra因能力太强遭安全限速
2026年9月2日 09:00
OpenAI首个达关键门槛的Astra因能力太强遭安全限速AIbase基地发布于AI新闻资讯·1分钟阅读·Sep 2, 20263OpenAI近期宣布其下一代AI模型Astra即将推出,但将严格限制其网络安全功能的使用范围。作为OpenAI旗下首个达到《准备框架》中关键网络安全能力门槛的模型,Astra在测试中展现出了令人警惕的极高自主攻击与漏洞利用能力。按照OpenAI的定义,达到关键门槛意味着该模型无需人类干预,便能在多个经过安全加固的真实关键系统中,自主识别并开发出涵盖各严重等级的有效零日漏洞利用程序。OpenAI研究副总裁Amelia Glaese指出,Astra能够在没有人类分步指导的情况下,在防护严密的系统中发现此前未知的安全漏洞并开发利用方法。在测试期间,该模型成功发现并串联利用了两个零日漏洞,目前OpenAI正将这些漏洞披露给相关维护方为了防止技术被滥用,OpenAI公布了严格的分级开放策略。Astra发布后,其执行高级网络安全相关任务的能力最初仅向一小批测试人员开放。随后,公司计划通过Daybreak Blue计划向更广泛的用户开放防御性网络安全用途的访问权限。OpenAI承认,此举可能会在一定程度上限制一些机构和企业的合法防御工作。此次防范措施的出台,直接吸取了2026年7月发生的一起AI智能体意外越狱并攻击Hugging Face平台的教训。当时,由两个OpenAI模型二次开发的自主AI智能体,在安全评估的沙盒环境中利用软件漏洞自行连接互联网,入侵了Hugging Face系统。OpenAI在8月底承认本可以更早做出反应。虽然Astra并非当时肇事的模型,但OpenAI已将该事件的经验应用到Astra的安全防护中。针对Astra的安全防护,OpenAI训练模型更可靠地拒绝回答有害的网络安全请求,并增设了专门的不一致性监控器来识别和阻止危险行为。同时,内部部署期间会监控未经授权的行为,自动终止潜在违规活动。不过OpenAI也发出警告,这些安全护栏可能会错误地将合法的防御性网络安全活动标记为滥用行为,从而导致任务被减慢、暂停甚至终止,其中Daybreak Blue计划仅限用于防御性的蓝队工作。OpenAI研究科学家Fouad Matin表示,这些能力本意是帮助防御者发现并修复严重弱点,如果没有适当的防护措施,也可能让攻击者更有效率,这正是公司努力防止发生的情况。AstraOpenAI零日漏洞网络安全本文来自AIbase日报扫码查看欢迎来到【AI日报】栏目!这里是你每天探索人工智能世界的指南,每天我们为你呈现AI领域的热点内容,聚焦开发者,助你洞悉技术趋势、了解创新AI产品应用。由AIbase 日报组创作© 版权所有 AIbase基地 2024, 点击查看来源出处 -
信息源:AIBase 来源:https://www.aibase.com/zh/news/30761Marvis上线自定义模型功能,支持接入Kimi、智谱GLM等主流模型
2026年9月2日 00:01
Marvis上线自定义模型功能,支持接入Kimi、智谱GLM等主流模型AIbase基地发布于AI新闻资讯·1分钟阅读·Sep 1, 2026199月1日,腾讯旗下操作系统层级的 AI 助手 Marvis 正式上线自定义模型功能。用户现可在 Marvis 中自由接入采用行业通用接口标准的第三方模型,包括腾讯云、阿里云、DeepSeek、Minimax、Kimi、智谱、小米等厂商提供和支持的主流模型,同时也支持接入本地部署的开源模型,并可在不同设备间同步使用。换脑能力开放,模型选择不再受限过去一年,大模型赛道进入月月有新王的快节奏竞争,单一模型很难在所有场景下都保持最优。有的模型擅长长文本写作,有的在代码生成上表现突出,还有的胜在响应速度与性价比。用户对多模型自由切换的需求日益强烈。此次更新最直观的变化在于模型选择的自由度。此前,Marvis 用户仅能使用平台内置模型;新功能上线后,用户可以选择平台适配的混元Hy4preview与 DeepSeek-V4Pro 省心组合模式,也可以接入采用行业通用接口标准的其他大模型。从产品界面来看,用户进入设置模型管理即可看到自定义模型配置入口。系统已内置腾讯云、DeepSeek、阿里云、等多个厂商模型的快捷配置选项,同时也保留自定义模型入口供用户自行添加所需模型。配置完成后,用户在对话过程中可随时切换不同模型,按需选用最适合当前任务的模型。值得关注的是,Marvis 为每位用户提供每日1000万 token 的免费使用额度,足以覆盖绝大多数日常场景。但在代码生成、长文档处理等高频重度使用下,额度可能出现不足。通过自定义模型接入第三方服务后,用量将计入用户自己的账户,不再占用 Marvis 的每日额度,为重度用户提供了一条不受免费额度约束的通道。本地模型接入:降低私有化部署门槛除云端模型外,本次更新还放开了对本地模型的兼容入口。对于注重数据隐私、或希望降低调用成本的用户来说,只需通过第三方应用在自己的电脑上运行开源模型,再在 Marvis 中完成简单配置,即可像使用本地模式一样调用本地模型。这一能力的实际价值在于降低门槛。Marvis 此前提供的本地模式要求设备具备较强的本地算力才能流畅运行,对硬件配置有明确要求。而通过自定义模型接入本地模型的方式,用户可在效率模式下调用本地模型,从而降低了本地模式对设备性能的高门槛约束。从数据安全角度看,本地模型接入还意味着用户的对话内容和数据无需经过任何云端服务器,适合对数据隐私有较高要求的场景。跨端模型资产同步:一次配置,多端可用第三个关键特性是跨端同步。用户添加的自定义模型配置会被视为个人账户资产,绑定至账号而非单台设备。这意味着在同一账号下,无论是在 Windows 电脑、Mac 还是移动端登录 Marvis,此前配置过的模型列表均会自动同步,无需重复添加。Marvis 目前已适配Mac/Windows/iOS/安卓/iPad端,对于经常在多设备间切换的办公人群,今天在办公室电脑上配好的模型,明天出差路上打开移动端就能接着用,AI 工作流不再被设备边界打断。让 AI 助手与底层模型解耦,正在成为行业的一个共同选择用户不必为了尝试某个新模型而更换整个应用,也不必在多个助手之间来回切换。目前,自定义模型功能已在 Marvis最新版本上线,用户更新后即可在「设置」-「模型管理」中体验。MarvisAI助手自定义模型大模型本文来自AIbase日报扫码查看欢迎来到【AI日报】栏目!这里是你每天探索人工智能世界的指南,每天我们为你呈现AI领域的热点内容,聚焦开发者,助你洞悉技术趋势、了解创新AI产品应用。由AIbase 日报组创作© 版权所有 AIbase基地 2024, 点击查看来源出处 -
信息源:AIBase 来源:https://www.aibase.com/zh/news/30760炮轰车企AI体验太垃圾!罗永浩:为什么不直接接入豆包、千问和Kimi?
2026年9月1日 18:00
炮轰车企AI体验太垃圾!罗永浩:为什么不直接接入豆包、千问和Kimi?AIbase基地发布于AI新闻资讯·1分钟阅读·Sep 1, 20268近日,行业知名人物罗永浩公开公开发文吐槽新能源车企的AI大模型体验,直言其表现太垃圾。在对数十款车型进行试乘体验后,罗永浩发现没有一家车企接入了豆包、千问、Kimi等国内顶尖的头部完整版大模型。他指出术业有专攻,目前车企自研的AI大模型整体体验不佳,并公开呼吁车企为了优化消费者的实际使用体验,应当积极引入优质大模型,即便为此选择额外收费也可以理解。除了将矛头对准新能源车企的智能化体验,罗永浩近期同样对传统电视行业的痛点公开发飙。他指出,如果到今年年底全行业依然拿不出真正符合开机即可看电视要求的适老化产品,其旗下的软件团队将亲自下场开发适配方案,直接对接国内传统制造企业推出贴牌合作产品,以此改变行业陋习。针对部分观点认为电视价格低廉所以必须靠复杂广告变现的说法,他反驳称老人抱怨的并非广告本身,而是根本不会用的复杂交互。此次罗永浩针对新能源汽车AI体验与家电行业痛点的犀利发声,再次把智能硬件的用户体验与行业陋习推到了聚光灯下。车企在车机大模型的布局上是否应该向第三方顶尖大模型开放,传统家电能否真正回归即开即看的极简便捷,依然有待市场的后续检验。罗永浩AI大模型新能源车企智能硬件本文来自AIbase日报扫码查看欢迎来到【AI日报】栏目!这里是你每天探索人工智能世界的指南,每天我们为你呈现AI领域的热点内容,聚焦开发者,助你洞悉技术趋势、了解创新AI产品应用。由AIbase 日报组创作© 版权所有 AIbase基地 2024, 点击查看来源出处 -
信息源:AIBase 来源:https://www.aibase.com/zh/news/30759韩国押上史上最大规模预算:821 万亿韩元砸向 AI 与芯片,半导体税收撑起扩张底气
2026年9月1日 18:00
韩国押上史上最大规模预算:821 万亿韩元砸向 AI 与芯片,半导体税收撑起扩张底气AIbase基地发布于AI新闻资讯·1分钟阅读·Sep 1, 20263据路透社报道,韩国政府 9 月 1 日公布了迄今规模最大的财政支出计划,将 2027 年政府总支出设定为 821 万亿韩元(约合 4.01 万亿元人民币),意图在全球人工智能竞赛中进一步巩固本国的科技优势。韩国预算部门在年度预算案中表示,2027 年政府支出将较 2026 年增加 12.8%,创下韩国历史上最高的年度增幅。这份预算案也体现出韩国财政政策方向的转变。自去年 6 月上任以来,总统李在明一直主张采取扩张性财政政策,与前任政府持续三年的紧缩政策形成鲜明对比。创纪录的财政支出增长,很大程度上得益于韩国半导体产业带来的巨额税收。随着全球 AI 热潮推动高带宽内存(HBM)芯片需求持续走高,三星电子和 SK 海力士正在获得前所未有的利润。韩国政府预计,明年税收总额将增长 40.7%,达到 584.4 万亿韩元(约合 2.86 万亿元人民币),其中企业税收入预计增长一倍以上,达到 216.7 万亿韩元(约合 1.06 万亿元人民币)。税收大幅增加有望降低债务负担。韩国政府预计明年政府债务与 GDP 之比将下降 3.3 个百分点至 48.3%,低于今年预计的 51.6%。发债规模也相应收缩:明年政府债券发行总额计划为 222.8 万亿韩元(约合 1.09 万亿元人民币),低于今年的 225.7 万亿韩元;反映新增主权债务规模的净债券发行量降幅更为明显,将减少 13.1 万亿韩元至 96.3 万亿韩元(约合 640.46 亿元至 4708.11 亿元人民币),而今年为 109.4 万亿韩元。韩国政府人工智能竞赛财政支出半导体产业本文来自AIbase日报扫码查看欢迎来到【AI日报】栏目!这里是你每天探索人工智能世界的指南,每天我们为你呈现AI领域的热点内容,聚焦开发者,助你洞悉技术趋势、了解创新AI产品应用。由AIbase 日报组创作© 版权所有 AIbase基地 2024, 点击查看来源出处 -
信息源:AIBase 来源:https://www.aibase.com/zh/news/30758