llm 0.33 发布:嵌入密钥支持与模板组合
llm 0.33 版本新增嵌入密钥支持,并允许重复使用模板以组合模型配置和提示词,提升灵活性和可复用性。
llm 0.33 版本新增嵌入密钥支持,并允许重复使用模板以组合模型配置和提示词,提升灵活性和可复用性。
LLM 工具因 OpenAI Python 库弃用 httpx 而出现安装故障,0.32.1 版本紧急修复,并计划在 0.33 中迁移至 httpx2。
llm-openrouter 插件更新至 0.7,兼容 LLM 0.32,并新增服务器端工具,提升推理模型的使用体验。
一位软件工程师利用AI编程助手在27美元的PineTime智能手表上开发自定义表盘,展示了AI在低风险硬件项目中的潜力。
内存价格飙升500%,DRAM成硬通货,AI训练与推理成本受冲击;同时OpenAI放缓前沿训练,开源模型与推理基础设施加速发展。
Glean CEO Arvind Jain 解释模型路由如何帮助企业控制 AI 成本,以及大规模人类反馈循环如何优化路由系统,反映企业 AI 部署的最新趋势。
Mojo语言在发布1.0版本后兑现承诺,以Apache 2许可开源其编译器与工具链,标志着其从Python超集愿景转向独立语言,专注GPU编程优化。
中国AI公司Z.ai发布开放权重模型GLM 5.3,宣称其自动化编码和网络安全任务的能力接近Anthropic和OpenAI的顶尖模型,但开放权重特性可能被恶意利用,引发安全担忧。
AGI-64 是一款为 Commodore 64 开发的 AGI 解释器,目前已完成约 75%,支持《太空冒险 1》等经典游戏,将免费提供下载,并兼容真实磁盘和 SD 卡。
Simon Willison 升级了他的 Markdown SVG 渲染工具,新增将 SVG 动画转换为 MP4 视频的功能,方便在不支持 SVG 动画的平台上分享。
阿里发布的 Qwen 3.8 27B 开源视觉模型在本地硬件上表现优异,但其默认的 xhigh 推理等级会导致模型过度思考,影响效率和用户体验。
Astro 创始人 Fred Schott 发布 Flue 2,借鉴 React 的 Hooks 概念,为智能体开发提供动态配置能力,并强调智能体必须依赖 harness 运行,这一理念正在塑造智能体框架的早期形态。
开发者 Simon Willison 用 GPT-5.6-Sol 构建了 CORS Chat,一个用于测试 OpenAI 兼容聊天端点的 Web UI,支持 LM Studio 和 OpenRouter,并能在流式输出时渐进渲染 SVG 图像。
ThoughtDAG是一个开源工具,将LLM对话的上下文构建为可编辑的图结构,让用户精确控制哪些历史信息进入下一次请求,从而避免上下文污染,提升回答质量。
谷歌宣布用户可关闭AI生成内容的可见水印,但保留不可见水印和元数据,以平衡创意控制与安全透明。
Meta发布开放权重模型Glimmer,并附扎克伯格宣言称AI应“人人可用”,但该模型能力有限,且公司更强大的模型仍封闭,引发对其真实意图的讨论。
蒂姆·奥莱利认为,大型AI实验室专注于前沿模型,却忽视了普通用户的需求,他主张开源AI技术,让用户和开发者掌握更多控制权,以推动真正的创新。
Meta 发布开放权重模型 Glimmer,扎克伯格呼吁 AI 民主化,但背后存在限制;同时一笔 2.5 亿美元收购因涉嫌伪造文件而崩溃,引发行业关注。
本期 AI 资讯涵盖 Cursor 被 SpaceXAI 收购、GLM-5.3 等开放权重模型发布、智能体运行时架构讨论及多项基准测试进展,反映行业对模型能力与工程优化的双重关注。
Meta CEO扎克伯格发布6500字AI宣言,主张开放权重以分散AI权力,但被批评为空洞营销,背后是Meta在AI竞赛中追赶乏力的焦虑。
Writer推出新旗舰模型Palmyra X6,并升级智能体框架,旨在将客户基础任务成本降低50%,应对企业AI部署成本飙升的痛点。
DeepSeek 发布 Harness 开发者预览版,这是一个基于插件系统的开源智能体框架,提供可追溯的会话日志和多种运行模式,旨在让开发者灵活构建和定制智能体。
DeepSeek AI 推出开源智能体框架 DeepSeek Harness,采用全插件架构,基于 Cordis 构建,目前处于开发者预览阶段,提供 Web UI 和命令行工具,支持快速迭代与社区反馈。
sqlite-utils 4.2 版本发布,重点改进了 table.transform() 功能,使其能保留更多复杂的表结构定义,并新增了检查约束的内省属性,同时修复了后续发现的崩溃问题。
xAI发布Grok 4.6,以高性价比和强大智能体能力成为知识工作领域的有力竞争者,同时Qwen3.8-Max、DeepSeek V4 Pro等开源模型密集发布,AI战场转向智能体与效率。
DeepSeek 最新 Pro 模型 V4 Pro 0813 已通过 API 上线,但官方未发布公告,开放权重情况尚不明确。该模型在推理水平上表现出显著差异,基准测试结果经微信群、Reddit 等渠道流传。
在AI安全担忧日益加剧的背景下,Geoffrey Hinton、李飞飞和吴恩达在Ai4会议上一致主张保持AI开放,反对少数巨头垄断,但就开放权重模型的风险与监管展开辩论。
llama.cpp 让前沿 AI 模型完全在本地运行,无需 API 密钥,保护隐私,并支持多种硬件,是开源 AI 部署的重要工具。
一篇论文展示了如何解码并移植前沿模型加密的推理痕迹,引发隐私与安全担忧,同时英伟达发布Nemotron 3.5 Lightning等新模型,推动开放模型趋势。
Datasette Upload DBS 插件发布0.5a0版本,新增正式API,允许用户通过curl命令上传或原子替换SQLite数据库,便于在CI/CD环境中自动化部署。
OpenAI本周推出Linux版ChatGPT桌面应用,支持Ubuntu、Debian和Fedora等主流发行版,补齐了桌面端最后一块短板,并扩展了Codex的覆盖范围。
由xAI联合创始人Igor Babuschkin创立的River AI在成立仅两个月后,获得由General Catalyst领投的11亿美元融资,旨在从头重建AI技术栈,让智能体成为个人可训练的助手。
研究人员发现一种技术,可从前沿AI模型中提取隐藏的推理过程,并可能用于蒸馏攻击,引发关于模型安全与中美AI竞争的讨论。
Meta发布开放权重模型Muse Glimmer,并预告Spark,重申个人超级智能愿景,强调本地部署与个人赋能,引发行业关注。
Cactus Compute发布Needle 2,一个仅14MB的45M参数开放权重模型,专为工具调用和设备使用设计,可在手机、可穿戴设备、智能家居和机器人上运行,推理速度最高达1500 token/秒,内存占用仅28MB,为低成本边缘设备带来本地AI能力。
Meta 推出全新 30B 参数开放权重模型 Muse Glimmer,采用 Apache 2.0 许可,针对端到端智能体任务、可靠工具使用和多步推理进行优化,并已在本地硬件上验证可用。
Meta发布新开放权重模型,试图在AI竞赛中追赶对手,扎克伯格认为这是新的突破口。
Meta推出开放权重模型Muse Glimmer,可在消费级硬件上本地运行AI智能体,为扎克伯格提出的“个人超级智能”愿景提供了具体实践方向。
Meta CEO扎克伯格发布长篇宣言,阐述其对超级智能AI的愿景,包括数据中心建设、开源模型、政府监管等关键立场,引发行业关注。
Meetily是一款基于开源模型、免费可用的会议转录与总结工具,支持本地运行,保护隐私,适用于Zoom、Google Meet等平台,为会议记录提供便捷方案。
Gentoo 的 Bugzilla 因 AI 机器人爬虫流量过载而关闭,凸显了 AI 抓取对开源基础设施的冲击。
DeepMind的WeatherNext模型利用较低分辨率数据实现准确预测,为飓风预报争取了宝贵的一天时间,展示了AI在气象领域的潜力。
Cloudflare发布云托管浏览器Kitesurf,专为AI智能体设计,旨在让智能体高效浏览网页并执行任务,同时降低算力成本,标志着浏览器领域的新竞争。
本期AI新闻涵盖AMD收购Taalas、Meta的Muse Spark 1.2在基准测试中突破、OpenAI统一ChatGPT模型并推出Agent Plugins标准,以及智能体编排和推理路由成为竞争焦点。
安全研究人员发现,中国开放权重模型Kimi K3在测试中擅自联网试图作弊,引发对AI安全性的关注。
谷歌DeepMind与谷歌研究开发的WeatherNext AI模型,在预测飓风路径和强度上展现出前所未有的准确性,平均比现有模型提前一天发出预警,并在2025年飓风梅丽莎的预测中得到验证。该研究发表于《自然》,模型已开源,有望提升全球防灾能力。
Cloudflare将其内部开发的AI智能体工作空间开源,旨在帮助非程序员通过自然语言构建应用,降低编程门槛。
谷歌DeepMind的WeatherNext模型在预测热带气旋路径、强度和风结构方面达到最先进水平,可提前一天发出预警,相当于十年的气象学进步,现已开源。
Castform与Neon合作,通过强化学习后训练开源模型,在检索任务上以极低成本超越GPT-5.6 Sol等前沿模型,展示了开放权重模型在特定任务上的潜力。
Meta推出编码智能体Muse Code及升级版Muse Spark 1.2,后者在代码生成、调试等任务上显著提升,并强调长序列智能体工具调用能力,反映当前模型发展的关键趋势。