AI资讯OpenAI发布评估科学研究中AI判断力的新基准测试
2023年6月30日,日本OpenAI宣布推出一项名为“GeneBench-Pro”的新基准测试,旨在评估AI在计算生物学领域中的推理能力和判断力。 GeneBench-Pro专注于科学研究中所需的高级判断能力,包括处理模糊信息、修正假设、选择分析方法以及评估结果是否足以支持决策等。该基准测试能够衡量AI在复杂且反复的判断过程中表现的准确性。 该测试涵盖统计遗传学、群体遗传学、临床遗传学和药理遗
按时间排序浏览最新内容。
AI资讯2023年6月30日,日本OpenAI宣布推出一项名为“GeneBench-Pro”的新基准测试,旨在评估AI在计算生物学领域中的推理能力和判断力。 GeneBench-Pro专注于科学研究中所需的高级判断能力,包括处理模糊信息、修正假设、选择分析方法以及评估结果是否足以支持决策等。该基准测试能够衡量AI在复杂且反复的判断过程中表现的准确性。 该测试涵盖统计遗传学、群体遗传学、临床遗传学和药理遗
AI资讯SpaceX向投资者展示了一款类似手机的AI设备原型,尽管马斯克公开否认其存在,但市场传闻不断。
AI资讯LegalOn Technologies对其AI文档审查工具「DocumentOn」进行了更新,提升了广告及促销材料对日本景品表示法的合规审查能力。
AI资讯Cursor在被SpaceX收购后,是否还能保持开放平台的身份,继续提供来自OpenAI和Anthropic等竞争对手的AI模型,这一点尚不明朗。第三方AI模型一直是Cursor业务的重要组成部分。尽管近年来Cursor开始训练自有AI模型,但它始终允许用户从Anthropic、OpenAI及其他AI实验室的多种模型中选择,以支持其代码助手。 这种策略使Cursor能够为客户提供当时最优或最经济的
AI资讯印度连续创业者Bhavin Turakhia正亲自投资3000万美元,押注企业AI领域仍有发展空间。他的新项目Neo基于一个简单理念:AI时代之前设计的办公软件,不能仅靠添加聊天机器人来升级,而必须从头重新设计。 现年46岁的Turakhia在企业科技领域已有多年经验,曾联合创办Directi、Radix、Titan及银行软件公司Zeta等企业,通常先用自有资金支持,再引入外部投资。Neo项目同样
AI资讯Elith发布了面向企业的生成式AI使用可视化、控制及记录的安全管理SaaS“GENFLUX Security”,助力企业安全高效利用AI。
AI资讯EMYSTI发布了开源型工作台“Naikaku AI综合系统”,通过分工协作实现AI的计划、执行、评估和监督,确保业务流程的可追溯性和安全性。
AI资讯Ben Guez通过一个自动化脚本,结合OpenClaw、Claude代码和Instagram试验短视频,收到了“许多潜在的国际妻子私信”。 这位内容创作者兼创业者告诉TechCrunch:“我觉得这太疯狂了,潜力巨大。我不确定每个人是否都会觉得这好,但它确实有效。” Guez是如何吸引这么多女性的呢?他首先使用开源AI代理OpenClaw来追踪世界杯比赛结果。每场比赛结束后,OpenClaw会触
AI资讯软银携手日本静冈县藤枝市,利用国产生成式AI“Sarashina”及云服务推动自治体窗口业务数字化转型。
AI资讯日本IBM与商船三井合作打造了一款集成多种数据的AI平台,旨在提升船舶安全运营的决策效率和准确性。
AI资讯微软于周四宣布成立一家名为微软前沿公司的新运营业务,专注于利用微软现有的AI工具推动企业级AI部署的成功。该项目将获得微软25亿美元的投资支持,并汇聚6000名行业及工程专家。 微软商业业务CEO Judson Althoff在宣布该项目时,拒绝将其简单归类为“前沿部署工程师”(FDE)模式。他表示:“这超越了传统的前沿部署工程,未来将成为业界最大、最具能力、以结果为导向的工程组织。” 尽管如此,
AI资讯LocaNeco是一款无需将数据上传至外部服务器,即可在设备本地完成AI处理的应用,支持文本和图像生成。